驯服 DeepSeek V4:为何模型拒绝调用工具?揭秘角色扮演对指令的干扰
针对近期用户反馈的 DeepSeek V4“不听话”及工具调用失效问题,本文进行了深入的技术排查与实证分析。测试发现,DeepSeek V4 具有极强的“角色扮演特化”倾向,当提示词中包含人物设定时,模型会优先沉浸在角色逻辑中,导致其忽视 ...
针对近期用户反馈的 DeepSeek V4“不听话”及工具调用失效问题,本文进行了深入的技术排查与实证分析。测试发现,DeepSeek V4 具有极强的“角色扮演特化”倾向,当提示词中包含人物设定时,模型会优先沉浸在角色逻辑中,导致其忽视 ...
日前,马里兰大学、新加坡国立大学和俄亥俄州立大学联合完成的一项研究揭示了AI招聘中的算法偏见。研究人员利用GPT-4o、DeepSeek-V3等主流模型重写真实简历,并让AI担任“招聘官”进行盲评。结果显示,AI招聘官几乎一边倒地选择AI重...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
在使用 Claude Code 编程时,Auto 模式因兼顾流畅性与安全性被视为最优解,但官方限制其仅支持 Claude 模型。近日有开发者发现,通过开启 CCS 的本地路由功能并启动客户端,可以将 GLM、DeepSeek、GPT 等第三...
本文介绍了全新 AI 写作工具 Prose,并演示了其撰写综述论文的全过程。与 DeepSeek 等通用大模型不同,Prose 采用交互式卡片引导选题与大纲生成,并内置学术文献检索功能。其最大亮点在于将大纲与写作区分离,支持结构化写作和增量...
近日,有开发者尝试将 DeepSeek 模型集成至 Anthropic 的 Claude Code (VSCode插件) 时遭遇技术阻碍。尽管用户通过公司内部 API 中转站配置,并在 ccswitch 工具中测试连接成功,后台日志也显示有...
据Linux.do社区用户爆料,华为昇腾910B2芯片已成功适配DeepSeek V4 Flash大模型,并展现出不俗的推理性能。消息称,单张910B2服务器能够稳定支撑20路并发推理服务。这一进展不仅意味着国产AI芯片在软件生态适配上进一...
据Linux.do社区用户反馈,在OpenCode 1.14.26版本中测试DeepSeek V4 Flash模型时遇到了严重的体验问题。即便面对简单的查询,该模型也常陷入长达10分钟的过度思考,甚至出现反复修改代码回退或执行Git指令卡死...
近期在开发者社区中,多位用户反馈 DeepSeek 模型存在严重的工具调用失效问题。具体表现为:模型能够正确识别并理解可用的工具或技能,在思维链中也明确规划了调用步骤,但在最终执行时却“忘记”了生成实际的调用代码,导致功能空转。该 Bug ...
近日,有开发者指出在使用 DeepSeek 模型的“思考模式”时存在 API 兼容性缺陷。在日常编码需要切换不同模型的场景中,若对话历史涉及其他模型,切换回 DeepSeek 时会触发报错,提示“thinking mode 中的 conte...
继昨日 Pro 版 API 限时降价后,DeepSeek V4 宣布进一步下调输入缓存价格,大幅提升模型使用的成本竞争力。官方文档已更新具体明细,这一系列举措显示出其在争夺市场份额上的激进策略。此外,社区热议后续华为昇腾超节点的上线情况,业...