DeepSeek 陷“贴吧味”风波,数据清洗短板暴露了 AI 落地的现实挑战
近日,有用户在测试 DeepSeek 专家模式时发现,面对一道简单的逻辑题,模型竟输出了带有明显贴吧社区风格甚至“粗口”的回复。这一现象迅速在技术圈引发热议,并被指可能源于训练数据中混入了未清洗的百度贴吧语料。作为国产大模型的佼佼者,Dee...
标签索引 / 第 24 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,有用户在测试 DeepSeek 专家模式时发现,面对一道简单的逻辑题,模型竟输出了带有明显贴吧社区风格甚至“粗口”的回复。这一现象迅速在技术圈引发热议,并被指可能源于训练数据中混入了未清洗的百度贴吧语料。作为国产大模型的佼佼者,Dee...
近日有开发者在V2EX分享了对DeepSeek新模型(被称为V4)的实测体验。相比早期版本在生产环境下的乏力表现,新版本的能力有了显著增强。然而,性能的提升也带来了成本的剧增,一个简单问题的测试竟花费了5元人民币。虽然效果惊艳,但高昂的To...
近日,有技术爱好者在Linux.do社区反馈,DeepSeek V4 Pro模型在接入OpenWebUI时出现报错,提示思维模式内容必须回传。经排查,这是由于DeepSeek特有的思维链(CoT)机制需特定返回格式,而OpenWebUI尚未...
近日,DeepSeek V4 版本的文档中推荐了一款名为 ‘Continue’ 的 VS Code 插件作为代码补全工具,引发了技术社区的广泛关注。尽管该插件在 GitHub 上颇受好评,但在 Linux.do 论坛...
近日,技术社区Linux.do上一篇关于DeepSeek新版本的讨论引发关注。作者高度评价该模型在“世界知识”层面的表现,认为其预训练技术实现了巨大突破,认知能力已超越Claude和GPT,直逼Gemini。相比之下,国内其他大模型多沉迷于...
近日,DeepSeek 团队成员在 GitHub 发布了 V4 版本的角色扮演与思考模式切换指南。该文档揭示了在 APP 专家模式及 API 中,通过特定的提示词指令(如【角色沉浸要求】或【思维模式要求】),可引导模型生成包含内心独白的“角...
近日,DeepSeek V4 模型在一次逻辑测试中表现出色。当面对“容器R里有几个草莓”这一定义模糊的难题时,该模型没有像以往的大语言模型那样强行“过拟合”或产生幻觉给出答案,而是主动反问用户“R”的具体定义。这种“不懂会问”的交互方式,被...
近日有开发者在社区反馈,DeepSeek模型在处理一项复杂的字符串解码任务时出现异常,思考时间超过2分钟仍无任何输出,且Web端与API端均存在该问题。在同等测试条件下,GPT与豆包虽未给出正确答案,但能快速响应并给出结果,仅有Gemini...
社区针对DeepSeek-V4模型进行了编码能力实测,发现初期测试结果平平实则是配置不当所致。核心解决方案在于将环境变量 `CLAUDE_CODE_EFFORT_LEVEL` 设为 `max`,并确保所有子代理模型均指向 `deepseek...
AI独角兽DeepSeek在GitHub提前发布了完全重构的专家并行通信库DeepEP v2。新版本旨在解决初代产品的技术债务,在延续V3配置的测试中,不仅将峰值性能提升至1.3倍,更将GPU流处理器资源占用降低了4倍。架构上,v2版弃用N...