本文源于用户在 Linux.do 的反馈,指出了 DeepSeek 在实际应用中存在的显著短板。尽管该模型在理论上能深刻阐释 LLM 与人类语言机制的差异,展现了不错的基础能力,但在具体的搜索任务中表现不佳。测试发现,DeepSeek 缺乏主动使用工具的意识,无法从搜索结果网页(如时间网站)中准确读取关键信息,甚至在模型版本认知上出现偏差,暴露了其作为 AI Agent 在信息抓取和执行环节的不可靠性。
DeepSeek 搜索实测:虽有深度解析,但工具调用的“常识”依然欠缺
未经允许不得转载:80aj » DeepSeek 搜索实测:虽有深度解析,但工具调用的“常识”依然欠缺
相关推荐
AI Agent 入门课: 用 DeepSeek Harness 学五层工程能力
DSH MCP Manager 配置指南: OAuth、stdio 与工作区隔离
火山方舟 Coding Plan 实测:搭配 Claude Code 的省钱工作流
大模型周刊 第 36 期:监管给前沿模型踩刹车,开源在 token 榜上接力
大模型选型指南 2026:Claude/GPT/Gemini/Grok/DeepSeek 怎么选
Agent 的手脚:工具调用
大模型周刊 第 31 期:Mythos 把网安炸到震耳,Hermes 抢下 OpenRouter 日榜,DeepSeek V4 落地后继续杀价
技术指南:将免费DeepSeek模型接入Claude Code的实战方案