国产大模型代码实战测评:DeepSeek与GLM 5.1并驾齐驱领跑第一梯队
针对国产大模型在真实开发场景下的表现,一位开发者在中型项目中选取了DeepSeek V4 Pro、GLM 5.1、MiMO-2.5Pro及DeepSeek V4 Flash四款API进行代码审查对比。通过使用相同的提示词并经由GPT 5.5...
标签索引 / 第 15 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
针对国产大模型在真实开发场景下的表现,一位开发者在中型项目中选取了DeepSeek V4 Pro、GLM 5.1、MiMO-2.5Pro及DeepSeek V4 Flash四款API进行代码审查对比。通过使用相同的提示词并经由GPT 5.5...
继DeepSeek V4发布后,有用户发现其火速上线了多模态功能。然而,实测结果显示DeepSeek在视觉理解方面存在明显短板,特别是在手写文字OCR识别上,错误率高达90%,表现远逊于豆包(30%)和Llama 3.1(10%)。此外,测...
一位博主分享了使用DeepSeek v4和Kimi辅助完成130页论文的经历,在花费180元进行AI率检测后发现,即便使用了提示词技巧,绪论、相关工作及英文摘要部分的“AI味”依然浓重。甚至尝试用Claude重写摘要,AI检测率仍高达100...
一项针对 GPT-5.5 生成代码的审查测试显示,国产大模型表现参差不齐。在审查爬虫流水线代码时,小米模型仅耗时 4 分钟,全程“赞赏”未指出严重逻辑错误,评分垫底;DeepSeek 表现中规中矩,找到了部分非关键问题;GLM-5.1 虽耗...
一位资深 AI 用户对 DeepSeek V4 与 Google Gemini 的写作能力进行了实测对比。测试显示,DeepSeek V4 在文风细腻度上较前代 V3 有显著提升,但在逻辑连贯性上仍存在不足,常需多次重试才能生成通顺内容。相...
AI大模型领域独角兽DeepSeek持续发力,继此前Pro版降价、1元缓存策略及视觉模型灰度测试后,宣布将相关优惠活动再次延长至5月31日。此外,社区传闻预测DeepSeek正加速整合国产算力,预计将在5月底正式接入华为昇腾算力集群,并可能...
本次实测在大型代码仓库环境中,对比了DeepSeek的Pro与Flash模型在代码分析任务中的表现。结果显示,Pro版回答质量更高,逻辑更符合人类预期,而Flash版虽在总结深度上稍逊,但胜在响应速度极快。核心数据方面,6轮问答及多次检索共...
继在推理领域大放异彩后,DeepSeek 再次展现其技术野心。据社区用户实测反馈,DeepSeek 已悄然上线识图模式,正式迈入多模态交互时代。用户上传了一张在潮州拍摄的小猫图片,模型成功完成了识别与交互。这一更新标志着 DeepSeek ...
近日,社区针对 DeepSeek 视觉模型进行了首轮实测,并将其与 Gemini 3.1 Pro、Kimi 等主流模型进行了横向对比。测试项目涵盖手指数量识别、军事装备细节(如直10毫米波雷达)、冷门航空知识、地图常识以及图像联想能力。结果...
近日,科技社区发现DeepSeek似乎已悄然上线多模态能力。用户实测反馈显示,模型在处理图像相关任务时表现稳健,引发了对DeepSeek是否已部署原生多模态架构的猜测。此前DeepSeek凭借R1模型在推理性能上惊艳业界,此次若证实具备视觉...