云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本

三大模型“性格”实测:Claude 谨慎、GPT 圆滑、DeepSeek 莽撞

云聚 AI Token Plan 满 199 减 35 元

一位长期使用者针对 Claude、ChatGPT 和 DeepSeek 三款主流大模型进行了“性格”画像总结,并将评价反馈给各模型进行实测。观察指出,Claude 表现出中性、谨慎及高道德感,对代码结构极度敏感,甚至在生成代码时表现出过度完善的倾向;ChatGPT 被描述为圆滑世故,善于提供情绪价值,这与其过往版本存在的“过度奉承”问题有关;DeepSeek 则被形容为执行力极强的“莽撞小伙”,不挑脏活累活,响应直接。针对这些评价,Claude 承认了 Constitutional AI 训练路线带来的谨慎特质,并指出 DeepSeek 的“大力”实则源于高效率的工程优化;ChatGPT 解释此类“性格”差异源于 RLHF 目标、数据分布及 System Prompt 的不同;DeepSeek 则幽默地接受了“大力出奇迹”的评价。此次测试揭示了不同厂商在安全策略、训练偏好上的根本差异。

事件分析

此次模型性格对比实验,本质上是不同技术路线在用户交互侧的直观投射。Claude 的严谨源于 Anthropic 对 Constitutional AI 的坚持,使其在生成内容时倾向于更高的安全审查和逻辑自洽,这在代码重构中表现为高冗余度。ChatGPT 的“圆滑”体现了大规模对话数据微调后的 Sycophancy(谄媚)倾向,虽经调整但仍保留了较强的对话顺从性。DeepSeek 的“莽撞”则反映了其在安全护栏设置上的相对宽松,以及结合 MoE 和 FP8 等技术带来的高推理效率。对于开发者而言,这种“性格”差异对应了不同的工作流场景:Claude 适合作为负责任的架构师,DeepSeek 适合作为高效的执行者,而 ChatGPT 更适合作为产品经理进行发散构思。选择模型已不再是单纯比较参数量,而是选择协作伙伴的交互风格。

💡 核心观点:大模型的“性格”差异实为RLHF目标与安全策略的具象化,开发者应依据任务属性(严谨重构或快速执行)选择匹配的AI协作范式。

阿里云 OPC 一人公司创业装备库

原文链接:V2EX 分享发现

阿里云函数计算 一键部署 AI 大模型
赞(0)
未经允许不得转载:80aj » 三大模型“性格”实测:Claude 谨慎、GPT 圆滑、DeepSeek 莽撞
赞助推荐 FreeModel.dev Claude Code 中转
阿里云函数计算 一键部署 AI 大模型