近日,有开发者在社区反馈了在使用 Codex(一种 AI 编程或开发工具环境)时的一个有趣现象。该开发者在测试过程中,首先将底层模型切换为 DeepSeek,并尝试通过 AI 指令让其自动打开 macOS 平台的 Safari 浏览器以查看网页。然而,DeepSeek 模型在执行该任务时未能成功,系统提示要求调用无障碍模式,导致操作停滞。随后,当开发者将模型切换回 OpenAI 的 GPT 系列模型时,同样的指令被迅速且准确地执行,Safari 浏览器成功被唤起。这一对比引发了关于大模型 Agent 能力的讨论,显示出虽然 DeepSeek 等新兴模型在推理层面表现强劲,但在涉及具体的操作系统底层交互(如 macOS 无障碍 API)和函数调用稳定性上,OpenAI 似乎仍保留了一定的技术护城河和优化优势。
事件分析
💡 核心观点:大模型竞争维度已从单纯的“智商”比拼转向“执行”较量,OpenAI在系统交互与Agent落地上的工程壁垒短期内难以被复制。
原文链接:Linux.do





