OpenAI新版深度研究实测:写作风格引争议,用户称体验不如旧版o3模型
一位技术用户在Linux.do论坛分享了OpenAI新推出的“深度研究”功能的实测对比。据称由GPT-5.2驱动的新版模型与旧版o3模型分别生成了关于“极客湾视频下架”的研究报告。对比发现,新版模型的写作风格被认为“莫名其妙”,且逻辑和行文...
标签索引 / 第 43 页
这个标签下有 677 篇文章。按时间回看相关判断与实践记录。
标签精选
一位技术用户在Linux.do论坛分享了OpenAI新推出的“深度研究”功能的实测对比。据称由GPT-5.2驱动的新版模型与旧版o3模型分别生成了关于“极客湾视频下架”的研究报告。对比发现,新版模型的写作风格被认为“莫名其妙”,且逻辑和行文...
针对OpenAI Codex在处理长周期编程任务时容易因上下文压缩而“降智”或遗忘目标的问题,一位开发者设计了名为“Taskmaster”的全新AI技能。该系统通过CSV文件实现状态管理与任务追踪,具备断点续传、防污染和失败自停等特性,成功...
近日,针对Cherry Studio用户在调用第三方大模型时无法显示思维链的问题,社区发现了具体的解决方案。经测试,不同厂商的API协议存在显著差异:Gemini模型必须使用其专属协议才能呈现推理过程,而OpenAI的GPT系列模型由于默认...
OpenAI 近日发布博文,宣布正式弃用 SWE-bench Verified 基准,揭露了当前 AI 编程评估体系的两大致命隐患。首先是严重的数据污染,由于测试题源自 GitHub 开源仓库,导致这些代码也被用于模型训练,使得 GPT-5...
本文深入探讨了身份验证平台Persona、OpenAI及美国政府之间令人不安的联系。文章指出,原本用于身份KYC验证的生物识别与个人数据,正通过复杂的供应链被整合进庞大的监控网络,服务于AI模型训练与政府监管。这一机制不仅模糊了技术服务的边...
全球金融基础设施巨头 Stripe 宣布估值达 1590 亿美元,并向员工提供流动性。其 2025 年报显示平台总处理量达 1.9 万亿美元,同比增长 34%,收入套件年化运行率突破 10 亿美元。Stripe 正成为 AI 经济的核心引擎...
开发者近日开源了一款名为“小毛驴”(xiaomaolv)的高性能 AI Gateway 项目。该项目基于 Rust 语言开发,主打“配好 Provider + Channel 就能跑”的极简使用体验。核心功能包括支持 OpenAI 兼容接口...
最新研究显示,OpenAI、Google、Anthropic及xAI的顶级大语言模型(LLM)能够被诱导生成《哈利·波特》、《权力的游戏》等畅销小说的逐字文本。斯坦福与耶鲁的研究表明,即便设有防护栏,通过特定提示或越狱手段,仍可从Gemin...
谷歌教育宣布与ISTE+ASCD达成合作,启动一项面向全美600万名教师的免费AI培训计划,这是迄今为止同类规模最大的项目。该计划旨在教授教师如何使用Gemini和NotebookLM等工具,从而引导全美7400万学生在课堂中安全应用AI技...
近期有开发者利用 GitHub 上的“大海捞针”测试工具,对谷歌 Gemini 3.1 Pro(包括 High 模式)与 OpenAI 的 GPT-5.2-High 进行了上下文检索能力对比。测试结果显示,Gemini 3.1 Pro 在长...