Anthropic神秘新模型基准测试曝光:代码能力大幅碾压Opus,编程自动化或迎奇点
V2EX网友分享了疑似Anthropic内部新模型’Mythos’的测试数据,其在SWE-bench系列基准测试中表现惊人,多项指标大幅超越现有的Claude Opus 4.6。数据显示,Mythos在SWE-ben...
V2EX网友分享了疑似Anthropic内部新模型’Mythos’的测试数据,其在SWE-bench系列基准测试中表现惊人,多项指标大幅超越现有的Claude Opus 4.6。数据显示,Mythos在SWE-ben...
据科技社区Linux.do消息,AI领域重要玩家Anthropic(A社)似乎已内部测试代号为“Claude Mythos”的模型。然而,官方宣称该模型因能力过强且存在潜在安全风险,将不会对公众发布。取而代之的是,Anthropic计划推出...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
近日,科技社区 V2EX 爆料发现 Anthropic 官网上存在名为“mythos preview”的神秘新模型入口。通过访问特定的内测链接,网友惊讶地发现页面路径中包含“2026”字样,同时关联的“Glasswing”项目页也被曝光。目...
针对 Claude Mythos 预览版的网络安全能力评估近日在 Hacker News 引发热议。该评估深入探讨了模型在应对复杂网络威胁、提示注入及对抗性攻击时的实际表现。分析指出,Mythos 引入了全新的安全架构,显著增强了模型的鲁棒...
AI 安全公司 Anthropic 正式启动“Project Glasswing”计划,旨在解决 AI 时代最薄弱的环节——软件供应链安全。随着 AI 模型日益成为关键基础设施,其底层依赖的操作系统、编译器和库的安全性至关重要。该项目通过引...
Anthropic 正式公布名为“琉翼计划”的最新项目,并推出了专注于网络安全领域的 Claude Mythos Preview 模型。与通用大模型不同,该模型主要应用于网络安全防御与漏洞挖掘。Anthropic 表示,鉴于该模型能力过于强...
Anthropic 近日推出了名为“Project Glasswing”的预览项目。据早期讨论显示,该模型性能强劲,甚至在某些方面优于现有的旗舰模型 Opus。为确保安全,Anthropic 采取了审慎策略,仅向选定的 Foundation...
近日,一位重度开发者基于数千个Claude Code会话日志进行了量化分析,指出该模型近期性能出现显著退化。分析表明,Claude已从早期的“研究优先”策略退化为“编辑优先”,在处理复杂工程任务时表现出明显的偷懒和草率,其深度思考能力据称下...
近期,某知名 API 中转站因频繁出现 Claude 报错遭到用户质疑。用户在使用该服务提供的“官方中转”时,遇到了 `Invalid ‘signature’ in ‘thinking’ bl...
Anthropic 宣布与 Google 和 Broadcom 签署新协议,共同建设多吉瓦(GW)级别的下一代 TPU 算力基础设施,预计首批算力将于 2027 年上线。这一巨额投资标志着 Anthropic 正在激进地扩大其底层计算能力,...