GPT-5.5风声鹤唳,Claude光速修复“降智”问题:非因知错,实乃怕输
近日,随着OpenAI被传发布更为强大的GPT-5.5,Anthropic旗下的Claude Code迅速结束了持续一个月的“降智”状态,表现力大幅回升。这一现象引发了社区的广泛调侃与热议,有观点一针见血地指出,Claude之所以能光速修复...
标签索引 / 第 5 页
这个标签下有 197 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,随着OpenAI被传发布更为强大的GPT-5.5,Anthropic旗下的Claude Code迅速结束了持续一个月的“降智”状态,表现力大幅回升。这一现象引发了社区的广泛调侃与热议,有观点一针见血地指出,Claude之所以能光速修复...
随着大模型技术的迭代,其背后的运行与算力成本正急剧攀升。业界数据显示,自建顶尖模型(如GLM系列)的硬件成本已达数百万级别,且并发能力受限,导致主流AI厂商普遍陷入“赔本赚吆喝”的困境,需要持续外部输血。近期智谱AI等厂商出现的套餐缺货与服...
近期国产大模型(如Qwen、Kimi、GLM等)开启疯狂迭代模式,版本更新频率令人咋舌。然而,这种“军备竞赛”背后是巨额的试错成本,若体验不佳,几千万训练成本恐打水漂。目前普通用户对高频更新已感疲劳且付费意愿低,反而是程序员、运维等深度用户...
据开发者社区反馈,DeepSeek 近期低调更新了其 API 服务,疑似推出了 Lite V4 版本,并带来了一项重磅升级:支持高达 100 万 tokens(1M)的上下文窗口。这一改进意味着开发者可以在单次请求中处理更大量的文本数据,无...
据社区爆料及外媒报道,盛大集团陈天桥创立的AI大模型公司MiroMind,正在有计划地将核心预训练技术及团队转移至海外并寻求融资。不同于仅停留在应用层的厂商,MiroMind掌握大模型底座技术,其潜在的“技术外流”引发了行业对高端AI资产流...
一位 AI 开发者在社区反馈,其项目依赖的 MiniMax 官方 API 近期性能严重下滑,响应延迟从原本的 10~30 秒恶化至最低 30 秒,升级高速套餐后依然缓慢,导致用户体验受损。鉴于 Kimi 存在编程外使用限制且速度不佳,GLM...
近日,科技社区传出国产大模型DeepSeek V4可能于下周发布的消息,引发了广泛关注和讨论。鉴于DeepSeek V3此前展现出的极强性能与极低定价,业界对其新模型的定价策略充满好奇。在相关的社区投票中,普遍预测V4将延续甚至突破现有的低...
一位开发者针对Grok-4.20和4.30进行了长上下文能力的实战测试,结果引人深思。测试分为两部分:首先使用约150万token的机器生成文本进行“大海捞针”测试,模型表现完美,准确回答了所有问题;然而,当上传一部约89万token的百万...
针对近期阿里、幻方等公司密集开源大模型的现象,本文深入探讨了其背后的商业动因。文章对比了Linux等传统开源软件的生态锁定效应,指出大模型作为API服务的“黑盒”特性似乎缺乏类似壁垒。文章进一步追问,在用户极易切换模型提供商的当下,大厂开源...
近期许多重度用户发现,以 GPT 和 Claude 为代表的 AI 模型出现回答过度冗长、频繁“请示”甚至道德感过高的现象。文章指出,这并非模型变笨,而是 RLHF(基于人类反馈的强化学习)训练范式下的结构性偏差。为了在评估中获高分,模型学...