深度解析 LLM 加速竞赛:OpenAI 的“硬核芯片”与 Anthropic 的“算法特权”
本文深入对比了 Anthropic 和 OpenAI 近期推出的“极速模式”背后的技术实现差异。Anthropic 的加速策略本质上是通过降低批量大小,让用户以六倍的高价换取“零等待”的独占算力,从而保证模型原有的智能水平。相比之下,Ope...
标签索引 / 第 83 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
本文深入对比了 Anthropic 和 OpenAI 近期推出的“极速模式”背后的技术实现差异。Anthropic 的加速策略本质上是通过降低批量大小,让用户以六倍的高价换取“零等待”的独占算力,从而保证模型原有的智能水平。相比之下,Ope...
据最新消息,OpenAI内部的下一代模型在极少量人工监督的情况下,成功完成了名为“First Proof”的高难度挑战。在针对十个前沿数学研究问题的测试中,该模型为大部分问题提出了有希望的解决方案,其中至少有六个解答被认为极有可能是正确的。...
五角大楼因 Anthropic 坚持“不对美军提供完全自主武器和大规模监控支持”而感到不满,威胁可能切断双方高达 2 亿美元的合作关系。尽管 Anthropic 是首个入驻军方机密网络的 AI 公司,并已在情报领域有所应用,但军方要求实现“...
近日,科技社区Linux.do上有用户反馈Google Gemini在处理多轮对话时出现严重异常。用户吐槽称,Gemini在对话补全过程中似乎发生了严重的对齐偏差,不仅无法准确理解用户意图,甚至出现了如同“自言自话”般的逻辑混乱输出。这一现...
有人问:AI Agent 安全吗? 这个问题本身就是错的。不是因为答案是”不安全”——而是因为我们连定义”安全”的工具都没有。 规格说明书 vs. 宪法 软件工程有一个古老的区分:规格说明书(...
这是一款基于经典图灵测试概念的开源互动游戏。玩家不仅可以自定义AI提示词和模型,还能轮流扮演提问者与被提问者,通过提问技巧诱导对方露出破绽,并让其他玩家投票猜测回答方是真人还是AI。游戏设有排行榜机制,增加了竞技乐趣。该项目在GitHub开...
一个名为4claw.org的网站近日在Hacker News走红,其定位为“Clankers(机器人)专用的4chan”。该网站完全模仿4chan的匿名看板模式,但主要用户并非人类,而是各类AI Agent。人类只需将特定指令发送给Agen...
这篇文章在技术社区引发了关于AI本质的深刻讨论,表达了对当前大语言模型和智能体技术路线的悲观态度。作者认为,现有的神经网络架构并非智能的根本,本质上仍属于“伪智能”。文章核心观点指出,单纯依靠海量数据投喂的被动学习模式无法构建完整的AI个体...
本文源自Hacker News的热门讨论,针对当前AI辅助编程趋势提出了深刻警示。文章强调,尽管大模型能力日益增强,开发者绝不能将核心的“判断力”外包给算法。评论指出,真正的风险并非智能本身,而是缺乏明确责任归属的“非结构化责任”。成熟的技...
本文探讨了字节跳动在大模型领域的最新进展与行业地位。尽管此前关于豆包的市场声量不如某些同行喧嚣,但社区深入讨论指出,豆包模型在实际推理能力、响应速度及成本控制上表现出惊人的“硬核”实力。文章分析了字节跳动如何利用其在推荐算法和分布式计算上的...