小米罗福莉:AGI有望两年内实现,Agent爆发正抹平中美大模型代差
小米大模型团队负责人罗福莉近日发表行业研判,指出中美在预训练阶段已基本无代差。她认为,凭借对Agent新范式的快速响应,国内顶尖模型与Claude Opus等国外模型的差距仅剩两三个月。她预测,随着开源Agent框架(如OpenClaw)激...
标签索引 / 第 40 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
小米大模型团队负责人罗福莉近日发表行业研判,指出中美在预训练阶段已基本无代差。她认为,凭借对Agent新范式的快速响应,国内顶尖模型与Claude Opus等国外模型的差距仅剩两三个月。她预测,随着开源Agent框架(如OpenClaw)激...
近日,第三方AI工具QClaw发布版本更新,引发社区关注。此次更新的核心亮点在于直接内置了Kimi、智谱GLM、MiniMax等多款国内主流大模型接口。据用户反馈,该工具采用积分制收费,但获取门槛极低,基本可实现“免费”使用。这一功能允许开...
近日,有开发者在社区实测DeepSeek时遭遇“账单惊魂”:仅通过一个简单的“Hi”问候和分析指令,模型竟进行了长达11分41秒的推理过程,最终产生4.13元人民币的费用。尽管DeepSeek以极低的API单价闻名,但此事暴露了推理模型(如...
DeepSeek发布了全新的V4系列模型,其核心突破在于攻克了高效能的百万级Token上下文处理技术。这一进展使得AI模型能够一次性“吞下”并理解海量数据(如长篇小说、大型代码库或复杂的自动驾驶日志),同时显著降低了长文本推理的计算成本。D...
近期社区讨论指出,随着 DeepSeek、Kimi 等新一代模型参数量向万亿(1T)级别逼近,开源大模型的“满血”部署正变得难以为继。用户实测发现,即便拥有 8 张 L20 显卡,在量化后也难以承载这些巨量参数,导致部署成本极其高昂。这一趋...
近期,AI社区出现广泛的“Token焦虑”。随着OpenAI封禁违规账号、Gemini取消学生优惠、Copilot削减高阶模型权益以及国内大模型收紧协议,曾经通过中转站或注册机获取的廉价算力渠道正在全面收缩。用户习惯了低成本的“Vibe C...
近期有技术社区深入挖掘了ChatGPT内部的一个关键参数——“Juice值”,它实际上充当了模型的“思考预算”。该参数就像草稿纸的大小,决定了模型在收到问题后进行推理和规划的长度。如果预算太低,模型会在未完全想透时就急于输出,导致表现“降智...
近日,科技社区有用户反馈指出,Anthropic旗下的Claude模型(提及Opus版本)在经历了一段时间的“怪味”回复(业内常指因过度安全审查导致的拒绝回答或输出生硬)后,终于恢复了正常的沟通能力。这一变化被解读为在OpenAI等竞争对手...
OpenAI在GitHub代码库中悄然移除了GPT-5.4的“最新前沿”标签,引发业界对新模型的猜测。随后,OpenAI官方开发账号及高管在社交媒体上回应了网友疑问,虽然仅留下了“NS41”这一串字符,但经Base64解码后确认为“5.5”...
据开发者社区最新反馈,DeepSeek 近期对 API 端口进行了重要更新,其性能表现令人惊喜。时隔一年重返测试的用户发现,DeepSeek 的响应速度较以往有质的飞跃,在 Agent 等应用场景下,实测速度甚至超越了 GPT-4o、Cla...