大模型周刊第40周:后训练开始接管主战场
本周大模型圈最重要的信号不是又多了几个新模型,而是后训练、Agent能力和开源可用性同时加速。智谱、DeepSeek、Google、OpenAI和Anthropic都在用不同方式回答同一个问题:模型怎样从会聊天变成能稳定干活。
标签索引
这个标签下有 1065 篇文章。按时间回看相关判断与实践记录。
标签精选
本周大模型圈最重要的信号不是又多了几个新模型,而是后训练、Agent能力和开源可用性同时加速。智谱、DeepSeek、Google、OpenAI和Anthropic都在用不同方式回答同一个问题:模型怎样从会聊天变成能稳定干活。
2026 年 7 月最后一周,大模型行业的主线很清楚:美国头部厂商用降价和生态补强防守,中国开源阵营继续用权重开放和性价比抢开发者心智,Agent 与具身智能开始从概念走向生产场景。
2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GL...
第37期大模型周报,记录2026年7月11日至17日这一周的几个关键信号:OpenAI把GPT-5.6推向企业代理,Anthropic继续押注开发者生态,Google走企业集成路线,中国开源模型则用Kimi K3和GLM系列把成本压力重新打...
Thom Wolf 和 Olive Song 的对话接在 GLM 后面。主持人顺势把 MiniMax、DeepSeek、Moonshot、Z.ai 放进中国几家前沿模型团队的语境里。这不是简单的模型排行,而是在讨论开放模型生态的边界。 原视...
作者:toy | 覆盖周期:2026.06.20 – 2026.06.26 这一周,OpenAI 有三件事砸在同一个窗口里:6 月 24 日和博通一起亮出第一颗自研芯片 Jalapeño,6 月 25 日被白宫要求把新模型 GPT-5.6 ...
作者:toy | 覆盖周期:2026.06.13 – 06.19 卷首语 本周是 2026 年第一次能清楚看到”治理变量”压过”模型变量”的一周。 周一晚 OpenAI 被 42 个州的检察长...
作者:toy | 覆盖周期:2026.5.30 – 2026.6.5 这一周的关键词是”上场”。MiniMax 在 6 月 1 日把 M3 拍在桌上,1M 上下文、原生多模态、开源权重,SWE-Bench Pro 5...
Cerelog 推出了 ESP-EEG,这是一款高性价比的 8 通道生物传感开发板。该产品由前 SpaceX 工程师 Simon Hakimian 开发,核心采用与 OpenBCI Cyton 相同的 TI ADS1299 芯片,通过真闭环...
随着 Claude Code 等 AI 编程工具的普及,开发者对于代码所有权的思考正在发生转变。本文提出,既然投入了真金白银的 Token 成本,就不应让生成的代码仅仅成为大模型厂商的私有语料库。与其让代码在封闭环境或被中转站碎片化利用中流...