标签索引
大模型
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
相关内容
AGI 可能先以系统的形态出现
最近,科技公司 CEO 又开始说 AGI 已经到来,或者只差临门一脚。麻烦在于,大家嘴里的 AGI 并非同一个东西。有人盯着模型参数,有人看它能完成多少任务,还有人把工具、记忆和执行环境也算进去。 Caleb Writes Code 的视频...
大模型周报第41周:Agent开始进生产线,开源模型继续压成本
> 大模型周刊|2026.08.15–08.21 本周大模型行业有一条清晰主线:模型厂商开始把竞争重点推向真实工作流。OpenAI补青少年安全与教育产品,Anthropic把 Computer Use、Skills API 和 Files ...
Karpathy 讲透 Software 3.0:当英文成为编程语言,AI 工程师真正该设计什么
Andrej Karpathy 在 Stanford 的这场演讲,表面上是一场关于 Transformer、GPT 和提示工程的技术分享,真正值得留下的核心判断只有一句:软件正在从“人来设计算法”,转向“人来设计数据和语言程序”。模型能力越...
大模型周刊第40周:后训练开始接管主战场
本周大模型圈最重要的信号不是又多了几个新模型,而是后训练、Agent能力和开源可用性同时加速。智谱、DeepSeek、Google、OpenAI和Anthropic都在用不同方式回答同一个问题:模型怎样从会聊天变成能稳定干活。
大模型周刊 38|价格战、开源权重和 Agent 落地同时加速
2026 年 7 月最后一周,大模型行业的主线很清楚:美国头部厂商用降价和生态补强防守,中国开源阵营继续用权重开放和性价比抢开发者心智,Agent 与具身智能开始从概念走向生产场景。
大模型周刊 37:越狱、算力与开源反击
2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GL...
代码写作快免费了,软件工程反而更难了
Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness ...
企业 Agent 失败,不是因为模型不够大
Tesla 机器学习工程师 Ishita Daga 在这段 12 分钟分享里,把企业数据 Agent 的失败原因压到三个词:歧义、腐败、偏好。本文结合我自己的 Harness / 企业记忆笔记,讨论为什么加模型、加上下文、加知识库都不是根治...
大模型周刊第37期:Kimi K3 把“DeepSeek 时刻”又推回来
第37期大模型周报,记录2026年7月11日至17日这一周的几个关键信号:OpenAI把GPT-5.6推向企业代理,Anthropic继续押注开发者生态,Google走企业集成路线,中国开源模型则用Kimi K3和GLM系列把成本压力重新打...









