
第30期大模型周刊:钱在烧,模型在卷,代理在跑
5 月 9 日到 15 日这一周,大模型这边没什么”平静”可言。 OpenAI 还在为算力账单加杠杆,Anthropic 一边谈估值翻倍一边把云合同签到两千亿,Google 把 Gemini 直接焊死在 Androi...

5 月 9 日到 15 日这一周,大模型这边没什么”平静”可言。 OpenAI 还在为算力账单加杠杆,Anthropic 一边谈估值翻倍一边把云合同签到两千亿,Google 把 Gemini 直接焊死在 Androi...

这场分享里最有价值的,不是“Claude Code 很强”这种结论。这个结论现在已经不新鲜了。 真正值得记住的是另一句:**当编码吞吐不再是最贵的资源时,很多沿用了十几年的工程流程,会在你没注意的时候悄悄失效。** 这句话听起来像管理层口号,但 Fiona 讲得很具体。她不是在抽象谈未来,而是在复盘 Anthropic

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。

过去一年,大家聊 AI 竞争,最爱聊的是模型能力:谁更强,谁更会推理,谁在 coding 上更猛。但《硅谷101》这期《Token经济学:AI时代的新货币战争》把镜头往下压了一层,讨论的不是“谁更聪明”,而是“谁在为聪明买单”。这一下就把问题拉回现实了。 因为今天的 AI 行业,尤其是 agent 这一波,已经越来越不

如果你最近在用 Claude Code,大概率已经感受到那股味道了: - Pro / Max 越来越容易碰到 KYC - 账号莫名其妙被风控、被封、被限制 - 环境明明配好了,过几天又得重新折腾 - 真正烦人的不是不会用,而是没法长期稳定用 所以这篇不是单纯讲“Claude 合租便不便宜”。 这篇只回答一个问题:**当

本周 AI 圈的主线很清楚:美国巨头继续把钱砸进算力、企业服务和更强的垂直能力,中国公司则沿着开源、高性价比和快速融资一路猛推。两条路线看起来不同,底层逻辑却很像——大家都在抢未来两三年的平台位。 如果只看一层表面,你会觉得本周新闻很散:OpenAI 讲基建和广告,Anthropic 讲增长和安全,Google 还在为

4 月最后一周,大模型圈没有出现像新旗舰模型发布那样的超级大新闻,但行业方向反而更清楚了。 一边是 OpenAI、Anthropic、Google 继续把重点压在企业能力、Agent 工作流和安全治理上;另一边是 DeepSeek、Moonshot、智谱这些中国团队,继续卷开源、长上下文和编码 Agent。和前几个月比

2026 年春天,红杉资本 AI Ascent 峰会上,三位合伙人 Pat Grady、Sonia 和 Constantine 轮番上台,做了一场不到 40 分钟的开场 keynote。Pat 在中间某段轻描淡写地丢出一句话——"if we may be so bold, we would say that this

Andrej Karpathy 几个月前说了句话:**他从未觉得自己作为程序员这么落后过。** 说出这话的人是 OpenAI 联合创始人、前 Tesla Autopilot 负责人、AI 教育领域最会讲人话的那个人。他在红杉 AI Ascent 2026 上解释了这种落后感从哪来——2025 年 12 月,一个很清晰的

一个 WhatsApp 机器人,在主人完全没有编写语音处理功能的情况下,自己学会了接收语音消息、识别格式、转码、调用 API 转录、然后回复——全程 9 秒。 主人站在马拉喀什的街头,看着 WhatsApp 上的打字指示器,愣住了。 这是 Peter Steinberger 在 TED 上演讲里,最让我停下来的一个场景

> 视频来源:

很多人第一次用 Claude Code,都会经历一个很像“AI 很强,但我很累”的阶段:你明明已经把一个流程带着它跑通了,可第二天重来,还是得从头提示、从头纠偏、从头盯着它走。流程是通了,但没有沉淀成资产。 AgentCrew Academy 这期视频讲的,正是怎么把这种“已经跑熟的例行工作”,从一次性对话,变成一个可

2026年4月18-24日 · 第28期 · 每周五发布 本周关键词:Agentic Workflows · 开源围剿 · 蒸馏摩擦 · 定价博弈 TL;DR — 30 秒看完本周 如果你只有 30 秒,记住这五件事: OpenAI 发布 ...

前几天我看到 XinGPT 发了一条视频,标题很直接:为什么 AI 说话总有一股“AI 味”,以及有没有办法一键解决。 这个问题其实很多人都遇到过。你让模型写一段话,它很容易先“稳稳地接住你”,再快速给出一个看上去很完整、很圆润、很安全的结论。句子没错,逻辑也通,但读起来就是不像一个真的人在说话。 这种感觉很难靠一句话

核心洞察:Software 2.0、可验证性(Verifiability)、Agent Harness、LLM Wiki 现在是 2026 年,大模型已经成了基础设施。 每天都有无数的团队在熬夜:微调模型、写又长又臭的提示词、搞一套看似华丽...

> 原文: > https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/Claude-Design-Sys-Prompt.txt > > 说明:这次不再按“拆章摘要”写,而是直接按你的要求处理成两段式:第一章给出一整块可连续阅读的中文翻译;第二章再单独

TL;DR:本周 AI 圈的关键词只有一个——执行力。OpenAI Codex 变身 Mac 大脑,Claude Opus 4.7 悄然落地,OpenClaw 用一次”好的无聊发布”黏合了整个生态,Kimi K2.6...

这次 OpenClaw 的更新,真正值得盯的只有两项: - **Active Memory**,在回复前主动回忆偏好、背景和最近约束 - **Dreaming / REM Backfill**,在空闲阶段整理碎片信息,筛选哪些值得晋升为长期记忆 如果只看 release note,这很容易被理解成一次常规功能增强。但把

最近一段时间,Harness Engineering 这个词突然开始密集出现。很多团队第一反应是,又来了一个新概念,听上去像给 Prompt Engineering 和 Context Engineering 换了个壳。但把这条视频完整看完,会发现它真正击中的,是 AI 工程从“让模型会答题”走向“让模型能干活”之后的

这一周最值得记住的一件事,和模型能力无关,和功能更新无关。 Anthropic 发布了 Claude Mythos Preview——一个能够自主发现并利用操作系统、浏览器、NFS 服务等核心组件高危漏洞的模型。然后他们说:这个模型太危险了,不能公开发布。 这周同时发生的事:Python 生态的 litellm 被发现

我先说结论 这场比赛最有意思的地方,不是又冒出了几个会写代码的团队。 真正值得看的是,消费互联网平台开始认真测试一件事:当 AI、硬件、内容分发和用户场景被放在同一个赛场里,什么样的作品才算“能跑通”。 从公开信息看,2026 年 4 月 ...