
1M 上下文已经可用: Claude、Gemini 与编程 Agent 怎么选
有人在搜索框里反复打”1m 上下文已经全量可用”。这背后不是想读一篇科普,而是一个很具体的工程疑问:我现在用的模型,到底是不是已经能吃下 100 万 token 的上下文?如果能,我该不该把整个仓库、整本手册、整批日...

有人在搜索框里反复打”1m 上下文已经全量可用”。这背后不是想读一篇科普,而是一个很具体的工程疑问:我现在用的模型,到底是不是已经能吃下 100 万 token 的上下文?如果能,我该不该把整个仓库、整本手册、整批日...

社区里流传一句很有冲击力的话:某个项目把 Claude Code 的「准确率从 41% 升到 89%」,靠的只是改了一个 CLAUDE.md。这个数字来自热点原帖的说法,没有公开的评测方法和样本量,我们不把它当作实测基准。但它指向的那件事是...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。

“Codex 会把磁盘给烧了吗?” 这句听上去夸张的吐槽,背后其实是一个很现实的问题: 当你把一个能自己读写文件、跑命令、装依赖、起容器的自主编程 agent 放到本地长时间运行,它确实有可能在你不注意的时候把磁盘占...

TL;DR 一句话定义:vibe coding 想到哪写到哪,靠语义直觉驱动模型补全;spec coding 先写规格、定接口和验收,再让模型按规约实现。前者原型阶段真的快,后者在三天后你还认得自己代码这事上无可替代。 长项目的分水岭只有一...

TL;DR 把 GLM-5.2 和 GPT-5.5 摆在一起看, 不是为了分胜负, 而是帮工程团队定位”什么场景该用谁”。一句话: GPT-5.5 在通用推理、Agent 工具调用与生态成熟度上仍是基线, GLM-5...

写这篇之前,我先把过去半年在自己机器上跑过的 AI 编程 Agent 拉了一份清单: Claude Code、Codex、Cursor、Cline、Aider、Kilocode,以及最近 linux.do 圈讨论比较多的两款新兴 Agent...

上一篇拆了 Anthropic CEO 达里奥·阿莫迪(Dario Amodei)这期访谈的前半段:一家 AI 公司怎么把商业模式和价值观对齐。从访谈第 28 分钟开始,话题拐了一个弯,火力也猛了一个档。前半段聊的是公司怎么赚钱,后半段聊的...

大多数公司是先想清楚”做什么生意能赚钱”,再找一套说辞把它包装成使命。Anthropic 反过来:先定下”要把强大的 AI 做得安全”这条死规矩,再倒推什么样的生意不会跟它打架。在 Bloom...

上周五,美国政府做了一件很反常的事:它逼着本国最领先的一家 AI 公司,把最先进的产品从市场上撤下来。首当其冲的是 Anthropic,它的前沿模型叫 Mythos,对外卖的那个版本叫 Fable。据报道,留给公司执行的时间,大约只有九十分...

有人在搜索框里反复打 anyrouter 这个词。背后的需求很具体:想用 Claude Code,但官方订阅要美区信用卡,价格也不便宜,于是去找中转站。 AnyRouter 就是这类中转站里名气最大的一个。我把它接进 Claude Code...

很多人在 Vercel AI SDK 或多模型调用链里看到 AI_ProviderSpecificError(也写成 ProviderSpecificError、AI_ProviderSpecific...)时,第一反应是去官方文档搜这个类...

豆包是字节跳动的 AI 助手,2024 年 5 月上线,背后是 Doubao-Seed 系列大模型。它在国内是装机量最大的 AI 应用之一,但「好用」和「值不值得你用」是两件事。 我把豆包当主力工具用了一段时间,也拿同样的任务喂给 Chat...

ppt-web 是 CallStorm 在 ppt-master 之上做的二次开发, 把命令行 PPT 生成器包成 FastAPI + React + Docker 的 web 服务。本文拆解架构、流水线、Claude Code 角色, 给出二次开发开源项目的可复用方法论。 V2EX 出现一个名字叫 `ppt-web`

把 Codex CLI 与 Cursor 的套餐拆开看: 每月多少钱、能跑多少请求、Agent 模式怎么算额度、谁更适合长任务谁更适合 IDE 内联编辑, 给出一份给真实开发者的选型清单。 最近半年, 选 Codex CLI 还是选 Cursor 这件事在工程师群里基本天天有人问。一边是 OpenAI 把 Codex

Codex CLI 跑着跑着 MCP 服务器断了, 看上去像是被 logout 吞了 session。这篇从 stdio 长会话断连、provider 切换丢 MCP、ChatGPT auth 卡 codex_apps、mcp logout 副作用四个根因, 拆解可复现路径和修复矩阵, 一次把 session 救回来。

如果你在搜 com.openai.codex.code_sign_clone,大概率不是想读一篇技术散文,而是磁盘莫名变小、du 之后翻到一堆奇怪的文件夹,想搞清楚这玩意儿是不是病毒、能不能删、删了会不会把 Codex.app 弄坏。先把答案给你:它不是报错,也不是被入侵,是 Codex 桌面应用每次启动都会留下来的临

GSC 后台看到一个搜索词,叫”codex mac intel 版本”。84 次曝光,0 次点击。点不进来,是因为搜的人想要一个确定答案:我这台 Intel Mac,到底能不能跑 Codex? 答案要拆成两半。Cod...

本地大模型怎么选:Qwen3.6 27B BF16 与 Step3.7 IQ4_XS 横评,从量化精度、显存账、编码 benchmark、Agent 适配、推理速度五个维度给一张选型矩阵,附四类使用者落地建议。

2026 年主流大模型已分化出清晰的能力地图:Claude 编程稳、GPT 通用全、Gemini 长文档强、DeepSeek 推理深、Grok 实时快。这篇基于 264 篇社区实测整合,按代码、长文档、Agent、中文、成本敏感等场景给出选型建议,以及别被 benchmark 骗的真相。

覆盖 LangChain、LangGraph、LangSmith、Langfuse、n8n、Dify、Coze、FastGPT、AutoGen、CrewAI 十款主流 AI Agent 框架横向对比、五维选型决策树、生产可观测与新手/团队两条学习路径。