Dense vs MoE:大模型架构的选择题
选 Dense 还是选 MoE?这个问题在 2025 年之后已经不怎么争议了——大多数顶级闭源模型(GPT-4 系列、Gemini、DeepSeek-V3)都用了 MoE。但这不意味着 Dense 没用了。两种架构各有清晰的能力边界,选错架...
持续更新
选 Dense 还是选 MoE?这个问题在 2025 年之后已经不怎么争议了——大多数顶级闭源模型(GPT-4 系列、Gemini、DeepSeek-V3)都用了 MoE。但这不意味着 Dense 没用了。两种架构各有清晰的能力边界,选错架...
Agent 有个老问题:它知道怎么写代码、怎么查资料、怎么调用工具,但它不知道你自己的东西在哪里。 我说的不是联网搜索——Google 和 Bing 它已经会用了。我说的是你自己沉淀下来的那堆 Markdown:项目文档、SOP、会议纪要、...
一个 WhatsApp 机器人,在主人完全没有编写语音处理功能的情况下,自己学会了接收语音消息、识别格式、转码、调用 API 转录、然后回复——全程 9 秒。 主人站在马拉喀什的街头,看着 WhatsApp 上的打字指示器,愣住了。 这是 ...
> 视频来源: > > 受访者:罗福莉(小米大模型负责人) > > 说明:本文基于用户提供的中文字幕转写整理,按模型、组织与研究范式重新组织,不是逐字稿。 如果只把这场访谈当成一篇 OpenClaw 体验分享,其实会错过
> 视频来源: > > 受访者:罗福莉(小米大模型负责人) > > 说明:本文基于用户提供的中文字幕转写整理,按一个核心问题重新组织,不是逐字稿。 很多人第一次看 OpenClaw,都会下一个很快的判断:这不就是 Cla
这一周最值得记住的,不是哪家模型又发了一个新版本,也不是哪家厂商又多说了几句 Agent 愿景。 真正变硬的一条线,是 Agent 开始全面撞上生产现实。算力不够,订阅收紧,漏洞变成供应链入口,观测和权限开始补票,平台厂商也不再只卖“更聪明...
AI Agent 的终极形态不是单个 Agent 多强,是一群 Agent 怎么协作,以及它们共同积累的知识怎么不丢失。 Hermes 解决知识积累用的是 LLM Wiki 模式——用 LLM 做蒸馏引擎,把原始信息压成可检索的结构化知识。...
理论上 Hermes 装好就能用。实际上想让它真正跑起来,需要搭五套子系统。不是可选的——缺任何一套,Agent 的能力都会塌一个角。 本文是操作手册。每一套系统我给出最小配置、常见坑和真实案例。照着走,30 分钟配完。 Hermes 的消...
AI Agent 的核心差异不在于模型能力,在于记忆怎么管、技能怎么长。OpenClaw 是你教它做事,Hermes 是它自己在工作中学会做事。这个区别看起来小,跑 30 天后效果天差地别。 我花了三周读了 20 多篇 Hermes Age...
很多人第一次用 Claude Code,都会经历一个很像“AI 很强,但我很累”的阶段:你明明已经把一个流程带着它跑通了,可第二天重来,还是得从头提示、从头纠偏、从头盯着它走。流程是通了,但没有沉淀成资产。 AgentCrew Academ...
2026年4月18-24日 · 第28期 · 每周五发布 本周关键词:Agentic Workflows · 开源围剿 · 蒸馏摩擦 · 定价博弈 TL;DR — 30 秒看完本周 如果你只有 30 秒,记住这五件事: OpenAI 发布 ...
前几天我看到 XinGPT 发了一条视频,标题很直接:为什么 AI 说话总有一股“AI 味”,以及有没有办法一键解决。 这个问题其实很多人都遇到过。你让模型写一段话,它很容易先“稳稳地接住你”,再快速给出一个看上去很完整、很圆润、很安全的结...
核心洞察:Software 2.0、可验证性(Verifiability)、Agent Harness、LLM Wiki 现在是 2026 年,大模型已经成了基础设施。 每天都有无数的团队在熬夜:微调模型、写又长又臭的提示词、搞一套看似华丽...
引言(The Hook):你是不是还在为每天手动“调教”各种 AI 助手而心力交瘁?我们曾经以为给大模型套个复杂的网关调度就是 Agent,那是最初级的思维。而在过去 30 天,我停掉了手里 80% 的常规任务流,将它们全部迁移到了 Her...
这一周最值得记住的,不是又多了几个 Agent SDK,也不是哪家模型又把能力榜单往前推了一格。 真正的变化是,AI Agent 这条线开始从“能不能做更多事”,转向“谁敢把它放进真实系统里”。安全、身份校验、可审计 harness、生产级...
> 原始文件: > > 说明:这次不做导读式改写。第一章直接放完整对照翻译,尽量按原始 `{tag}` 结构保留;第二章再单独分析这套设计的优点、缺点和代
> 原文: > https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/Claude-Design-Sys-Prompt.txt > > 说明:这次不再按“拆章摘要”写,而...
最近一年做 Agent 的人,几乎都会在同一个地方反复撞墙: 模型越来越强,工具链越来越长,但对话一断、会话一换,系统就像“失忆”一样,重新变回一个陌生助手。 很多团队把这个问题当成“再接个向量库”就能解决的工程细节。看完这期视频后,我反而...
TL;DR:本周 AI 圈的关键词只有一个——执行力。OpenAI Codex 变身 Mac 大脑,Claude Opus 4.7 悄然落地,OpenClaw 用一次”好的无聊发布”黏合了整个生态,Kimi K2.6...
> 基于 Anthropic 官方 32 页手册 --- | 章节 | 内容 | 适用人群 | |------|------|----------| | 核心概念 | Skills 是什么、三级结构、设计原则 | 所有读者 | | 规划设计...