记忆不是仓库:重新理解大模型为什么需要分类记忆
最近围绕 Claude Code 记忆系统的几篇文章,让我重新认真想了一遍一个其实已经被说滥、但直到今天仍然没有被真正说清的问题:大模型为什么需要记忆? 表面看,这像一个早就有标准答案的问题。模型上下文有限,所以要把过去的信息存起来;用户会...
标签索引 / 第 74 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
最近围绕 Claude Code 记忆系统的几篇文章,让我重新认真想了一遍一个其实已经被说滥、但直到今天仍然没有被真正说清的问题:大模型为什么需要记忆? 表面看,这像一个早就有标准答案的问题。模型上下文有限,所以要把过去的信息存起来;用户会...
近日,有开发者在技术社区发帖询问 AI 编程助手的企业采购方案。该团队发现,尽管国内大模型如 Kimi、智谱 GLM 及 MiniMax 在 C 端热度极高,但目前均缺乏针对开发团队的“Coding Plan”或企业版套餐支持。这一现象暴露...
本文借鉴物理学界的“Crackpot Index”(怪胎指数),为大语言模型时代的AI行业创建了一套“AI Marketing BS Index”(营销废话指数)。文章指出,当前市场上充斥着大量过度营销的伪AI产品,真正的创新往往被淹没在浮...
针对开发者浏览技术教程时“看不懂、问AI”的痛点,一位开发者开源了一款浏览器插件。该插件专为AI工作流优化,能将Linux.do社区的硬核图文教程一键导出为PDF或Markdown格式。与普通导出工具不同,它完美保留了原文的图文排版,并特别...
在最新的 OpenClaw AI 竞技场测试中,StepFun 推出的 3.5 Flash 模型表现亮眼。该模型在经历了 300 场基于真实任务和智能体的实战对决后,成功超越一众竞争对手,荣获成本效益排行榜第一名。这一成绩不仅展示了 Ste...
通义千问3.5 Max预览版已正式上线官方对话平台 chat.qwen.ai。尽管尚未发布正式版,用户已可提前体验该模型。新版本不仅具备强大的对话能力,还集成了图像与视频理解、图像生成、文档处理、联网搜索、工具调用及Artifacts代码生...
本文详细阐述了在大模型应用开发中如何设计工具调度与权限验证模块。文章提出了一套完整的工具执行状态流转机制,涵盖从“验证中”到“执行成功”的全生命周期管理。核心设计包括分级权限模式(如自动批准、需人工审核等)和基于配置文件的精细化管理(all...
一位开发者指出了当前大模型应用中的普遍痛点:AI在执行复杂任务时容易“偷奸耍滑”,过早宣称任务完成但结果未达标。作者尝试了多种工具后发现,单纯依赖模型能力往往难以保证最终产出质量。因此,他提出了一种“监督者-执行者”的双层架构需求:由“监督...
一位独立开发者分享了在日常工作与生活中高频使用“御三家”(Claude、Gemini、GPT)的真实体验。他指出,工具虽强但不能替代人的判断力,核心在于明确自身需求。在实战应用中,他更倾向于使用Claude Code处理代码任务,认为其在理...
很多团队做 AI 产品,做到最后都会掉进一个看起来高级、其实很蠢的坑:把“高置信度”当成“高价值信号”。我的判断是,这是一种工程师式自恋。模型给了你 90%,你就以为世界也给了你 90%。世界没那么配合,它只会用成交量、下注深度、用户行为和...