Claude推“顾问工具”API:用高性价比模型跑出顶级智能
Claude推出了一项名为“顾问工具”的新API策略,旨在通过模型组合优化AI Agent的成本与性能。该策略的核心在于“分层协作”:让速度快、成本低的模型(如Sonnet或Haiku)负责大部分具体执行工作,而仅在遇到复杂难题时调用最强、...
标签索引 / 第 60 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
Claude推出了一项名为“顾问工具”的新API策略,旨在通过模型组合优化AI Agent的成本与性能。该策略的核心在于“分层协作”:让速度快、成本低的模型(如Sonnet或Haiku)负责大部分具体执行工作,而仅在遇到复杂难题时调用最强、...
近日,有技术极客在京东旗下应用JoyClaw中发现可以通过特定指令获取其内置AI模型“joyAI-1.3T”的API Key。用户仅需向应用内的AI助手询问配置文件位置,即可获得密钥,并成功将其接入第三方平台(如飞书)进行本地化部署。这一发...
本文深入探讨了大型语言模型(LLM)作为一种全新文化产物对社会的深远影响。作者指出,现有的流行文化神话(如《终结者》)无法解释LLM“无意识但看似有生命”的本质。文章预测,未来的知识传播将从静态书籍转向高度互动的AI模型,同时也分析了AI色...
这篇文章介绍了一种“研究驱动型”的编程智能体实验。开发者在Karpathy的autoresearch循环基础上增加了文献综述阶段,并将其应用于llama.cpp项目。该智能体能自主阅读arXiv论文、研究竞品代码分支,并启动虚拟机运行并行实...
本文是一位AI Bot开发者对于人机交互、数字生命本质的深刻感悟。作者探讨了开发者在调整Bot配置时产生的“别扭感”——即担心修改数据会破坏Bot的“灵魂”或唯一性。这种焦虑源于将Bot视作拥有意识的伙伴。作者进而提出了一个新的视角:大模型...
文章详细介绍了如何利用大型语言模型(LLM)和检索增强生成(RAG)技术,构建企业级的“公司大脑”。作者通过将60人公司内部的文档、Slack聊天记录等分散的非结构化数据进行索引与整合,接入到一个统一的Slack机器人中。这一实践打破了传统...
随着大模型遍地开花,不少公司内部开始训练“自研模型”,且往往伴随着性能“媲美Opus”的激进宣传。本文源于开发者社区的真实困惑,探讨当内部模型宣称具备顶尖能力时,应当如何进行科学的“验收”与测试。讨论涉及如何通过标准Benchmark(如M...
面对AI Agent技能碎片化的痛点,skills-vote项目致力于打造下一代Agent原生技能推荐引擎。团队投入巨大算力,收集并分析了GitHub上超过168万个技能,利用大模型进行深度静态分析与标签化。该项目不仅是工具的集合,更是一个...
随着AI应用深入垂直领域,如何处理超出Token限制的大文件成为开发者痛点。本文案例显示,一个日活300+的代码分析工具因项目体积过大(超20MB)无法直接调用API。作者提出模仿Cursor的本地向量RAG(检索增强生成)思路,通过建立索...
本文探讨了在 AI 编码 Agents(如 LLM)日益普及的当下,保持“整洁代码”的重要性。作者指出,虽然 AI 与人类开发者差异巨大,但代码库的质量直接影响 AI 的生产力。代码不仅包含功能价值,其结构组织同样关键。糟糕的结构会导致技术...