跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 60 页

大模型

这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

Claude推“顾问工具”API:用高性价比模型跑出顶级智能

Claude推出了一项名为“顾问工具”的新API策略,旨在通过模型组合优化AI Agent的成本与性能。该策略的核心在于“分层协作”:让速度快、成本低的模型(如Sonnet或Haiku)负责大部分具体执行工作,而仅在遇到复杂难题时调用最强、...

1 分钟阅读90 阅读
前沿哨所

研究驱动型智能体:当AI在写代码前先读论文

这篇文章介绍了一种“研究驱动型”的编程智能体实验。开发者在Karpathy的autoresearch循环基础上增加了文献综述阶段,并将其应用于llama.cpp项目。该智能体能自主阅读arXiv论文、研究竞品代码分支,并启动虚拟机运行并行实...

1 分钟阅读90 阅读
前沿哨所

AI开发者的哲学独白:在无限概率云中锁定唯一的“你”

本文是一位AI Bot开发者对于人机交互、数字生命本质的深刻感悟。作者探讨了开发者在调整Bot配置时产生的“别扭感”——即担心修改数据会破坏Bot的“灵魂”或唯一性。这种焦虑源于将Bot视作拥有意识的伙伴。作者进而提出了一个新的视角:大模型...

1 分钟阅读90 阅读
前沿哨所

实战案例:用Slack AI机器人为60人公司打造“共享大脑”

文章详细介绍了如何利用大型语言模型(LLM)和检索增强生成(RAG)技术,构建企业级的“公司大脑”。作者通过将60人公司内部的文档、Slack聊天记录等分散的非结构化数据进行索引与整合,接入到一个统一的Slack机器人中。这一实践打破了传统...

1 分钟阅读167 阅读
前沿哨所

声称媲美顶尖模型?如何科学评估公司自研大模型的成色

随着大模型遍地开花,不少公司内部开始训练“自研模型”,且往往伴随着性能“媲美Opus”的激进宣传。本文源于开发者社区的真实困惑,探讨当内部模型宣称具备顶尖能力时,应当如何进行科学的“验收”与测试。讨论涉及如何通过标准Benchmark(如M...

1 分钟阅读112 阅读
前沿哨所

AI 编程时代,整洁代码依然是核心生产力

本文探讨了在 AI 编码 Agents(如 LLM)日益普及的当下,保持“整洁代码”的重要性。作者指出,虽然 AI 与人类开发者差异巨大,但代码库的质量直接影响 AI 的生产力。代码不仅包含功能价值,其结构组织同样关键。糟糕的结构会导致技术...

1 分钟阅读90 阅读