行业观察:大模型告别参数竞赛,技术重心转向工程化与编程变现
本文深入分析了大模型行业的最新发展趋势。作者指出,技术方向正发生根本性转变:一是从单纯追求模型规模和训练效果,转向实际的工程化应用与优化,近期 OpenAI 和 Anthropic 的更新多为工程层面的修补;二是从通用大模型转向垂直领域,特...
标签索引 / 第 158 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本文深入分析了大模型行业的最新发展趋势。作者指出,技术方向正发生根本性转变:一是从单纯追求模型规模和训练效果,转向实际的工程化应用与优化,近期 OpenAI 和 Anthropic 的更新多为工程层面的修补;二是从通用大模型转向垂直领域,特...
一位开发者推出了“Resilient Workflow Sentinel”,这是一个旨在解决企业隐私和成本问题的离线AI工作流系统。该系统可在配备RTX 3080的消费级电脑上运行,利用Qwen2.5-7B模型对Jira或Slack中的工单...
Anthropic 研究团队开展了一项极具挑战性的实验,通过“智能体团队”架构,让 16 个 Claude Opus 4.6 实例并行协作,在没有人工干预的情况下,历时两周花费约 2 万美元,从零编写了一个拥有 10 万行代码的 C 语言编...
AI 独角兽 Anthropic 近期为 Claude Pro 及 Max 订阅用户推出了一项限时福利。符合条件的用户只需登录 claude.ai 官网,进入 Settings > Usage 页面并点击活动横幅,即可领取价值 50 ...
引子:同一晚的两个信号 2026 年 2 月 5 日,Anthropic 和 OpenAI 同时发了新模型公告:Claude Opus 4.6 与 GPT‑5.3‑Codex。一个主打更长上下文、更稳的深度推理和更成熟的工作流入口,另一个把...
Anthropic 正式推出旗舰模型 Claude Opus 4.6,在智能体编码和长上下文处理上实现重大突破。新模型首次引入 100 万 token 的上下文窗口,有效解决了“上下文腐烂”问题,并在 Terminal-Bench 2.0 ...
一个反直觉的观点 大家都说 RAG(Retrieval-Augmented Generation)是 Agent 的必备能力。 但我用过之后,发现了一个问题:RAG 的幻觉比直接生成还严重。 RAG 的承诺 vs 现实 理论上,RAG 应该...
Gorse是一款开源的AI推荐系统引擎,近期更新引入了大语言模型(LLM)用于推荐结果的排序优化。该系统提供可视化流程编辑,支持多种召回策略(如嵌入向量相似度、协同过滤),并能结合传统点击率预测模型或LLM对候选物品进行精排。作者已利用Go...
Anthropic 的最新讨论揭示了一个反直觉的现象:随着模型规模的增大和任务复杂度的提升,模型在多次回答同一问题时的一致性反而出现下降。这一发现挑战了“越大越好”的行业共识,表明单纯追求参数量的扩张可能导致输出结果的不可预测性增加。对于追...
本文深刻剖析了当前AI辅助编程领域的两种主流模式及其缺陷。作者指出,“氛围感编程”虽然快捷但缺乏精度,导致技术债堆积;而“规格驱动开发”虽然严谨,却引发了难以维护的“文档债务”,使得工程师被迫在重复构建上下文中消耗精力。文章核心观点在于,当...