第29期大模型周刊:前沿竞赛加剧,算力狂飙与中国开源浪潮并行
本周 AI 圈的主线很清楚:美国巨头继续把钱砸进算力、企业服务和更强的垂直能力,中国公司则沿着开源、高性价比和快速融资一路猛推。两条路线看起来不同,底层逻辑却很像——大家都在抢未来两三年的平台位。 如果只看一层表面,你会觉得本周新闻很散:O...
标签索引 / 第 18 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本周 AI 圈的主线很清楚:美国巨头继续把钱砸进算力、企业服务和更强的垂直能力,中国公司则沿着开源、高性价比和快速融资一路猛推。两条路线看起来不同,底层逻辑却很像——大家都在抢未来两三年的平台位。 如果只看一层表面,你会觉得本周新闻很散:O...
近日,有社区用户反馈谷歌Gemini应用疑似出现严重的“降智”现象。据描述,在使用Gemini 3.1P模型进行多轮对话测试时,前两轮对话尚能展示模型的思考步骤,但随着对话深入,模型突然停止输出思考过程,甚至显得不再进行逻辑推理。这一现象引...
Meta FAIR联合斯坦福等机构发布了全新编程基准ProgramBench,旨在重新定义AI编程评估方式,考核模型是否具备从零构建真实软件系统的“工程智能”。不同于传统的补全函数或修复Bug,该测试要求模型仅依据文档重建ffmpeg、SQ...
近期尝试向非技术人员推广 Claude Code 等工具时发现,AI 编程尚未实现真正的“零门槛”。用户在使用过程中,依然面临 Git 管理、沙箱环境、环境变量等底层概念的认知壁垒。实测发现,向用户解释这些工程化基础概念的时间,甚至超过了利...
近日,Claude Code 团队成员 Thariq 发文探讨了在 AI 编程交互中使用 HTML 替代传统 Markdown 的技术优势。文章指出,Markdown 虽然对人类阅读友好,但在引导大模型生成代码时,其语法解析存在模糊性,容易...
本文探讨了大语言模型(LLM)在处理高严谨性形式化规约语言TLA+时的潜力与局限。TLA+是设计复杂并发和分布式系统的核心工具,能从数学层面证明系统正确性,但其学习门槛极高。文章或相关研究通过实验测试了LLM生成TLA+模型的能力,结果显示...
近期开发者社区热议关于AI编程工具的本地化困境。尽管部分用户尝试将国产大模型API接入桌面版AI工具(如Claude),但客户端仍强制要求“科学上网”。该话题聚焦于寻找真正无需国际网络环境的解决方案,例如利用VSCode插件或特定系统配置,...
一篇来自Linux.do的热门讨论引发了关于AI使用方式的反思。作者强烈主张在应用Claude或GPT等先进大模型时,应彻底卸载“Skills”(预设技能或指令集)。文章认为,人为设定的规则往往基于用户的局限性思维,反而会束缚AI自身的想象...
随着大模型在日常工作中扮演越来越重要的角色,仅靠20美元的基础版已难以满足部分重度用户的需求。近期有用户在社区发帖,咨询升级至GPT或Claude 100美元档位的必要性。该用户除了关注高阶版的额度是否能支撑高强度使用外,更对“Max用户惨...
尽管大语言模型在文本理解上表现优异,但在处理 PDF、多级表头等复杂表格时,常因缺乏布局常识而出现幻觉与数据错位。针对这一痛点,新推出的 SnapFill 智能填表工具通过自研文档解析引擎与空间定位算法,赋予了 AI “视觉”能力。该工具支...