AI 编程实战调查:为何同样的 AI 工具,有人提效 10 倍有人只能写 Bug?
本文源于 V2EX 的一篇深度讨论,作者结合 Agent 开发岗位的面试经历,揭示了 AI 编程在实际业务落地中的巨大误区。文章指出,尽管企业普遍追求“Vibe Coding”能力,但许多团队因使用国内非一线模型及非专业 IDE,导致开发效...
标签索引 / 第 116 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本文源于 V2EX 的一篇深度讨论,作者结合 Agent 开发岗位的面试经历,揭示了 AI 编程在实际业务落地中的巨大误区。文章指出,尽管企业普遍追求“Vibe Coding”能力,但许多团队因使用国内非一线模型及非专业 IDE,导致开发效...
科技评论家 Ed Zitron 最新文章指出,当前的 AI 热潮本质上是一场由资本和巨头主导的“信息战争”。他提出一个核心观点:现阶段的 AI 本质上仍是基于统计学的概率预测模型,而“幻觉”并非系统漏洞,而是其无法剥离的根本属性。这意味着,...
字节跳动推出的豆包Seed 2.0系列模型已发布三周有余,然而在Artificial Analysis等主流评测榜单及OpenRouter模型聚合平台上仍未看到其踪影。这一缺席引发了社区对模型性能的广泛猜测,有人质疑是否因效果不佳而推迟上架...
Josef Urban团队发布最新研究成果,展示了如何利用现有的ChatGPT和Claude模型,在短短两周内自动生成了超过13万行的形式化拓扑学代码。该方法通过建立大语言模型与证明检查器之间的持续反馈闭环,以约100美元的低廉成本完成了包...
近期,有开发者在技术社区分享了一则关于谷歌Gemini模型的异常表现。在经历一次失败的工具调用后,该模型似乎发生了逻辑崩塌,输出了大量毫无逻辑的胡言乱语。更令人关注的是,在模型崩溃的文本中意外出现了竞争对手Qwen的相关字样,引发了关于模型...
Google DeepMind 悄然推出了 Gemini 3.1 Flash-lite 预览版,旨在为高频任务提供极致的效率与智能。根据官方数据及 Artificial Analysis 基准测试,该模型速度相比 2.5 Flash 提升了...
文章指出,AI编程工具的“平价时代”正走向终结,未来最顶级的AI助手将变得极其昂贵,普通开发者和学术界将面临被“价格挤出”的风险。作者通过分析定价趋势发现,从GitHub Copilot的10美元/月到Claude Code的100美元/月...
针对当前大模型领域“重算法轻数据”的资料断层,一技术团队开源了《大模型数据工程》实战指南。该项目系统梳理了涵盖预训练数据清洗、多模态对齐、SFT数据合成及高可用RAG流水线的全链路架构,并选用了Ray Data、Spark等主流技术栈。作者...
近日,社区传闻阿里巴巴通义千问(Qwen)核心研发骨干“牢林”离职,且可能被谷歌DeepMind挖角。作为千问小模型研发的关键人物,其离职能否影响Qwen在B端及轻量化模型领域的优势引发热议。分析指出,虽然阿里在AI全栈生态布局上实力雄厚,...
据社区反馈,谷歌AI Studio平台近日悄然上线了代号为“Gemini 3.1 Flash Lite Preview”的新模型,目前用户已可登录并正常使用。尽管官方尚未发布正式公告,但根据命名规则推测,该模型旨在兼顾“Flash”系列的极...