实测智谱 GLM 编码性能遭质疑:生成五行代码耗时半小时,疑似遭遇服务限流
一位开发者日前在技术论坛发帖反馈,在实测智谱 GLM-5.2 模型进行代码编写时遭遇了严重的性能瓶颈...
一位开发者日前在技术论坛发帖反馈,在实测智谱 GLM-5.2 模型进行代码编写时遭遇了严重的性能瓶颈...
随着人工智能技术的飞速发展,AI 辅助编程已成为提升开发者生产力的核心手段,围绕不同大模型在编码领域...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
近日,GitHub 社区发布了一款名为 `devin-byok-plus` 的开源工具,这是一款专为...

Paul 这一讲一开场就先打了个预防针:今天讲的是高度浓缩版的内容,MIT 隔壁的 ALP 那门课才是正经讲大模型,这里只是个高空俯瞰。听到一半我反而觉得,这种”俯瞰”才是真正值钱的。他把一个被无数公众号、技术博客、...

监督学习像一次考试,你答一道题,老师立刻给分。强化学习不是。强化学习是你下一整盘棋,走了几十步,最后才知道这盘赢没赢,而且没人告诉你哪一步是关键的。这个差别看起来只是”反馈给得晚一点”,但它把整套训练范式都拧到了另一...

1976 年,一个叫 David McGurk 的心理学家做过一个实验。他给受试者放两段视频,画面里两个人在说话,音轨完全一样,但其中一个人的嘴型是发”ba”,另一个是发”fa”。受试者听到的...
近日,一位开发者在技术社区 Linux.do 发起了一项针对国产大模型并发编程推理能力的测评,题目选...
近日,技术社区 Linux.do 发起了一项针对主流大模型的高难度编程基准测试,通过构建一个基于 T...

最近 Twitter 上的「RAG 已死」和 Google 上「RAG」的搜索曲线,方向是反的。前者一年比一年响,后者在 2025 年中段创了新高。两条线对不上,要么是社交媒体放大了少数派意见,要么是「RAG」这个词被两边人各说各话。 Tu...
近日,一位开发者在技术社区分享了关于将不同 AI 模型接入 Claude Code 的性能对比测试。...

作者:toy | 覆盖周期:2026.6.6 – 2026.6.12 这一周的主线是”交卷”。6 月 8 日,OpenAI 把保密版 S-1 递给 SEC,距 Anthropic 递交正好一周——AI 第一梯队的两家...
Moonshot AI 推出的开源编程模型 Kimi K2.7-Code 在 Hacker News...
一位开发者在拥有20万行核心代码的大型项目中,对主流国产模型与海外旗舰模型进行了深度实战测评。测试指...
近期,开发者社区 Linux.do 上发起了一场关于国产大模型代码生成能力的深入讨论,核心议题聚焦于...
一位重度 AI 用户在技术社区 Linux.do 发帖求助,披露其每月在 LLM 推理上的 Toke...
小米近期在代码托管平台 GitHub 上正式开源了其 AI 编程助手项目 MiMo-Code。该工具...
近日,在大模型底层优化社区引发了关于 AI 编程能力的激烈讨论。一位开发者在技术社区分享了针对 Cu...
近日,开发者社区针对热门 AI 编程工具 Cursor 的订阅额度机制展开了热议,焦点集中在 Pro...
在最近的一项针对大模型 UI 设计与编码能力的实测中,开发者发布了一项具体挑战:要求模型仅使用 HT...
这篇来自研究人员 Sahil Sen 等人的论文深入探讨了大型语言模型(LLM)在代理系统中的信息检...