用户实测 Kimi 代码能力遭吐槽:简单 Next.js 项目耗尽周额度且无法运行
一位开发者在 V2EX 分享了自己试用 Kimi K2.5 的糟糕经历。他表示,仅构建一个简单的 Next.js 纯前端展示 Demo,就直接耗尽了当周的算力额度,而时间限额却未用完。更令人失望的是,生成的代码质量堪忧,项目无法通过 pnp...
标签索引 / 第 86 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
一位开发者在 V2EX 分享了自己试用 Kimi K2.5 的糟糕经历。他表示,仅构建一个简单的 Next.js 纯前端展示 Demo,就直接耗尽了当周的算力额度,而时间限额却未用完。更令人失望的是,生成的代码质量堪忧,项目无法通过 pnp...
近期,科技社区出现关于 Google Gemini 模型的集中吐槽。多位资深用户反映,该 AI 工具在未经官方说明的情况下,出现了严重的性能退化现象。此前在自媒体写作、结构化生成及格式调整方面表现出色的 Gemini,突然变得无法正常输出带...
一款名为 Antimatter 的文字游戏展示了 AI 在内容生成领域的独特尝试。该游戏采用麻将接龙机制,核心在于匹配“反义词”方块。开发者指出,当前顶尖的 LLM 难以生成高深度的语言谜题,容易陷入概念雷同的循环。为解决这一痛点,作者构建...
社区近日出现了一款名为Qwen3.5-27B-Claude-4.6-Opus的蒸馏模型,引起了技术爱好者的关注。据介绍,该模型使用了约14000个Claude 4.6 Opus风格的通用推理样本进行训练。这是一种模型蒸馏技术的应用,旨在通过...
一位资深开发者分享了使用 Claude Opus、Gemini Ultra 等顶级 AI 编程模型的切身体验。他指出,顶级模型虽然官方定价高昂,但凭借极佳的指令遵从度和稳定性,能实现“一步到位”的高效开发。相比之下,次级模型虽然单价低,但常...
本文是“LLM神经解剖学”系列的续作,作者通过数学探针和大规模实验,在Qwen3.5-27B上验证了RYS(重复特定层)方法的有效性。研究发现,Transformer内部存在清晰的“三阶段”结构:早期层负责编码,晚期层负责解码,而中间层则在...
针对传统收纳软件录入成本高、操作繁琐的痛点,独立开发者推出了一款名为“巢鹊收纳”的 iOS 应用。该产品创新性地将收纳逻辑重构为 AI Agent 模式,利用 LLM 强大的语义理解能力,将传统的“手动填表”转变为“自然语言对话”。通过 P...
Hacker News上热推的GitHub开源项目MSA(Memory Sparse Attention)展示了一种针对大模型注意力机制的优化方案。该技术通过引入“内存”概念与“稀疏”计算策略,旨在解决Transformer在处理长序列时面...
如果你今天还在把 AI 产品竞争理解成“谁的模型更聪明”,那基本已经慢了一拍。我的判断是:接下来两年,真正把市场拉开差距的,不是推理分数,不是上下文长度,也不是谁会喊“Agent”喊得更响,而是责任可追溯性——系统出错以后,你能不能在足够短...
科技社区引发关于大模型“人味”的讨论。有用户吐槽GPT等主流模型回答过于“官方”,充满“如果你希望”等套话,缺乏自主执行任务的能力,导致交互体验令人血压飙升。相比之下,Opus等模型因能听懂人话、具备“人味”而备受推崇。该用户现正寻求Min...