Kimi 推出 K2.6 预览版反响平平,社区热度被 DeepSeek 全面碾压
近日,针对月之暗面推出的 Kimi K2.6 预览版,科技社区 Linux.do 上出现了关于其存在感低迷的讨论。与此前智谱 GLM 发布时引发的全站测试热潮,以及 DeepSeek 仅凭传闻便引得无数开发者密切监视(视奸)的盛况形成鲜明对...
标签索引 / 第 29 页
这个标签下有 609 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,针对月之暗面推出的 Kimi K2.6 预览版,科技社区 Linux.do 上出现了关于其存在感低迷的讨论。与此前智谱 GLM 发布时引发的全站测试热潮,以及 DeepSeek 仅凭传闻便引得无数开发者密切监视(视奸)的盛况形成鲜明对...
科技社区有消息指出,DeepSeek疑似正在进行下一代模型V4的灰度测试。在最新的测试中,该模型成功解决了被视作逻辑推理难题的“魔方题”,成为首个做对该题的国内模型之一。数据显示,其解题思考时间长达121秒,显示出极强的深度推理能力。这一表...
近日,科技社区Linux.do上的一则帖子展示了DeepSeek大模型在前端生成领域的惊人实力。通过特定的提示词,用户在未开启联网搜索及专家模式的情况下,让DeepSeek生成了高度还原iOS 18设计风格的天气卡片。该卡片完全使用HTML...
开发者推出了基于Python的白盒AI Agent基础框架easy-agent的0.3.4版本。此次更新重点在于补全漏洞并引入了BFCLv4版本的全量测试集,旨在通过百分制对齐行业标准评分。实测表明,虽然项目完整执行了测试流程,但目前分数仍...
据社区用户观察,DeepSeek 近期似乎对 Web 端模型进行了低调但重要的更新。对比测试发现,针对此前需要思考 200 秒却仍答错的复杂逻辑题(俗称“糖果题”),新模型现在能够通过长达 800 秒的深度思考链得出正确答案。这一变化不仅展...
Google 官方推出了全新的端侧 AI 技术演示应用“AI Edge Gallery”。该应用的核心亮点在于完全本地化运行,无需联网,所有推理均在手机 GPU/NPU 硬件上完成,从而实现零延迟并极大保障了用户隐私。在模型支持方面,应用集...
据社区消息流传,DeepSeek相关人士梁锋在内部发声,暗示DeepSeek V4模型或将于4月下旬正式发布。作为近期在AI领域引发震动的“黑马”,DeepSeek此前的V3及R1模型已展现出对标国际顶尖水平的实力。若此次V4确认在短期内推...
近期有科技爱好者通过一道涉及多种口味与形状组合的复杂逻辑题,对DeepSeek进行了极限测试。该题目要求计算在特定条件下,同时持有不同形状苹果味和桃子味糖果的最少取样数量,逻辑极具陷阱性。测试结果显示,相比昨日模型在“专家模式”下的错误回答...
一位开发者在为第三方Telegram客户端“Flexgram”设计Logo时,对当前主流大模型的SVG代码生成与审美设计能力进行了横向实测。测试对象包括Claude Opus/Sonnet 4.6、Gemini 3.1 Pro/Flash、...
随着DeepSeek在全球AI领域引发热潮,用户在实际使用中发现其网页版“专家模式”存在两项明显限制。实测显示,该模式目前暂不支持文件上传功能,且在资源占用上表现出独占性——当一个专家模式会话处于运行状态时,无法同时启动或回答其他会话。这一...