国产大模型现状:Kimi与GLM被视为唯二追赶者,MiniMax因营销过猛遭质疑
近期科技社区对国产大模型的实际能力展开了深入讨论,观点认为在“国产御三家”中,仅有 Kimi 和智谱 GLM 在编程及综合能力上能真正咬紧 GPT 和 Claude 等国外第一梯队。相比之下,MiniMax 虽然发布频繁且宣传攻势猛烈,号称对标最强模型,但实际体验被指与宣传严重不符,这种“营销大于技术”的行为被批评为意在拉升股价,令人...
阅读全文实时动态 / 第 685 页
追踪 AI、开源与工程领域的重要动态。
近期科技社区对国产大模型的实际能力展开了深入讨论,观点认为在“国产御三家”中,仅有 Kimi 和智谱 GLM 在编程及综合能力上能真正咬紧 GPT 和 Claude 等国外第一梯队。相比之下,MiniMax 虽然发布频繁且宣传攻势猛烈,号称对标最强模型,但实际体验被指与宣传严重不符,这种“营销大于技术”的行为被批评为意在拉升股价,令人...
阅读全文BrowserRouter 是一款专为 macOS 打造的浏览器自动路由工具,旨在解决用户在多浏览器环境下的链接分发痛点。该工具不仅支持基于域名、路径及查询参数的通配符规则匹配,还具备类似 Dock 的浮窗选择功能和一键隐身模式切换。最引人注目的是其开发背景:作者全程借助 AI 编程工具实现“零代码”开发,最终交付了一款体积仅 560...
阅读全文近期,AI 模型厂商的版权管控力度显著升级。知名开源项目 OpenCode 接到了 Anthropic 的正式法律告知,被迫移除所有与 Claude 模型相关的代码与功能。从 GitHub 的 PR 记录来看,OpenCode 已全面妥协,切断了用户通过该项目调用 Claude 的途径。此事不仅是单一项目的关停,更揭示了 Anthro...
阅读全文这款名为 bookmark-organizer 的开源工具表面上用于整理 Chrome 书签,实则旨在验证一套新的 AI Agent 交互协议,即如何安全地修改本地半结构化数据。该工具摒弃了盲目自动化,强制执行“扫描、分析、计划、验证、预览、应用”的严格流程。它先确定 plan.json,进行有效性检查和差异对比,并在执行前强制备份。...
阅读全文效率工具「休息日」发布了 1.7.0 版本,重点新增了订阅式节假日模板功能。值得注意的是,开发者通过 GitHub Commit 记录透露,该功能的实现高度依赖 AI 辅助工具 Claude 和 Codex。这一案例生动展示了当前 AI 编程助手在实际开发场景中的应用能力——不仅帮助开发者解决了长期拖延的 TODO 任务,更显著提升了...
阅读全文近日,科技社区针对OpenRouter上出现的匿名模型Hunter Alpha和Healer进行了深度测试。通过分词器特殊Token分析,确认两者均为小米Mimo系列模型,排除了此前外界猜测其为DeepSeek、GLM或Kimi套壳的可能性。然而,实测反馈显示,最新的Mimo v2 Pro正式版在代码生成能力上相比早期的Hunter-...
阅读全文一位长期使用 Claude 的技术爱好者分享了 GPT 5.4 的最新使用体验。相较于其认为“完全没法比”的 GPT 5.2 版本,新版本在切换至 High 模式后表现惊艳。实测发现,Xhigh 模式虽然推理更深,但速度慢且思维发散,实用性不如 High 模式。尤其在代码处理方面,GPT 5.4 High 模式的表现被认为优于 Cla...
阅读全文近期科技行业,尤其是 AI 领域出现了明显的“涨价降额”趋势。国外如谷歌、Codex、Windsurf 等纷纷降低额度或提高价格;国内 GLM、MiniMax 等也收紧了并发限制。与此同时,内存存储成本高企导致手机等硬件涨价,地缘政治更增加了供应链风险。面对行业内日益收紧的成本控制和高价壁垒,开发者和普通用户将希望寄托在 DeepSe...
阅读全文本文深入探讨了在AI辅助开发背景下,如何重构“文档工程”以适配Agent协作。作者指出,单纯依赖AI阅读代码效率低下且易出错,必须建立具备结构、边界与可追溯性的知识体系。文章提出了文档工程的三个层次(规范、过程、成品),并详细演示了如何通过全局与项目级的 `AGENTS.md` 定义AI的行为边界与决策原则。这套方法论的核心在于通过清...
阅读全文一位资深开发者在实测 OpenAI 生态下的开源代理工具 OpenClaw 后发现,尽管其部署门槛降低,但在实际应用中存在严重的技术局限。特别是在处理需要长时间运行的代码生成或任务执行时,系统往往因进程阻塞机制问题导致任务被迫中断。经查证 GitHub 社区反馈,该问题源于 OpenClaw 缺乏有效的后台轮询机制,主进程无法等待子任...
阅读全文针对 AI 应用和跨端开发中 LaTeX 数学公式渲染的痛点,开发者推出了开源项目 RaTeX。该项目采用 Rust 语言进行原生的公式解析与排版,通过输出统一的 DisplayList(绘制指令),实现了在各端(iOS、Android、Flutter、RN)的原生高性能绘制。相比传统的 MathJax(性能较差)或依赖 WebVie...
阅读全文本文深入探讨了大语言模型(LLM)的技术边界与能力局限。尽管 LLM 在文员工作、代码编写及医疗诊断等具备强文本模式的领域已达到甚至超越人类水平,但在国际象棋、中国象棋和围棋等博弈领域却表现拙劣。这一反例有力地揭示了 LLM 的本质:它是基于概率的统计模型,擅长模式匹配与文本预测,而非基于逻辑的深度搜索与空间规划。
阅读全文开发者 bingoYB 发布了开源 AI 书签管理插件 HamHome,现已正式上架 Chrome 商店。该工具主打隐私优先与本地化,采用“BYOK”模式支持 OpenAI、Claude 及通过 Ollama 接入本地大模型,能自动提取网页摘要并分类。核心亮点包括基于 WebDAV 的去中心化多端同步、确保原网页失效仍可查看的快照功能...
阅读全文本文分享了一位 Android 开发者设计的“混合模型”开发流水线。作者将 Cursor (Opus4.6) 用于核心编码,GitHub Copilot (GPT5.4) 用于代码 Review,最后利用 Claude Code + Kimi-2.5 进行编译验证。这种“组合拳”策略通过将昂贵的高级模型与免费额度及低成本模型结合,在保...
阅读全文开发者推出了一款名为 IMClaw 的即时通讯工具,专门为 AI Agent 设计,旨在解决当前智能体之间互不相通的“孤岛”问题。通过 IMClaw,Agent 可以自主完成加好友、创建群聊以及参与公开话题讨论(如“围炉煮茶”)等社交行为。用户作为旁观者,仅需通过 Dashboard 观察其 Agent 的社交网络与协作过程。该项目现...
阅读全文开源 SSH 终端工具 Netcatty 发布重大更新,致力于成为付费软件 Termius 的免费平替。该工具不仅实现了多种云同步(如 GitHub Gist、S3、WebDav),还创新性地集成了 AI 驱动功能。用户可通过侧边栏对话框直接指挥 AI 执行集群组建、远程部署及故障排查等复杂操作,并支持接入 OpenAI、Claude...
阅读全文谷歌正式向测试者发放了 Gemini Mac 应用内测版,意在桌面端与 ChatGPT 和 Claude 展开竞争。该应用不仅集成了文生图、视频音乐生成及文档分析能力,代码中更揭示了名为「Desktop Intelligence」的测试功能。该功能允许 AI 读取屏幕内容并提取应用信息,实现更深度的上下文交互,类似于 Android ...
阅读全文Kimi 参与开发的员工在知乎发文指控,MiniMax 于 2 月发布的 M2.5 模型中,其 Office 能力与 Kimi 版本高度相似,约有 8000 行代码一致。该员工指出,相关 PDF 脚本随后被删除,MiniMax 转而宣称其为“自研”工具。此外,MiniMax 在 3 月发布 M2.7 时依然更新了 Office 能力。...
阅读全文近日,有技术用户对小米名为“龙虾”(MiMO Claw)的设备进行了安全测试。该设备底层基于阿里云环境,测试者发现可以在该环境中成功部署1Panel管理面板,并意外获取了sudo(超级用户)权限。尽管该服务当前处于NAT网络下,无法直接通过公网访问,但测试人员指出,理论上可部署frpc服务实现内网穿透,进而从外部控制该服务器。这一发现...
阅读全文小米大模型团队负责人罗福莉在社交媒体宣布,正式发布MiMo-V2-Pro、Omni及TTS全栈模型家族,宣称这是专为Agent时代打造的产品。她指出,AI行业正经历从“对话”向“智能体”的极速范式转移。同时,为推动内部应用,罗福莉向团队发出了近乎严苛的要求,暗示成员若每天对话次数少于100次可辞职,这反映了小米试图通过高频内部使用快速...
阅读全文