国产大模型“御三家”之争:DeepSeek、Kimi与豆包等头部玩家激战正酣
近日,科技社区 Linux.do 发起了一场关于“国产大模型御三家”的评选讨论,引发了广泛关注。投票列表囊括了当前国内主流的顶尖大模型产品,包括风头正劲的 DeepSeek(提及 V4 系列)、月之暗面的 Kimi(K2.6)、阿里的通义千...
标签索引
这个标签下有 4 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,科技社区 Linux.do 发起了一场关于“国产大模型御三家”的评选讨论,引发了广泛关注。投票列表囊括了当前国内主流的顶尖大模型产品,包括风头正劲的 DeepSeek(提及 V4 系列)、月之暗面的 Kimi(K2.6)、阿里的通义千...
据社区反馈,Kimi最新模型版本在OpenRouter平台取得重大突破,成功跻身总榜第三名,并夺得编程能力榜单第一名。与此前依靠免费推广策略不同,此次排名提升主要归功于模型在编程等硬核任务上的真实表现与性能提升。这一成绩不仅展示了国产大模型...
随着大模型技术爆发,各类评测榜单层出不穷,导致用户难以分辨模型真实实力。本文汇总了目前业内公认最可信的四大AI评测基准,包括关注质量与性价比的 Artificial Analysis、侧重高难度未见任务的 LiveBench、中文权威的 S...
参考第三方榜单数据显示,在模型智力评分方面,豆包仅得34分,显著落后于Kimi(47分)和DeepSeek(42分)。然而,吊诡的是,豆包却是目前国内用户量最大的AI应用。分析指出,豆包的成功并非源于顶尖的推理能力,而是胜在极致的用户体验和...