国产模型体验对比:MiniMax 较真爱反驳,Kimi 顺从且多模态更强
近日科技社区引发了关于国产大模型的对比讨论。用户实测发现,MiniMax(m2.5版本)在交互中表现出较强的“独立性”,倾向于坚持自己的逻辑,甚至会反驳用户观点;而月之暗面的 Kimi(k2.5版本)则显得更加“听话”,倾向于无条件执行指令...
标签索引 / 第 8 页
这个标签下有 190 篇文章。按时间回看相关判断与实践记录。
标签精选
近日科技社区引发了关于国产大模型的对比讨论。用户实测发现,MiniMax(m2.5版本)在交互中表现出较强的“独立性”,倾向于坚持自己的逻辑,甚至会反驳用户观点;而月之暗面的 Kimi(k2.5版本)则显得更加“听话”,倾向于无条件执行指令...
针对传统语音Agent必须经过ASR转录导致情绪与语调信息丢失的痛点,开发者推出了名为OpenClaw-voxsense的开源插件。该插件跳过中间的文字转换环节,直接调用Gemini的原生多模态能力处理原始音频,结合上下文实现对声音内容的深...
TutorGPT 是一款新发布的免费 AI 在线辅导工具,主打“拍照解题”与“深度步骤讲解”。与市面上仅提供最终答案的竞品不同,该产品利用多模态大模型能力,不仅能精准识别数学、物理等学科题目,还能提供逐步推导的解题思路,并支持用户针对特定步...
Google 正式发布了首个原生多模态嵌入模型——Gemini Embedding 2。该模型突破了传统单一模态的限制,能够将文本、图像、视频、音频及各类文档统一映射至同一个向量空间中。这一技术升级使得跨媒体类型的语义检索和分类成为现实,开...
AI 接口平台 OpenRouter 近期悄然上线了两款神秘的“隐形”模型:Hunter Alpha 和 Healer Alpha。其中,Hunter Alpha 号称拥有 1 万亿参数和 100 万 token 的上下文窗口,专为长程规划...
Hacker News上的一篇讨论文章引发关注,观点称“AGI中的G或许代表Gemini”,以此强调Google大模型的强势崛起。尽管许多用户仍认为ChatGPT表现更稳,但大量反馈指出Gemini在多模态能力上实现了突破。一位用户分享了实...
谷歌正式推出了Gemini Embedding 2,这是其首个完全原生的多模态嵌入模型。该模型具备突破性的跨模态能力,能够将文本、图像、视频、音频和文档等多种形式的数据,统一映射到同一个高维向量空间中。不同于以往需要分别处理不同模态的方案,...
AI Key 聚合工具 Metapi 发布 V1.2.2 版本,旨在解决用户分散管理多个 API 中转站的痛点。新版核心特性包括:完整的移动端响应式布局与桌面客户端支持,实现了全平台覆盖;新增文件上传代理,支持图片、PDF 等多种格式解析;...
最新技术讨论显示,GPT-5.4 在视觉领域实现了从“识别”到“定位”的关键突破。相比旧版模型仅能理解图片内容却无法提供准确坐标,GPT-5.4 能够根据描述精准返回 UI 元素的相对坐标。这一改进使得 AI 不再依赖 DOM 结构,而是通...
用户对腾讯云新推出的 Coding Plan 服务进行了上手实测。结果显示,腾讯自家的混元大模型表现相对中规中矩。然而,该平台集成的第三方模型 Kimi 2.5 和 GLM-5 并未出现类似百度千帆平台的功能阉割情况,完整保留了图片理解等核...