标签索引
AI大模型
这个标签下有 197 篇文章。按时间回看相关判断与实践记录。
标签精选
相关内容
AI 大模型陷入“挤牙膏”时代?巨头放缓大版本迭代背后的隐忧
近期 AI 界出现了一种明显的“版本号停滞”现象。无论是 Claude 的 4.x 系列、OpenAI 的 GPT-4o 迭代,还是 Gemini 的更新节奏,巨头们似乎都在频繁进行小版本修补,却迟迟未推出划时代的 5.0 或下一代大模型。...
豆包输入法正式上线 Mac 版:字节跳动将 AI 大模型植入桌面端
字节跳动旗下豆包输入法正式推出了 macOS 客户端,标志着这款 AI 原生输入法完成了从移动端到桌面端的布局。该版本核心亮点在于深度集成了豆包 AI 大模型,允许用户在输入框内直接调用 AI 进行内容创作、润色和问答,无需跳转应用。此外,...
实测:编程虽弱,但豆包在联网搜索上竟“碾压”DeepSeek?
近日,一篇针对大模型信息检索能力的实测引发关注。在查询最新的Chrome API时,GPT-4、Gemini、Copilot等主流模型均出现幻觉或无法回答。令人意外的是,此前被诟病编程能力较弱的字节跳动豆包,却与Grok一同准确答对,表现远...
实测揭露千问推理模型“顽疾”:陷入思考死循环,耗尽Token却无输出
近期社区测试发现,阿里千问系列的QWQ及Qwen 3.6等推理模型存在严重的“过度思考”问题。在GSM8K、HotpotQA等多项基准测试中,模型容易陷入思考死循环,表现为反复检查逻辑、切换候选答案或纠结于边界条件,最终导致达到最大Toke...
限时福利!OpenCode 宣布免费开放 DeepSeek V4 Flash 模型
OpenCode 平台宣布限时免费提供 DeepSeek V4 Flash 模型接口,这对开发者和 AI 爱好者来说是一重大利好。据悉,V4 Flash 模型主打极速推理与高性能平衡,旨在降低用户尝试前沿大模型技术的门槛。尽管原文细节有限,...
斥资550万欧元却难言“真开源”?深度解析葡萄牙语大模型AMÁLIA的争议与困境
葡萄牙政府投资550万欧元打造了AMÁLIA大模型,旨在捍卫欧洲葡萄牙语在AI时代的地位。该项目由顶尖高校联合研发,基于EuroLLM架构,虽在部分基准测试中表现出色,但遭到了业界的深度审视。批评指出,该项目自称“全开源”却未公开模型权重、...
疑似套壳Gemini?社区热议国产大模型Qwen是否存在蒸馏行为
近日,科技社区Linux.do出现热议话题,有用户声称在本地部署阿里Qwen模型时发现其疑似基于Google Gemini进行蒸馏(Distillation)。该贴指出两者在特定输出上存在惊人的相似性,从而引发了对国产大模型技术路线的广泛质...
DeepSeek 多模态能力获实测好评:识图速度快且准,灰度测试已开启
DeepSeek 正在逐步向部分用户开放其多模态识图功能。据科技社区反馈,获得灰度测试资格的用户对该功能评价极高,称其识别速度极快且准确率高,能够覆盖常见的图片类型。这标志着 DeepSeek 在巩固文本生成优势的同时,正迅速补齐视觉交互短...
DeepSeek R1 遭遇离谱 Prompt 攻击:竟触发 14000 字思考链最终报错
Linux.do 社区用户发现,一个特定的 Prompt(提示词)能让 DeepSeek 模型陷入“死循环”。该指令要求模型进行高难度的词语解构与抽象文字游戏,结果导致 DeepSeek R1 进入极长的“思考”状态,单次思考量甚至高达 1...