近日有用户在实测中发现,字节跳动旗下的豆包2.0在APP端的长对话能力存在严重短板。尽管模型声称支持高输出上限,但在实际连续对话中,仅进行了约14轮互动(总计约1万 Tokens)后,模型便会彻底遗忘初始指令和上下文内容。用户指出,这种记忆丢失表现为对先前设定规则的完全无知,导致无法执行连贯的专业任务,推测APP端可能存在隐藏的上下文窗口限制。该测试结论表明,目前的豆包APP端并不适合用于高强度或依赖长记忆的专业场景。
豆包2.0实测“健忘”?用户指APP端长对话仅维持14轮,上下文仅约1万Tokens
未经允许不得转载:80aj » 豆包2.0实测“健忘”?用户指APP端长对话仅维持14轮,上下文仅约1万Tokens
相关推荐
突破Transformer瓶颈:全球首个全亚线性大模型SubQ发布,支持1200万Token上下文
谁是前端之王?DeepSeek、Kimi等国产大模型UI生成能力实测对比
实测DeepSeek超长上下文短板:400K窗口下Agent逻辑失效陷入死循环
疑似美团LongCat 2.0现身:支持百万上下文与128K输出
实测Qwopus3.6-27B:200k上下文加持,多模态与推理能力表现惊艳
挑战 Claude 与 Gemini:DeepSeek V4 Pro 写作能力实测与官方数据全解析
长文本实战测评:DeepSeek与Kimi霸榜,Qwen等旗舰模型意外翻车
实战测评:在复杂航线推理任务中,GPT表现仍显著优于Grok与Gemini