实测揭露千问推理模型“顽疾”:陷入思考死循环,耗尽Token却无输出
近期社区测试发现,阿里千问系列的QWQ及Qwen 3.6等推理模型存在严重的“过度思考”问题。在GSM8K、HotpotQA等多项基准测试中,模型容易陷入思考死循环,表现为反复检查逻辑、切换候选答案或纠结于边界条件,最终导致达到最大Toke...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
近期社区测试发现,阿里千问系列的QWQ及Qwen 3.6等推理模型存在严重的“过度思考”问题。在GSM8K、HotpotQA等多项基准测试中,模型容易陷入思考死循环,表现为反复检查逻辑、切换候选答案或纠结于边界条件,最终导致达到最大Toke...