UNITY模型逻辑测试失误:推理全面却答错经典题
厦门实验室的UNITY模型在逻辑能力测试中表现不佳。面对经典逻辑题“如果不把红色的球放在蓝色的盒子里,那么蓝色的盒子里一定没有红色的球吗?”时,尽管模型思考过程全面有条理,却给出错误答案“一定没有”。相比之下,Claude、ChatGPT、...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
厦门实验室的UNITY模型在逻辑能力测试中表现不佳。面对经典逻辑题“如果不把红色的球放在蓝色的盒子里,那么蓝色的盒子里一定没有红色的球吗?”时,尽管模型思考过程全面有条理,却给出错误答案“一定没有”。相比之下,Claude、ChatGPT、...