本文探讨了各大AI模型在高三理科试卷测试中的表现分析。测试者让豆包等模型处理英文数据,并重新编排结果,显示Gemini在理科测试中绝对领先,GPT-5.1位居第二,而Qwen-3则表现落后。文章还讨论了AI模型的能力差异,如语言风格、图像理解(依赖图像工具),并推测GPT-5.2可能在未来某些学科有所突破。内容提供了对AI模型在学术测试中性能的深入洞察,有助于理解当前AI大模型的技术水平和局限性。
AI模型高考理科测试:Gemini领先,GPT-5.1次之,Qwen-3落后
未经允许不得转载:80aj » AI模型高考理科测试:Gemini领先,GPT-5.1次之,Qwen-3落后







