跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引

模型实测

这个标签下有 5 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

实测豆包2.0新模型:从多模态理解到逻辑推理的全面挑战

针对字节跳动豆包2.0新模型的高调登场,科技社区发起了针对其宣称性能的实测挑战。测试内容涵盖了图片理解与画面分析等视觉能力,同时也对概率计算这一逻辑推理核心指标进行了验证。此外,实测还深入探讨了模型在节省Token策略下,是否会出现“过于简...

1 分钟阅读226 阅读
前沿哨所

Cursor实测:GPT5.2代码表现竟优于Opus 4.5

有开发者在社区分享了Cursor的使用体验,表示在处理特定任务时,备受期待的Opus 4.5-high-thinking模型频频受阻,而切换到GPT 5.2-Code-Xhigh模型后问题却迎刃而解。这一显著的性能对比让用户对价值200美元...

1 分钟阅读305 阅读