跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 37 页

大模型

这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

AI制造的“完美假象”:当大模型粉碎了知识工作的质量护城河

在传统知识工作中,我们习惯通过排版、拼写等低成本的“表面质量”来快速推测报告的实质价值,因为深入核实真相对个人而言成本过高。然而,大语言模型的出现彻底打破了这种平衡:它们能够生成语法完美、风格专业但内容可能空洞甚至错误的“拟像”。这种对写作...

1 分钟阅读99 阅读
前沿哨所

大模型“刷榜”乱象丛生:如何寻找真正公正的AI测评平台?

随着大模型技术的爆发式发展,各大厂商竞相角逐排行榜,导致“跑分注水”、针对题库特训甚至商业定制冠军等乱象频发。这种为了刷榜而优化的行为,使得榜单难以反映模型的真实能力,不仅误导用户,也无益于技术进步。当前,行业迫切需要寻找公认、公正且无商业...

1 分钟阅读187 阅读
前沿哨所

用纯Lambda微积分拷问AI逻辑能力:新基准LamBench问世

GitHub上出现了名为LamBench的新型AI基准测试,旨在通过120个纯Lambda微积分编程问题来评估大模型的算法实现能力。与常见的Python编程题不同,该测试要求模型在极简的Lamb语言环境下,仅利用函数编码来构建数据结构并实现...

1 分钟阅读155 阅读
前沿哨所

DeepSeek被曝存在“水果”推理盲区:能解橘子题却搞不定苹果

近日,科技社区有用户发现DeepSeek模型在处理经典的逻辑测试题时表现出一种有趣的“偏科”现象:模型似乎能完美解决涉及“橘子”的问题,但当将题目中的关键变量替换为“苹果”时,其推理能力却出现明显下降或错误。这一测试结果引发了社区对于AI模...

1 分钟阅读135 阅读