23岁业余人士联手ChatGPT攻克60年数学难题,陶哲轩惊叹:AI开辟了全新路径
一名23岁的数学业余爱好者借助ChatGPT成功攻克了困扰数学界长达60年的Erdős猜想(关于原始集总和的下限)。尽管该爱好者没有高等数学背景,但大语言模型(LLM)通过一次提示,提供了一种人类专家此前从未尝试过的全新解题路径。著名数学家...
标签索引 / 第 37 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
一名23岁的数学业余爱好者借助ChatGPT成功攻克了困扰数学界长达60年的Erdős猜想(关于原始集总和的下限)。尽管该爱好者没有高等数学背景,但大语言模型(LLM)通过一次提示,提供了一种人类专家此前从未尝试过的全新解题路径。著名数学家...
在传统知识工作中,我们习惯通过排版、拼写等低成本的“表面质量”来快速推测报告的实质价值,因为深入核实真相对个人而言成本过高。然而,大语言模型的出现彻底打破了这种平衡:它们能够生成语法完美、风格专业但内容可能空洞甚至错误的“拟像”。这种对写作...
这篇文章源自2021年的关键讨论,深入分析了大型语言模型(LLM)训练中的核心权衡:在固定计算预算下,是应该增加模型参数量,还是增加训练步数和数据量?研究表明,单纯追求参数规模并非最优解,通过更长时间的计算和更多数据训练较小的模型,往往能获...
随着大模型技术的爆发式发展,各大厂商竞相角逐排行榜,导致“跑分注水”、针对题库特训甚至商业定制冠军等乱象频发。这种为了刷榜而优化的行为,使得榜单难以反映模型的真实能力,不仅误导用户,也无益于技术进步。当前,行业迫切需要寻找公认、公正且无商业...
据科技社区 Linux.do 反馈,DeepSeek 最新 V4 模型的安全防御能力出现明显升级。多位开发者与用户测试发现,此前广泛流传的“破限”提示词在 V4 上已无法奏效,模型对恶意指令的识别与拦截更加精准。这一变化表明 DeepSee...
DeepSeek 官方更新 API 文档,宣布其 DeepSeek-V4-Pro 模型迎来大幅降价。根据最新显示,该模型目前正处于限时优惠期,用户可以享受原价 2.5 折的超低折扣。计费模式基于百万 tokens 单位,涵盖模型输入与输出的...
GitHub上出现了名为LamBench的新型AI基准测试,旨在通过120个纯Lambda微积分编程问题来评估大模型的算法实现能力。与常见的Python编程题不同,该测试要求模型在极简的Lamb语言环境下,仅利用函数编码来构建数据结构并实现...
谷歌云CEO托马斯·库里安在最新访谈中详细阐述了谷歌的全栈AI战略。硬件方面,谷歌将第八代TPU拆分为面向训练的8T和面向推理的8i,通过自研IP获取高毛利并优化部署成本。针对与Anthropic的复杂关系,库里安强调谷歌作为平台公司,即便...
近日,科技社区有用户发现DeepSeek模型在处理经典的逻辑测试题时表现出一种有趣的“偏科”现象:模型似乎能完美解决涉及“橘子”的问题,但当将题目中的关键变量替换为“苹果”时,其推理能力却出现明显下降或错误。这一测试结果引发了社区对于AI模...
WUPHF是一个开源的多智能体协作系统,旨在为AI员工打造一个共享大脑的虚拟办公室。该平台允许CEO、工程师等不同角色的AI智能体在同一空间内协同工作、认领任务并交付成果。其核心亮点在于采用类似Andrej Karpathy风格的Git原生...