深度解析国际象棋引擎的“怪异”训练法:LLM研究者的宝贵启示
本文探讨了现代国际象棋引擎(如lc0)采用的非常规训练技术,揭示了其与大模型(LLM)研究的深刻联系。文章指出,一旦具备强大搜索能力的引擎存在,昂贵的强化学习(RL)训练可被“蒸馏”替代,验证了搜索算力的极高价值。更具启发的是,利用SPSA...
标签索引 / 第 81 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
本文探讨了现代国际象棋引擎(如lc0)采用的非常规训练技术,揭示了其与大模型(LLM)研究的深刻联系。文章指出,一旦具备强大搜索能力的引擎存在,昂贵的强化学习(RL)训练可被“蒸馏”替代,验证了搜索算力的极高价值。更具启发的是,利用SPSA...
近日,有技术社区用户爆料称,在二手交易市场(如闲鱼)购买所谓的“Claude Code 4.6”中转服务时,遭遇了严重的“货不对板”问题。据反馈,部分商家利用信息差,将后台实际请求路由至成本更低的智谱GLM-4.7等国产模型,以此通过差价牟...
本文提出了“语义消融”(Semantic Ablation)这一概念,深刻剖析了AI写作变得平庸、乏味甚至危险的根源。与产生虚假信息的“幻觉”不同,语义消融是指算法为了追求统计概率最大化,在RLHF(人类反馈强化学习)的作用下,系统性地剥离...
五角大楼正计划切断与AI公司Anthropic的合作,并将其标记为“供应链风险”,以此迫使所有美国军方承包商与其断交。此前,Anthropic因对军方使用AI模型的方式设置限制(特别是在武器和战场作战领域)而引发高层不满。官员警告称,Ant...
针对开发者在调用大模型 API 时遇到的调试难题,作者开源了一款名为 PrismCat 的透明代理工具。该工具通过将 API 请求指向本地地址,无感记录所有请求与响应细节,并提供 UI 界面进行可视化复盘。其核心亮点包括智能折叠 Base6...
近日,有用户在 Linux.do 社区分享了对 Kimi 2.5 的测试结果。当上传一张其并不认识的角色图片并提问时,Kimi 2.5 并未直接编造答案,而是展现出了极具人性化的“思考”过程。在推理链中,该模型五次自我提示应该放弃猜测并诚实...
该项目将知名AI专家Andrej Karpathy的Python版GPT语言模型重写为纯C99代码(MicroGPT-C)。通过移除Python和PyTorch依赖,并利用编译器自动向量化(SIMD),其在相同任务下的训练速度相比原版Pyt...
针对AI Agent的最新研究推出了SkillsBench基准测试,通过86项任务和7308条轨迹评估了“技能”对智能体的实际增益。结果显示,人工精心策划的技能能将任务通过率平均提升16.2%,且小模型配合技能甚至能匹敌大模型。然而,结论极...
作者基于7年AI/ML从业经验,整理了一份非传统的开源教材,旨在解决传统教材“重符号、轻直觉”的问题。该资料摒弃了晦涩的数学推导,专注于从第一性原理解释数学、计算机和AI概念。其实用性已得到验证:多位朋友利用此笔记准备面试,成功拿到了Dee...
据科技论坛Linux.do网友反馈,Google Gemini在结合实时搜索信息方面展现出惊人速度。用户上传刚刚拍摄的春晚直播画面进行测试,Gemini在间隔不到5分钟的情况下便准确识别出相关节目信息,而GPT在此类实时事件处理上稍显滞后。...