大模型微调全攻略:从LoRA优化到RLHF对齐的硬核实战图谱
本资源整理了一套大模型(LLM)微调全流程实战课程,内容涵盖Transformer底层原理、LoRA/QLoRA高效微调算法,以及Flash Attention和模型量化等性能优化技术。课程还深入探讨了分布式训练与RLHF人类反馈强化学习,...
标签索引 / 第 80 页
这个标签下有 1711 篇文章。按时间回看相关判断与实践记录。
标签精选
本资源整理了一套大模型(LLM)微调全流程实战课程,内容涵盖Transformer底层原理、LoRA/QLoRA高效微调算法,以及Flash Attention和模型量化等性能优化技术。课程还深入探讨了分布式训练与RLHF人类反馈强化学习,...
Waymo宣布正式启用第六代Driver系统,开启完全无人驾驶运营的新阶段。作为下一代扩张的核心引擎,该系统通过简化硬件配置在保持高安全标准的同时大幅降低了部署成本。新系统设计更具适应性,不仅兼容多种车辆平台,还显著提升了应对极端冬季天气等...
法国 AI 巨头 Mistral AI 正式宣布收购高效能 Serverless 云平台 Koyeb,旨在强化其自有的「Mistral Compute」服务。Koyeb 专精于帮助开发者在 CPU、GPU 及各类硬件加速器上无缝运行和扩展 ...
近日有开发者爆料,在使用 Claude Sonnet 模型 API 时,遭遇了令人啼笑皆非的一幕:模型竟声称自己是 DeepSeek。这一现象不仅引发了社区对大模型幻觉和身份识别机制的讨论,更揭示了当前主流 LLM 在面对特定提示词或复杂语...
Anthropic 正式推出了全新升级的 Claude Sonnet 4.6 模型,该版本在编程、计算机操作及长文本推理能力上实现了显著突破。作为目前 Free 和 Pro 用户的默认版本,Sonnet 4.6 提供了高达 1M token...
本文探讨了AI构建的“后稀缺乌托邦”可能面临的人性挑战。作者指出,即便AI技术让物质极大丰富(如《星际迷航》所示),人类依然无法摆脱痛苦与焦虑。核心原因在于“位置商品”——如地位、尊重、关注和爱——本质上是稀缺且排他的。正如职场中对头衔的执...
Google NotebookLM 迎来备受期待的功能更新,极大地增强了其在工作流中的实用性。针对AI生成的幻灯片,NotebookML 现已支持“基于提示词的修订”功能,用户可以通过自然语言指令直接对幻灯片进行微调、裁剪和定制,从而精准控...
Anthropic发布迄今最强Sonnet模型4.6,全面升级编程、计算机操控及智能体规划能力,支持100万token上下文。该模型性能已逼近旗舰级Opus 4.5,但定价维持不变,性价比极高。早期评测显示,其在代码修复、复杂表格处理及多步...
Continue是一款创新的开发者工具,它将AI代码审查无缝集成到GitHub的CI流程中。用户只需在代码仓库中添加Markdown文件定义检查规则,Continue便会在每次PR提交时自动运行,并将结果作为状态检查反馈:代码合格显示绿色,...
mage-bench 是一个基于开源平台 XMage 的创新项目,旨在让大语言模型(LLM)在虚拟桌面上通过《万智牌》进行对抗。该项目打破了以往AI玩棋类游戏的简化模式,坚持使用完整的游戏规则,涵盖了指挥官、标准、摩登和特选等多种复杂赛制。...