Mistral AI 推出 Forge:让企业利用私有数据构建专属 AI 模型
Mistral AI 正式发布企业级 AI 训练平台 Forge,旨在帮助企业利用私有数据构建专属的前沿模型。与依赖公共数据的通用 AI 不同,Forge 允许企业将内部文档、代码库、合规政策和运营流程融入模型训练全流程(包括预训练、后训练...
标签索引 / 第 2 页
这个标签下有 22 篇文章。按时间回看相关判断与实践记录。
标签精选
Mistral AI 正式发布企业级 AI 训练平台 Forge,旨在帮助企业利用私有数据构建专属的前沿模型。与依赖公共数据的通用 AI 不同,Forge 允许企业将内部文档、代码库、合规政策和运营流程融入模型训练全流程(包括预训练、后训练...
一款名为“CIA World Factbook Archive”的开源项目在 Hacker News 上引发关注。该项目将 1990 年至 2025 年间长达 36 年的《CIA 世界概况》出版物进行了数字化结构处理,构建了一个包含 281...
面对英伟达显卡价格高昂且货源紧缺的现状,社区发起了关于利用AMD显卡进行深度学习模型训练的讨论。文章汇总了Bilibili及知乎上的实操案例,探讨了在非CUDA环境下运行PyTorch的可行性与具体方案。这一趋势不仅反映了开发者对降低算力成...
近日,有用户在使用谷歌Gemini生成视频时,发现画面右下角竟意外出现了字节跳动旗下AI产品“豆包”或其相关项目的特征性水印。这一“翻车”事件引发社区热议,暗示谷歌在模型训练过程中,可能混入了由竞争对手AI生成的合成数据。这不仅暴露了谷歌数...
一位开发者分享了其开源项目 CookLLM 的最新进展,详细记录了从零开始构建一个 29M 参数小模型的全过程。目前项目已进入预训练至 SFT 及 RL 阶段,作者利用 OpenCSG FineWeb 数据集进行训练,并运用 Scaling...
随着通用大模型训练数据的日益枯竭,特定垂直领域的私有代码库正成为科技公司竞相争夺的战略资源。社区讨论指出,SKILL语言作为EDA(电子设计自动化)领域的核心脚本语言,不仅包含了基础的代码逻辑,更封装了完整的芯片开发框架与严谨的工程方法论。...
本文记录了一次独特的技术尝试:利用海量算力对拥有万亿参数的超大模型进行微调,旨在赋予其生成幽默内容的能力。尽管在模型参数规模上达到了顶峰,但实际生成的笑话效果却被观众评价为“并不好笑”。这一实验生动地揭示了当前大语言模型的局限性:单纯依靠参...
据报道,英伟达数据战略团队曾主动接触知名“影子图书馆” Anna’s Archive,寻求合作。英伟达明确表示希望将其拥有的数百万盗版电子书纳入大语言模型的预训练数据集。此外,英伟达还咨询了如何付费获取该网站的高速访问权限。这一...
FinePDFs是一个专注于PDF文档的数据集项目,爬取了2013至2025年间的PDF文件,经过数据清洗与标记后,构建了一个包含1733种语言、规模达4.75亿文档的数据库。团队发现当前AI模型训练内容中PDF文档占比仅0.6%,但大量技...
本文为个人AI训练爱好者提供了Nvidia显卡的详细选购指南。汇总了从高端RTX 5090、4090D到中端4080、3090,再到入门级3060等多款显卡,涵盖当前市场价格(如闲鱼、淘宝)、显存大小(96G到12G)、性能表现及软件兼容性...