根据央视新闻从国家数据局获得的最新消息,我国在优质数据资源供给方面取得了突破性进展。截至今年 6 月底,全国范围内已建成包括科学研究、工业制造、医疗卫生及教育教学在内的关键行业领域高质量数据集共计 12 万个。这些数据集的总体存储量已超过 1565 拍字节(PB),这一数字较今年第一季度末实现了 60% 以上的惊人增长。若以中国国家图书馆数字资源总量为参照,当前数据体量约为其 547 倍。这一庞大的数据基础设施为我国人工智能技术的迭代升级提供了坚实的底座支撑。此外,数据产业链上下游协同发展态势明显,成都、沈阳、合肥等七个数据标注先行先试城市的标注规模已突破 119 PB,相关从业人员达到 14 万人,有效保障了高质量数据集的建设需求。国家数据局明确表示,下一步将致力于构建服务人工智能的高质量数据供给体系,探索建立数据集有偿使用的价值闭环机制,以实际应用场景牵引数据供给,利用数据驱动模型持续迭代。
事件分析
💡 核心观点:建立垂直领域“数据水库”与正规化标注产业,标志着我国 AI 战略已从算法竞争转向底层数据要素供给的系统性变现与治理。
原文链接:Linux.do





