首页 / 财经 / 武汉将建200个以上高质量数据集,目标2028年AI产业规模超2000亿元

武汉将建200个以上高质量数据集,目标2028年AI产业规模超2000亿元

摸鱼不慌
摸鱼不慌

武汉近日发布《武汉市行业高质量数据集建设行动方案(2026—2028年)》,提出到2028年,全市累计建成200个以上行业高质量数据集,形成满足大模型训练需求的标准化语料资源,以推动人工智能产业规模超过2000亿元的目标。

语料资源对AI模型训练的重要性

据方案介绍,语料资源是指由出版公司通过书籍电子化形成的图文资源库,这类资源是AI模型训练中的重要数据集。出版业在版权、IP等方面拥有资源优势,这些优势或将使出版业成为AI模型研发的关键基石。

出版公司在版权、IP等方面的资源优势,或将使其成为AI模型研发的关键基石。

出版公司布局AI赋能平台

相关上市公司中,中信出版自研的夸父AI数智出版平台贯穿图书出版全流程,实现了显著降本增效。同时,公司搭建的知识精粹AI知识库已接入企业学习平台。

果麦文化在大众图书出版行业积累了海量文字语料,经过研发人员筛选、打磨后,这些语料变得更加优质,能让模型学习到规范的语言习惯和校对方法规律。

AI推动传媒内容产业双重定价

兴业证券表示,AI正推动传媒内容产业从消费品转向数据+IP资产双重定价,传统出版与网文IP将同时受益于价值重估。据财联社主题库显示,出版业语料资源的优势将进一步转化为AI模型训练的核心资源。

  • 累计建成行业高质量数据集将达到200个以上。
  • 形成满足大模型训练需求的标准化语料资源。
  • 目标推动人工智能产业规模超过2000亿元。