小米宣布扩展其超级小爱同学试点计划,将更多旧款旗舰设备纳入支持名单,这一举措体现了小米对现有用户群体的重视,并非仅将高级AI功能局限于最新机型。 此次...
2025-08-14 0
8月14日上午10时,国务院新闻办公室举行关于“十四五”时期数字中国建设发展成就的新闻发布会。国家发展改革委党组成员、国家数据局局长刘烈宏介绍,2024年初,我国日均Token(词元)的消耗量为1千亿,截至今年6月底,日均Token消耗量已经突破30万亿,1年半时间增长了300多倍,这反映了我国人工智能应用规模的快速增长。
他介绍,截至今年6月底,我国已经建设高质量数据集超过3.5万个,总体量超过了400PB(1PB可存储约5亿张2MB大小的高清照片,400PB的总量相当于中国国家图书馆数字资源总量的140倍左右)。人工智能模型的训练也推动了数据交易需求的攀升,截至今年6月底,各地高质量数据集累计交易额近40亿元,数据交易机构挂牌的高质量数据集总规模达到了246PB。以北京数交所为例,高质量数据集占交易总量的比例从去年的10%跃升到目前的近80%。
他介绍,上海、天津、安徽等地正在试点“数据语料作价入股”等新模式,引导企业将高质量数据集折算为股权投入到相关企业。高质量数据集的发展需要数据标注产业的支撑,我们已布局了成都、沈阳、合肥等7个数据标注基地,助力高质量数据集的建设。
中文数据在国内大模型的训练性能提升方面发挥着重要作用。大家都非常关心中文数据在训练数据中的占比情况,经过一段时间的努力,国内多数模型训练使用的中文数据占比已经超过了60%,有的模型已达到80%。中文高质量数据的开发和供给能力持续增强,推动我国人工智能模型性能的快速提升。
下一步,国家数据局将通过体系化布局持续推进高质量数据集建设,加快打造具身智能、低空经济、生物制造等重点领域数据高地。我们也将推动全社会强化数据要素价值认同,加快推进数据要素价值共创,培育“为优质数据买单”的市场共识。
澎湃新闻记者 赵利新
(本文来自澎湃新闻,更多原创资讯请下载“澎湃新闻”APP)
相关文章
小米宣布扩展其超级小爱同学试点计划,将更多旧款旗舰设备纳入支持名单,这一举措体现了小米对现有用户群体的重视,并非仅将高级AI功能局限于最新机型。 此次...
2025-08-14 0
亲,这款游戏可以开挂的,确实是有挂的,很多玩家在这款游戏中打牌都会发现很多用户的牌特别好,总是好牌,而且好像能看到-人的牌一样。所以很多小伙伴就怀疑这...
2025-08-14 0
现在人们打棋牌麻将谁不想赢?手机微乐麻将必赢神器但是手机棋牌麻将是这么好赢的吗?在手机上打棋牌麻将想赢,不仅需要运气,也需要技巧。掌握的棋牌麻将技巧就...
2025-08-14 0
近日,泰安市第十七届自然科学优秀学术论文评选结果公布,宁阳县第一人民医院选送的学术论文中四篇论文荣登获奖名单!其中一等奖两篇,二等奖两篇。近日,泰安市...
2025-08-14 0
在智能家居时代,网警正通过技术防御、漏洞治理、全民联防与数据安全保护四大核心策略,全方位守护家庭网络安全。以下是具体措施与实践案例:️ 一、技术防御...
2025-08-14 0
8月10日至8月12日,两场量子科技尖峰论坛接踵而至。先是8月10日,粤港澳大湾区(广东)量子科学中心携手粤港澳大湾区量子科技与产业创新联盟联合举办“...
2025-08-14 0
来源:新华社客户端大赛不仅是“放大器”,更是“催化剂”——通过场景开放、资源聚合和生态协同,推动数据实现从资源到资产、资产到资本的跃迁。在2025年“...
2025-08-14 0
发表评论