截至6月底中国日均Token消耗量突破30万亿
创始人
2025-08-17 06:20:19
0

中新社北京8月14日电 (记者 刘亮)在人工智能时代,Token(即“词元”)作为处理文本的最小数据单元,如同互联网时代的“流量”。中国国家数据局局长刘烈宏14日在北京举行的新闻发布会上介绍,截至今年6月底,中国日均Token消耗量已突破30万亿。

8月14日,中国国务院新闻办公室在北京举行“高质量完成‘十四五’规划”系列主题新闻发布会,国家发展改革委党组成员、国家数据局局长刘烈宏,国家数据局副局长沈竹林,国家数据局副局长陈荣辉,国家数据局副局长夏冰介绍“十四五”时期数字中国建设发展成就,并答记者问。中新社记者 杨可佳 摄

国务院新闻办公室当天举行新闻发布会,介绍“十四五”时期数字中国建设发展成就。刘烈宏在会上表示,2024年初,中国日均Token的消耗量为1000亿,截至今年6月底,日均Token消耗量已突破30万亿,1年半时间增长了300多倍,这反映了中国人工智能应用规模快速增长。

他指出,人工智能快速发展,与中国高度重视数据工作密不可分。中国是第一个把数据作为生产要素的国家,多措并举促进数据资源的开发利用。中国强调“人工智能+”行动到哪里,高质量数据集的建设和推广就要到哪里。

近年来,中国大力推动高质量数据供给,出台高质量数据集建设相关文件,多部门联合推动相关工作。同时,持续推进高质量数据集建设工作。截至今年6月底,中国已建设高质量数据集超过3.5万个,总体量超400PB。据悉,1PB可存储约5亿张2MB大小的高清照片,400PB相当于中国国家图书馆数字资源总量的140倍左右。

人工智能模型的训练也推动数据交易需求攀升。刘烈宏介绍,截至今年6月底,中国各地高质量数据集累计交易额近40亿元人民币,数据交易机构挂牌的高质量数据集总规模达246PB。以北京数交所为例,高质量数据集占交易总量的比例从去年的10%跃升到目前的近80%。

中文数据在国内大模型的训练性能提升方面发挥着重要作用。刘烈宏说,中国多数模型训练使用的中文数据占比已超过60%,有的模型已达80%。中文高质量数据的开发和供给能力持续增强,推动中国人工智能模型性能快速提升。

来源:中国新闻网

相关内容

热门资讯

2025年值得入手的2款智能手... 在科技飞速发展的今天,智能手表已成为我们生活中不可或缺的伙伴。无论是健康监测、信息提醒,还是时尚搭配...
原创 苹... 有不少朋友疑惑苹果iPhone 16 Pro和16 Pro Max有什么区别?该选择哪一款更好?各自...
第五轮学科评估对比:西安交大突... 在之前的文章中,我们已经提及西安交通大学第五轮学科评估的表现可圈可点,新晋的3个A+学科:机械工程、...
原创 2... 从去年华为用上了麒麟芯片开始,华为的市场份额就蹭蹭的往上涨,当时抢购的人特别多,一时间还买不到现货,...
steam官网无法访问?这个办... 对于广大游戏爱好者而言,Steam平台无疑是获取最新游戏资讯、购买游戏、与全球玩家互动的重要阵地。然...
解决FaceTime无法使用的... FaceTime是苹果公司推出的一款视频通话应用,广泛应用于iPhone、iPad和Mac等设备上。...
vivo手机5g开关在哪里打开 vivo手机5G开关的打开方式可能因手机型号、系统版本及运营商网络支持情况的不同而有所差异。但总体来...
2024年OPPO手机全攻略:... 手机已不仅仅是通讯工具,它更是我们记录生活、享受娱乐、提升工作效率的重要伙伴。随着科技的飞速发展,O...
原创 最... 近日,有关华为nova 13系列手机的消息开始多了起来,之前透露的消息暴露,华为nova 13 Pr...
2024信号“最可靠”的四款手... 大家好!今天我要和大家聊聊2024年信号“最可靠”的四款手机,它们分别是华为Pura 70 Pro+...