91国高清视频,国产精品午夜视频,欧美黑人粗暴多交高潮水最多,99久久精品一区二区三区,毛片不卡免费看,av日韩中文字幕,久久黄色成人

知識

國內(nèi)多數(shù)AI模型訓練使用的中文數(shù)據(jù)占比已超60% — 新京報

時間:2010-12-5 17:23:32  作者:娛樂   來源:娛樂  查看:  評論:0
內(nèi)容摘要:據(jù)新華社消息,中文數(shù)據(jù)在國內(nèi)AI大模型的訓練性能提升方面發(fā)揮著重要作用。國家數(shù)據(jù)局近日發(fā)布的數(shù)據(jù)顯示,目前國內(nèi)多數(shù)AI模型訓練使用的中文數(shù)據(jù)占比已經(jīng)超過60%,有的模型達到80%。中文高質(zhì)量數(shù)據(jù)的開發(fā)

據(jù)新華社消息,國內(nèi)中文數(shù)據(jù)在國內(nèi)AI大模型的多數(shù)的中訓練性能提升方面發(fā)揮著重要作用。國家數(shù)據(jù)局近日發(fā)布的模型數(shù)據(jù)顯示,目前國內(nèi)多數(shù)AI模型訓練使用的訓練中文數(shù)據(jù)占比已經(jīng)超過60%,有的使用模型達到80%。中文高質(zhì)量數(shù)據(jù)的文數(shù)開發(fā)和供給能力持續(xù)增強,推動我國人工智能模型性能快速提升。據(jù)占京報


國家數(shù)據(jù)局局長劉烈宏表示,比已我國人工智能的超新快速發(fā)展,與我國高度重視數(shù)據(jù)工作是國內(nèi)密不可分的。作為人工智能發(fā)展的多數(shù)的中核心要素之一,數(shù)據(jù)在推動“人工智能+”過程中發(fā)揮著關鍵作用,模型高質(zhì)量數(shù)據(jù)集的訓練建設至關重要。


“在人工智能時代,使用Token,文數(shù)也就是大家通常所說的詞元,是處理文本的最小數(shù)據(jù)單元,如同互聯(lián)網(wǎng)時代大家所說的‘流量’。”劉烈宏介紹,2024年初,我國日均Token的消耗量為1000億,到今年6月底,日均Token消耗量已經(jīng)突破30萬億,一年半時間增長了300多倍,反映了我國人工智能應用規(guī)模的快速增長。


據(jù)介紹,截至今年6月底,我國已經(jīng)建設高質(zhì)量數(shù)據(jù)集超過3.5萬個,總體量超過了400PB(1PB可存儲約5億張2MB大小的高清照片),400PB的總量相當于中國國家圖書館數(shù)字資源總量的140倍左右。


人工智能模型的訓練也推動了數(shù)據(jù)交易需求的攀升。截至今年6月底,各地高質(zhì)量數(shù)據(jù)集累計交易額近40億元,數(shù)據(jù)交易機構掛牌的高質(zhì)量數(shù)據(jù)集總規(guī)模達到了246PB。


下一步,國家數(shù)據(jù)局將通過體系化布局持續(xù)推進高質(zhì)量數(shù)據(jù)集建設,加快打造具身智能、低空經(jīng)濟、生物制造等重點領域數(shù)據(jù)高地,推動全社會強化數(shù)據(jù)要素價值認同,加快推進數(shù)據(jù)要素價值共創(chuàng),培育“為優(yōu)質(zhì)數(shù)據(jù)買單”的市場共識。


編輯 劉佳妮

來源:新華社
copyright © 2025 powered by 素昧平生網(wǎng)   sitemap