北京人工智能數(shù)據(jù)運(yùn)營(yíng)平臺(tái)發(fā)布

北京日?qǐng)?bào)發(fā)布時(shí)間：2024-06-17 12:30:43

　　日前，北京人工智能數(shù)據(jù)運(yùn)營(yíng)平臺(tái)在2024北京智源大會(huì)上發(fā)布，“行業(yè)數(shù)據(jù)集—場(chǎng)景應(yīng)用創(chuàng)新計(jì)劃”同步啟動(dòng)。北京智源人工智能研究院理事長(zhǎng)、北京大學(xué)教授黃鐵軍表示，構(gòu)建大模型生態(tài)首先要建立數(shù)據(jù)流通機(jī)制，推動(dòng)從數(shù)據(jù)到智能的正反饋。

　　匯聚數(shù)據(jù)超700萬(wàn)億字節(jié)

　　“如果沒(méi)有開(kāi)源數(shù)據(jù)集，很難想象人工智能怎樣才能實(shí)現(xiàn)如此快速的迭代，然而，這些數(shù)據(jù)集還遠(yuǎn)遠(yuǎn)不夠。”智源研究院副院長(zhǎng)兼總工程師林詠華坦言，特別是中文互聯(lián)網(wǎng)的數(shù)據(jù)量相差甚遠(yuǎn)，數(shù)據(jù)孤島問(wèn)題也較為嚴(yán)重。

　　本次發(fā)布的北京人工智能數(shù)據(jù)運(yùn)營(yíng)平臺(tái)，匯聚了大量通用數(shù)據(jù)、行業(yè)數(shù)據(jù)，支持文本、圖像、視頻等多種模態(tài)，并打造了全流程的數(shù)據(jù)處理工具。超過(guò)700萬(wàn)億字節(jié)的通用數(shù)據(jù)集可以開(kāi)展通用模型訓(xùn)練，同時(shí)，4.33萬(wàn)億字節(jié)的行業(yè)垂類數(shù)據(jù)對(duì)模型訓(xùn)練也極為重要。

　　當(dāng)前已知的全球開(kāi)源行業(yè)文本類數(shù)據(jù)集總量?jī)H約1.2萬(wàn)億字節(jié)。“這次開(kāi)源的行業(yè)數(shù)據(jù)集，幾乎每一項(xiàng)都遠(yuǎn)超全球已經(jīng)開(kāi)源的該行業(yè)數(shù)據(jù)集總和，是全球最大的多行業(yè)中英雙語(yǔ)數(shù)據(jù)集。”林詠華說(shuō)，目前數(shù)據(jù)集包含醫(yī)療、教育、法律、新聞等18類行業(yè)數(shù)據(jù)，未來(lái)將進(jìn)一步擴(kuò)展到30類左右。

　　針對(duì)不同數(shù)據(jù)特點(diǎn)，平臺(tái)明確了3種數(shù)據(jù)使用方式。一批公開(kāi)領(lǐng)域采集的數(shù)據(jù)集將開(kāi)源開(kāi)放，用戶可以免費(fèi)下載;有意向互換高質(zhì)量數(shù)據(jù)集的主體，可以參與構(gòu)建數(shù)據(jù)池，合作共建、共享數(shù)據(jù)集;高價(jià)值數(shù)據(jù)集則通過(guò)數(shù)算一體模式，確保模型在加工、訓(xùn)練過(guò)程中，數(shù)據(jù)不出安全域，保障數(shù)據(jù)安全。

　　挑戰(zhàn)多模態(tài)模型新路線

　　“智源研究院在2021年就發(fā)布了悟道1.0和2.0大模型，當(dāng)年創(chuàng)造了‘中國(guó)首個(gè)’‘全球最大’等一系列紀(jì)錄?？梢哉f(shuō)，智源與大模型有著緊密的關(guān)聯(lián)。”智源研究院院長(zhǎng)王仲遠(yuǎn)表示，隨著大模型的發(fā)展，人工智能逐步進(jìn)入通用人工智能時(shí)代，該院目前正在訓(xùn)練的原生多模態(tài)世界模型Emu3，再次瞄準(zhǔn)了行業(yè)內(nèi)最有挑戰(zhàn)性的一條技術(shù)路線。

　　當(dāng)前，文生圖、圖生文、文生視頻等模型都有各自對(duì)應(yīng)的架構(gòu)和方法，很難兼容不同任務(wù)。例如文生視頻模型Sora，就無(wú)法做到對(duì)圖像和視頻的理解。“Emu3從設(shè)計(jì)之初就瞄準(zhǔn)了多模態(tài)融合，其生成和理解能力也得到統(tǒng)一，還具備更多模態(tài)的可擴(kuò)展性。”王仲遠(yuǎn)說(shuō)，基于智源研究院自研的多模態(tài)自回歸技術(shù)路徑，圖像、視頻、文字等模態(tài)可以進(jìn)行聯(lián)合訓(xùn)練。

　　這一模式，讓該模型不僅能閱讀文字，還擁有“讀圖”“看視頻”的能力。上傳一段視頻，模型能快速識(shí)別出視頻內(nèi)的人有幸福、興奮的感覺(jué)。“如果這條路線實(shí)現(xiàn)突破，又將是對(duì)人工智能產(chǎn)業(yè)的一次重大技術(shù)貢獻(xiàn)。”王仲遠(yuǎn)說(shuō)，目前，該模型已具備生成高質(zhì)量圖片和視頻、續(xù)寫視頻、理解物理世界等多模態(tài)能力，但中間還存在不盡完美之處。待持續(xù)訓(xùn)練并經(jīng)過(guò)安全評(píng)估后，Emu3將逐步開(kāi)源。

　　世界級(jí)研究成果接連產(chǎn)出

　　具身智能技術(shù)的發(fā)展，推動(dòng)人工智能從數(shù)字世界走入物理世界。在大會(huì)展廳中，經(jīng)過(guò)通用抓取模型訓(xùn)練，機(jī)器人對(duì)任意形狀、反光透明等物體都能有效抓取，在工業(yè)級(jí)真機(jī)上實(shí)現(xiàn)超過(guò)95%的抓取成功率，實(shí)現(xiàn)全球領(lǐng)先的商業(yè)級(jí)動(dòng)作執(zhí)行水平。機(jī)器人還擁有對(duì)開(kāi)放指令的思考能力，當(dāng)測(cè)試人員提出“我餓了”，機(jī)器人在桌面擺放的10多種物品中，發(fā)現(xiàn)了可以食用的橘子和香蕉。“橘子和香蕉您要哪個(gè)?”機(jī)器人追問(wèn)。得到需要橘子的答案后，它抓起橘子放入筐里。

　　機(jī)械臂搭載探頭在被檢測(cè)者的胸部往復(fù)移動(dòng)，心臟跳動(dòng)的畫(huà)面就在床旁的顯示屏上呈現(xiàn)出來(lái)。王仲遠(yuǎn)介紹，智源研究院與清華大學(xué)、301醫(yī)院合作研發(fā)的全球首創(chuàng)智能心臟超聲機(jī)器人，能在高速動(dòng)態(tài)環(huán)境下快速計(jì)算提取心臟特征。臨床驗(yàn)證結(jié)果顯示，它檢測(cè)的準(zhǔn)確性、高效性與人類醫(yī)生基本持平，但穩(wěn)定性和舒適性顯著高于人類醫(yī)生，對(duì)提升超聲醫(yī)療的普及度有重要意義。

　　全球首個(gè)低碳單體稠密萬(wàn)億語(yǔ)言模型推出，全球首個(gè)實(shí)時(shí)孿生心臟計(jì)算模型構(gòu)建，全原子生物分子模型達(dá)世界領(lǐng)先……王仲遠(yuǎn)介紹，過(guò)去的一年里，智源研究院在多模態(tài)大模型、具身大模型和生物計(jì)算大模型等方向發(fā)力，已取得了多個(gè)世界級(jí)成果。未來(lái)幾年內(nèi)，該院還將圍繞這些方向持續(xù)研發(fā)。

　　來(lái)源：北京日?qǐng)?bào)