久久久国产精品视频_国产成人精品日本亚洲专_日本午夜大片免费观看视频_97av麻豆蜜桃一区二区

首頁 > 生活分享 > 免費教學 > 世界級成果亮相智源大會,北京人工智能數(shù)據(jù)運營平臺發(fā)布

世界級成果亮相智源大會,北京人工智能數(shù)據(jù)運營平臺發(fā)布

發(fā)布時間:2024-06-15 16:28:57來源: 15210273549

數(shù)據(jù)量超過700萬億字節(jié)的通用數(shù)據(jù)集和4.33萬億字節(jié)的行業(yè)數(shù)據(jù)集,在同一個平臺匯聚。6月14日,北京人工智能數(shù)據(jù)運營平臺在2024北京智源大會上發(fā)布,“行業(yè)數(shù)據(jù)集-場景應用創(chuàng)新計劃”也同步啟動。北京智源人工智能研究院理事長、北京大學教授黃鐵軍表示,構(gòu)建大模型生態(tài)首先要建立數(shù)據(jù)流通機制,推動從數(shù)據(jù)到智能的正反饋。

匯聚數(shù)據(jù)超700 萬億字節(jié)

“如果沒有開源數(shù)據(jù)集,很難想象過去十幾年,人工智能怎樣才能實現(xiàn)如此快速的迭代。然而,這些數(shù)據(jù)集還遠遠不夠。”智源研究院副院長兼總工程師林詠華坦言,特別是中文互聯(lián)網(wǎng)的數(shù)據(jù)量相差甚遠,“數(shù)據(jù)孤島”問題也較為嚴重。

本次發(fā)布的北京人工智能數(shù)據(jù)運營平臺,匯聚了大量通用數(shù)據(jù)、行業(yè)數(shù)據(jù),支持文本、圖像、視頻等多種模態(tài),并打造了全流程的數(shù)據(jù)處理工具。超過700萬億字節(jié)的通用數(shù)據(jù)集可以開展通用模型訓練,同時,4.33萬億字節(jié)的行業(yè)垂類數(shù)據(jù)對模型訓練也極為重要。


當前已知的全球開源行業(yè)文本類數(shù)據(jù)集總量僅約1.2萬億字節(jié)。“這次開源的行業(yè)數(shù)據(jù)集,幾乎每一項都遠超全球已經(jīng)開源的該行業(yè)數(shù)據(jù)集總和,是全球最大的多行業(yè)中英雙語數(shù)據(jù)集。”林詠華說,目前數(shù)據(jù)集包含醫(yī)療、教育、法律、新聞等18類行業(yè)數(shù)據(jù),未來將進一步擴展到30類左右。

針對不同數(shù)據(jù)特點,平臺明確了3種數(shù)據(jù)使用方式。一批公開領(lǐng)域采集的數(shù)據(jù)集將開源開放,用戶可以免費下載;有意向互換高質(zhì)量數(shù)據(jù)集的主體,可以參與構(gòu)建數(shù)據(jù)池,合作共建、共享數(shù)據(jù)集;高價值數(shù)據(jù)集則通過數(shù)算一體模式,確保模型在加工、訓練過程中,數(shù)據(jù)不出安全域,保障數(shù)據(jù)安全。

挑戰(zhàn)多模態(tài)模型新路線

“智源研究院在2021年就發(fā)布了悟道1.0和2.0大模型,當年創(chuàng)造了‘中國首個’‘全球最大’等一系列紀錄。可以說,智源與大模型有著緊密的關(guān)聯(lián)。”智源研究院院長王仲遠表示,隨著大模型的發(fā)展,人工智能逐步進入通用人工智能時代,該院目前正在訓練的原生多模態(tài)世界模型Emu3,再次瞄準了行業(yè)內(nèi)最有挑戰(zhàn)性的一條技術(shù)路線。

當前,文生圖、圖生文、文生視頻等模型都有各自對應的架構(gòu)和方法,很難兼容不同任務。例如文生視頻模型Sora,就無法做到對圖像和視頻的理解。“Emu3從設計之初就瞄準了多模態(tài)融合,其生成和理解能力也得到統(tǒng)一,還具備更多模態(tài)的可擴展性。”王仲遠說,基于智源研究院自研的多模態(tài)自回歸技術(shù)路徑,圖像、視頻、文字等模態(tài)可以進行聯(lián)合訓練。

這一模式,讓該模型不僅能閱讀文字,還擁有“讀圖”“看視頻”的能力。上傳一段視頻,模型能快速識別出,視頻內(nèi)的男人給人以幸福、興奮的感覺。“如果這條路線實現(xiàn)突破,又將是對人工智能產(chǎn)業(yè)的一次重大技術(shù)貢獻。”王仲遠說,目前,該模型已具備生成高質(zhì)量圖片和視頻、續(xù)寫視頻、理解物理世界等多模態(tài)能力,但中間還存在不盡完美之處。待持續(xù)訓練并經(jīng)過安全評估后,Emu3將逐步開源。

世界級研究成果接連產(chǎn)出

具身智能技術(shù)的發(fā)展,推動人工智能從數(shù)字世界走入物理世界。在大會展廳中,經(jīng)過通用抓取模型訓練,機器人對任意形狀、反光透明等物體都能有效抓取,在工業(yè)級真機上實現(xiàn)超過95%的抓取成功率,實現(xiàn)全球領(lǐng)先的商業(yè)級動作執(zhí)行水平。機器人還擁有對開放指令的思考能力,當測試人員提出“我餓了”,機器人在桌面擺放的10多種物品中,發(fā)現(xiàn)了可以食用的橘子和香蕉。“橘子和香蕉您要哪個?”機器人追問。得到需要橘子的答案后,它抓起橘子放入筐里。


機械臂搭載探頭在被檢測者的胸部往復移動,心臟跳動的畫面就在床旁的顯示屏上呈現(xiàn)出來。王仲遠介紹,智源研究院與清華大學、301醫(yī)院合作研發(fā)的全球首創(chuàng)智能心臟超聲機器人,能在高速動態(tài)環(huán)境下快速計算提取心臟特征。臨床驗證結(jié)果顯示,它檢測的準確性、高效性與人類醫(yī)生基本持平,但穩(wěn)定性和舒適性顯著高于人類醫(yī)生,對提升超聲醫(yī)療的普及度有重要意義。

全球首個低碳單體稠密萬億語言模型推出,全球首個實時孿生心臟計算模型構(gòu)建,全原子生物分子模型達世界領(lǐng)先……王仲遠介紹,過去的1年里,智源研究院在多模態(tài)大模型、具身大模型和生物計算大模型等方向發(fā)力,已取得了多個世界級成果。未來幾年內(nèi),該院還將圍繞這些方向持續(xù)研發(fā)。

免費教學更多>>

蔚來:搭載Banyan智能系統(tǒng)的車型4月初率先開啟世界模型領(lǐng)航 埃安:將推行業(yè)首個15萬元級“智駕險”方案 友商看過來!廣汽喊你組隊刷L3副本,智駕舞臺還空得很 強強聯(lián)手,廣汽與華為聯(lián)手打造華望汽車能否改變汽車行業(yè)格局? 廣汽埃安借網(wǎng)約車賽道,成為搶跑L4私人出行領(lǐng)域的最強智駕品牌。#埃安智駕能用、好用、放心用 15億落子南沙,廣汽攜手華為開啟高端局 水滴美學遇見悅彰音質(zhì),華為FreeBuds 6帶來半開放耳機體驗升級 靜音機械鍵盤!新盟M87Pro快速開箱 Hansker推出垂直游戲鼠標:原相3395傳感器,51° 人體工學傾斜 電腦CPU處理器該怎么選擇,i5、i7和i9對比,值得收藏 DLSS 4加成炫酷潮流,青春色彩不設限!索泰GeForce RTX 5070 Ti 16GB XGAMING OC顯卡 芝奇宣布首發(fā)DDR5-6000 CL26 48GB×2大容量低延遲高性能內(nèi)存條 國韻經(jīng)典,穩(wěn)如磐石,神凝系列DDR5內(nèi)存評測 科睿 X41 深度體驗:200HZ HDR400電競屏的「六邊形戰(zhàn)士」 京東攜手HKC、SANC顯示器走進全國高校 買顯示器享雙重補貼 迷你主機新風尚 磐鐳WI-6好價特惠 古都文旅煥新顏!蘇州金龍新V系客車助力陜西宇諾旅汽提質(zhì)升級 全新速騰申報圖曝光!外形像新老凌渡“結(jié)合體”,還能繼續(xù)大賣? 高階智駕規(guī)模化突圍 | 奇瑞汽車智能駕駛布局 武漢東湖高新區(qū):中國光谷——創(chuàng)新高地構(gòu)筑機器人產(chǎn)業(yè)未來藍圖 3月第二周銷量榜:比亞迪再破6萬輛,理想再超小鵬,零跑大漲重回前三 春招AI搶人大戰(zhàn):應屆生年薪130萬,實習月薪2萬 小米集團:技術(shù)賦能高端突破 AI將扮演重要角色 AI小白入門指南:解鎖數(shù)據(jù)、算力、算法的奧秘 “Let\'s 北京”京春美食季活動啟動 抖音超3000個商家上新春日美食 2024年京東直播訂單量增速行業(yè)第一 京東現(xiàn)身華為新品感受未來購物的便捷體驗! 攜手阿里巴巴,智己汽車行業(yè)首發(fā)IM AIOS生態(tài)座艙 淘寶新勢力周今晚8點開賣 房價飆升20%?北上廣深房價走勢分析