久久久国产精品视频_国产成人精品日本亚洲专_日本午夜大片免费观看视频_97av麻豆蜜桃一区二区

首頁 > 生活分享 > 免費教學(xué) > AI首次實時生成視頻!尤洋團(tuán)隊新作,網(wǎng)友:這是新紀(jì)元

AI首次實時生成視頻!尤洋團(tuán)隊新作,網(wǎng)友:這是新紀(jì)元

發(fā)布時間:2024-06-29 16:41:19來源: 15210273549

這是團(tuán)隊在Open-Sora上,使用5個4s(192幀)480p分辨率視頻進(jìn)行的測試。

新方法名為Pyramid Attention Broadcast(PAB),由新加坡國立大學(xué)尤洋以及3位學(xué)生推出。

 

具體來說,PAB通過減少冗余注意力計算,可實現(xiàn)高達(dá)21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質(zhì)量。

作為一種免訓(xùn)練方法,PAB可為將來任何基于DiT的視頻生成模型提供實時功能。

看完效果對比,網(wǎng)友們紛紛驚嘆:

這將是新紀(jì)元。

 

也引來了眾多專業(yè)人士的轉(zhuǎn)發(fā)和點評,如MIT博士Yilun Du表示:

是一個展示了如何將視頻生成加速到實時速度的酷炫工作!可能會為視頻策略和模擬的現(xiàn)實世界用例開辟新的領(lǐng)域。

 

那么,新方法具體如何破解實時生成視頻這個難題的呢?

減少冗余注意力計算

一開始,團(tuán)隊比較了當(dāng)前擴(kuò)散步驟與前一步驟的注意力輸出差異

這些差異通過均方誤差(MSE)進(jìn)行量化,并對每個擴(kuò)散步驟的所有層進(jìn)行平均。

團(tuán)隊捕捉到兩個關(guān)鍵信息

  • 隨著時間推移,注意力差異遵循U形模式,中間70%差異較小
  • 注意力差異的排序為:空間>時間>交叉

 

具體而言,不同時間步驟的注意力差異呈現(xiàn)出U形模式,在第一步和最后一步的15%步驟中發(fā)生顯著變化,而中間70%的步驟非常穩(wěn)定,差異很小。

其次,在穩(wěn)定的中間部分,不同類型的注意力表現(xiàn)出差異:空間注意力變化最大,涉及高頻元素,如邊緣和紋理;時間注意力顯示出與視頻中的運動和動態(tài)相關(guān)的中頻變化;跨模態(tài)注意力最為穩(wěn)定,它將文本與視頻內(nèi)容聯(lián)系起來,類似于反映文本語義的低頻信號。

對此,團(tuán)隊正式提出用PAB來減少不必要的注意力計算

 

PAB通過根據(jù)每種注意力的差異將注意力輸出到不同的后續(xù)步驟,從而節(jié)省計算量。

舉個例子,就像廣播電臺把一個信號發(fā)送給多個聽眾一樣,如果某個步驟的注意力結(jié)果在接下來的幾個步驟中仍然適用,就不需要重新計算,而是直接使用之前的結(jié)果。

團(tuán)隊發(fā)現(xiàn),即使沒有后期訓(xùn)練,這種簡單策略也能實現(xiàn)高達(dá)35%的加速,并且質(zhì)量損失可以忽略不計。

為了進(jìn)一步增強(qiáng)PAB,團(tuán)隊基于動態(tài)序列并行(DSP)改進(jìn)了序列并行。

 

序列并行通過在多個GPU上分割視頻以降低延遲,但DSP帶來的時間注意力需兩次全對全通信,導(dǎo)致高通信開銷。

而PAB由于時間注意力不再需要被計算,使這些通信開銷減少了50%以上,從而優(yōu)化了實時視頻生成的分布式推理效率。

借助并行功能,PAB可實現(xiàn)高達(dá)21.6FPS10.6倍加速,并且不會犧牲基于DiT的流行視頻生成模型(包括Open-Sora、Open-Sora-Plan和Latte)的質(zhì)量。

免費教學(xué)更多>>

謝浩男媽媽直播帶貨銷售額超1億,賬號一夜?jié)q粉50萬 直播界的“她”力量:為何女主播占據(jù)半壁江山? 深圳攜手全球電商平臺助力企業(yè)開拓新興市場 超3.8萬人次逛首店!京東MALL成都店開業(yè),30多個體驗區(qū)人氣旺 淘寶在海外爆火!中國電商如何接住“潑天流量”? 中國改名最成功的985大學(xué),錄取分?jǐn)?shù)不高,但考上就是“鐵飯碗” AI時代教育如何變革?上海首批 “標(biāo)準(zhǔn)化家長學(xué)校”出爐 二手房真的能買嗎?看完這3點再決定! 萬家麗建材+上海日立空調(diào)的新房舒適體驗 申城新房市場上新6個新樓盤,三分之二項目備案均價上揚 全國70城房價最新出爐 樓市小陽春顯現(xiàn) 所有手里有房的人要注意了! 房產(chǎn)交易量7年激增25000%!拉斯海馬樓市火爆,供不應(yīng)求 iPhone 17只是開胃菜!蘋果25年10款重磅新品曝光 第5款真要換代了 基本確定!iPhone 17 是近幾年來變化最大的iPhone,庫克開始放大招 電池健康80和100有什么區(qū)別?蘋果回應(yīng):低于80建議更換 曲面屏跌落神壇!華為小米vivo跟進(jìn)OPPO直屏戰(zhàn)略 vivo X200 Ultra 參數(shù)全解析:6大升級點+真實體驗,值不值6999? 3款價格“一落千丈”的旗艦手機(jī),拍照強(qiáng)信號好,還支持衛(wèi)星通信 消息稱三星下個月量產(chǎn)Galaxy Z Fold 7/Flip 7折疊手機(jī) 2025年7000元價位手機(jī)全維對比與選購指南 對比N個品牌后終于出手!TCL Q9L Pro憑實力完勝,后悔沒早換! 黑龍江干流張地營子鄉(xiāng)段、中興鎮(zhèn)段開江 從砸核桃神機(jī)到萬元機(jī)皇!諾基亞10款經(jīng)典機(jī)型,用過的請舉手! 紅米新機(jī)官宣:性能、續(xù)航大升級,下周發(fā)布 7月見!魅族22系列旗艦,定義“AI Device” 小米汽車SU7:年輕人第一輛跑車?真香警告! 小米米家雙循環(huán)燃?xì)鉄崴鱌10上市,國補價2549.2元起 首批搭載高通新神U!iQOO新機(jī)跑分曝光,接近驍龍8Gen3 華為手機(jī)跑分“翻車”真相:不是跑不動,是懶得跟你跑! 小米、OPPO、vivo三大小屏旗艦對比:4000元價位哪個是你的菜