英特爾研究院發(fā)布全新AI擴散模型
LDM3D是業(yè)界領先的可創(chuàng)建深度圖的生成式AI模型,有望革新內(nèi)容創(chuàng)作、元宇宙和數(shù)字體驗。
本文引用地址:http://www.eepw.com.cn/article/202306/447894.htm英特爾研究院宣布與Blockade Labs合作發(fā)布LDM3D(Latent Diffusion Model for 3D)模型,這一全新的擴散模型使用生成式AI創(chuàng)建3D視覺內(nèi)容。LDM3D是業(yè)界領先的利用擴散過程(diffusion process)生成深度圖(depth map)的模型,進而生成逼真的、沉浸式的360度全景圖。LDM3D有望革新內(nèi)容創(chuàng)作、元宇宙應用和數(shù)字體驗,改變包括娛樂、游戲、建筑和設計在內(nèi)的許多行業(yè)。
(資料圖片)
英特爾研究院人工智能和機器學習研究專家Vasudev Lal表示:“生成式AI技術旨在提高和增強人類創(chuàng)造力,并節(jié)省時間。然而,目前的大部分生成式AI模型僅限于生成2D圖像,僅有少數(shù)幾種可根據(jù)文本提示生成3D圖像。在使用幾乎相同數(shù)量參數(shù)的情況下,不同于現(xiàn)存的潛在擴散模型,LDM3D可以根據(jù)用戶給定的文本提示同時生成圖像和深度圖。與深度估計中的標準后處理方法相比,LDM3D能夠為圖像中的每個像素提供更精準的相對深度,并為開發(fā)者省去了大量用于場景開發(fā)的時間。”
封閉的生態(tài)系統(tǒng)限制了規(guī)模。英特爾致力于推動AI的真正普及,通過開放的生態(tài)系統(tǒng)讓更多人從這項技術中受益。計算機視覺領域近年來取得了重大進展,特別是在生成式AI方面。然而,當今許多先進的生成式AI模型只能生成2D圖像。與通常只能根據(jù)文本提示生成2D RGB圖像的現(xiàn)有擴散模型不同,LDM3D可以根據(jù)用戶給定的文本提示同時生成圖像和深度圖。與深度估計(depth estimation)中的標準后處理(post-processing)方法相比,LDM3D在使用與潛在擴散模型Stable Diffusion幾乎相同數(shù)量參數(shù)的情況下,能夠為圖像中的每個像素提供更精準的相對深度(relative depth)。
這項研究有望改變我們與數(shù)字內(nèi)容的互動方式,基于文本提示為用戶提供全新的體驗。LDM3D生成的圖像和深度圖能夠?qū)⒅T如寧靜的熱帶海灘、摩天大樓、科幻宇宙等文本描述轉(zhuǎn)化為細致的360度全景圖。LDM3D捕捉深度信息的能力,可以即時增強整體真實感和沉浸感,使各行各業(yè)的創(chuàng)新應用成為可能,包括娛樂、游戲、室內(nèi)設計、房產(chǎn)銷售 ,以及虛擬博物館與沉浸式VR體驗等。
6月20日,在IEEE/CVF計算機視覺和模式識別會議(CVPR)的3DMV工作坊上,LDM3D模型獲得了“Best Poster Award”。
LDM3D是在LAION-400M數(shù)據(jù)集包含一萬個樣本的子集上訓練而成的。LAION-400M是一個大型圖文數(shù)據(jù)集,包含超過4億個圖文對。對訓練語料庫進行標注時,研究團隊使用了之前由英特爾研究院開發(fā)的稠密深度估計模型DPT-Large,為圖像中的每個像素提供了高度準確的相對深度。LAION-400M數(shù)據(jù)集是基于研究用途創(chuàng)建而成的,以便廣大研究人員和其它興趣社群能在更大規(guī)模上測試模型訓練。
LDM3D模型在一臺英特爾AI超級計算機上完成了訓練,該超級計算機由英特爾?至強?處理器和英特爾?Habana Gaudi? AI加速器驅(qū)動。最終的模型和流程整合了RGB圖像和深度圖,生成360度全景圖,實現(xiàn)了沉浸式體驗。
為了展示LDM3D的潛力,英特爾和Blockade的研究人員開發(fā)了應用程序DepthFusion,通過標準的2D RGB圖像和深度圖創(chuàng)建沉浸式、交互式的360度全景體驗。DepthFusion利用了TouchDesigner,一種基于節(jié)點的可視化編程語言,用于實時互動多媒體內(nèi)容,可將文本提示轉(zhuǎn)化為交互式和沉浸式數(shù)字體驗。LDM3D是能生成RGB圖像及其深度圖的單一模型,因此能夠節(jié)省內(nèi)存占用和降低延遲。
LDM3D和DepthFusion的發(fā)布,為多視角生成式AI和計算機視覺的進一步發(fā)展鋪平了道路。英特爾將繼續(xù)探索如何使用生成式AI增強人類能力,并致力于打造一個強大的開源AI研發(fā)生態(tài)系統(tǒng),讓更多人能夠使用AI技術。延續(xù)英特爾對開放AI生態(tài)系統(tǒng)的大力支持,LDM3D正在通過HuggingFace進行開源,讓AI研究人員和從業(yè)者能對這一系統(tǒng)作出進一步改進,并針對特定應用進行微調(diào)。
在2023年6月18日至22日舉行的IEEE/CVF計算機視覺和模式識別會議上,英特爾將發(fā)表這項研究成果。欲了解更多信息,請參考論文《LDM3D: Latent Diffusion Model for 3D》。
關鍵詞:
您可能也感興趣:
為您推薦
焦點資訊:行業(yè)唯一!美菱如手洗洗衣機榮獲母嬰級認證
世界最新:端午假期遼寧實現(xiàn)旅游綜合收入51.17億元 同比增長182.7%
全球視點!附近長途汽車站在哪里
排行
最近更新
- 英特爾研究院發(fā)布全新AI擴散模型
- 外媒:華盛頓計劃強制使用特斯拉充電方案
- 【世界熱聞】刑法過失損壞電力設備案件的解釋規(guī)定有哪些
- 泰安市住房公積金中心發(fā)布暫停線上渠道服務的通知_實時
- 全球滾動:四川省教育考試院:錄取“數(shù)據(jù)”如何用?這幾種方法...
- 19戶整改37戶騰退住房!渭南這里開展保障房清查整治!
- 環(huán)球短訊!濰煙線大季家站旅客天橋順利吊裝完成
- 全球新資訊:2023年湖北省高考分數(shù)線發(fā)布!
- 大學生就業(yè)“最滿意”排行,60個專業(yè)上榜!
- 安逸花逾期上門短信是真的嗎?還不上會怎么樣?
- 適老服務、家庭保障、誠信理賠 太平人壽多項服務案例入選“2...
- 前線探營HLE.Viper:我一直在看UZI的比賽,我想看他贏下比賽...
- 數(shù)據(jù)里程碑:Meiko距離8000助攻成就僅差26助攻|環(huán)球速讀
- 焦點速訊:新聞8點見丨北京高考分數(shù)線公布;瓦格納的24小時“...
- 上海:“小巨人”企業(yè)在重點發(fā)展行業(yè)中發(fā)揮關鍵性作用 世界實時
- 天天新消息丨雷克薩斯ES怎么樣及斯巴魯新XV多少錢
- 全球新消息丨6月25日河南地區(qū)氫氟酸市場價格暫穩(wěn)
- 世界快消息!亞太實業(yè):未能在最后寬限期內(nèi)支付剩余的股權轉(zhuǎn)讓款
- 當前頭條:農(nóng)林牧漁行業(yè)周報:節(jié)日消費提振豬價有限,高溫現(xiàn)...
- 觀眾齊喊“開空調(diào)”!知名歌手演唱會遭遇尷尬一幕…… 當前滾動
- 紋身英文句子帶翻譯(紋身英文句子加翻譯 百度)
- 文化|滿屏小可愛!繼“村BA”“村超”,貴州文物帶你“趣”運動
- 天天實時:世界熱門:名嘴建議勇士放棄克萊簽回追夢:庫里打SG...
- 川觀智庫丨溫鐵軍:國企如何參與鄉(xiāng)村振興? 當前關注
- 世界實時:氣象專家:厄爾尼諾將給我國帶來哪些影響?
- 全球熱議:內(nèi)蒙古紅山區(qū):“閃耀青春,無毒有我”禁毒宣傳進高校
- 以案提質(zhì),攢足“三勁”抓發(fā)展——懷化市交建投推進重點項目...
- 618實現(xiàn)高質(zhì)量增長,榮耀是如何做到的? 環(huán)球即時
- 當前快播:淥口區(qū)人工增殖放流400萬尾魚苗進入湘江
- 一百多位姐姐被拒,乘風的門檻并不低,溫碧霞、葉全真也在其中
今日要聞
- 2023年青海高考什么時候填報志愿_青海高考志愿填報時間表
- 618實現(xiàn)高質(zhì)量增長,榮耀是如何做到的? 環(huán)球即時
- 宣城市機電學校開展研學活動拓展實踐教學
- 文化|滿屏小可愛!繼“村BA”“村超”,貴州文物帶你“趣”運動
- 南縣中魚口鎮(zhèn)積極開展夏季防溺水巡查工作
- 高培勇:宏觀政策要堅持“擠牙膏式”擴張,穩(wěn)預期得靠改革|世界速讀
- 金鏟鏟之戰(zhàn)s9六艾歐卡莎怎么玩(s9六艾歐卡莎陣容玩法攻略)[多圖] 精彩看點
- 天天觀熱點:端午假期重點企業(yè)銷售超9億元!同比增長38.1%
- 全球觀速訊丨郴州市21路公交車不停靠不讓上車
- 英特爾研究院發(fā)布全新AI擴散模型