首頁(yè) 要聞 中國(guó) 經(jīng)濟(jì) 財(cái)經(jīng) 品牌 點(diǎn)評(píng) 會(huì)展 綜合 | 設(shè)為首頁(yè)
中國(guó)品牌要聞網(wǎng)-傳遞資訊的價(jià)值打造品牌的影響
您現(xiàn)在的位置:首頁(yè)/熱搜排行/ 正文
英特爾研究院發(fā)布全新擴(kuò)散模型LDM3D,使用生成式AI創(chuàng)建360度全景圖
來(lái)源:
編輯:
時(shí)間:2023-06-23

英特爾研究院宣布與Blockade Labs合作發(fā)布LDM3D(Latent Diffusion Model for 3D)模型,這一全新的擴(kuò)散模型使用生成式AI創(chuàng)建3D視覺(jué)內(nèi)容。LDM3D是業(yè)界領(lǐng)先的利用擴(kuò)散過(guò)程(diffusion process)生成深度圖(depth map)的模型,進(jìn)而生成逼真的、沉浸式的360度全景圖。LDM3D有望革新內(nèi)容創(chuàng)作、元宇宙應(yīng)用和數(shù)字體驗(yàn),改變包括娛樂(lè)、游戲、建筑和設(shè)計(jì)在內(nèi)的許多行業(yè)。

英特爾研究院人工智能和機(jī)器學(xué)習(xí)研究專(zhuān)家Vasudev Lal表示:“生成式AI技術(shù)旨在提高和增強(qiáng)人類(lèi)創(chuàng)造力,并節(jié)省時(shí)間。然而,目前的大部分生成式AI模型僅限于生成2D圖像,僅有少數(shù)幾種可根據(jù)文本提示生成3D圖像。在使用幾乎相同數(shù)量參數(shù)的情況下,不同于現(xiàn)存的潛在擴(kuò)散模型,LDM3D可以根據(jù)用戶給定的文本提示同時(shí)生成圖像和深度圖。與深度估計(jì)中的標(biāo)準(zhǔn)后處理方法相比,LDM3D能夠?yàn)閳D像中的每個(gè)像素提供更精準(zhǔn)的相對(duì)深度,并為開(kāi)發(fā)者省去了大量用于場(chǎng)景開(kāi)發(fā)的時(shí)間。”

封閉的生態(tài)系統(tǒng)限制了規(guī)模。英特爾致力于推動(dòng)AI的真正普及,通過(guò)開(kāi)放的生態(tài)系統(tǒng)讓更多人從這項(xiàng)技術(shù)中受益。計(jì)算機(jī)視覺(jué)領(lǐng)域近年來(lái)取得了重大進(jìn)展,特別是在生成式AI方面。然而,當(dāng)今許多先進(jìn)的生成式AI模型只能生成2D圖像。與通常只能根據(jù)文本提示生成2D RGB圖像的現(xiàn)有擴(kuò)散模型不同,LDM3D可以根據(jù)用戶給定的文本提示同時(shí)生成圖像和深度圖。與深度估計(jì)(depth estimation)中的標(biāo)準(zhǔn)后處理(post-processing)方法相比,LDM3D在使用與潛在擴(kuò)散模型Stable Diffusion幾乎相同數(shù)量參數(shù)的情況下,能夠?yàn)閳D像中的每個(gè)像素提供更精準(zhǔn)的相對(duì)深度(relative depth)。

免責(zé)聲明:本文僅代表作者個(gè)人觀點(diǎn),與本網(wǎng)無(wú)關(guān)。其原創(chuàng)性以及文中陳述文字和內(nèi)容未經(jīng)本站證實(shí), 對(duì)本文以及其中全部或者部分內(nèi)容、文字的真實(shí)性、完整性、及時(shí)性本站不作任何保證或承諾, 請(qǐng)讀者僅作參考,并請(qǐng)自行核實(shí)相關(guān)內(nèi)容。當(dāng)事人(單位)如有異議,請(qǐng)參閱《刪帖說(shuō)明》辦理。
中國(guó)品牌要聞網(wǎng)-傳遞資訊的價(jià)值打造品牌的影響
編輯:綜合整理
2024-08-19
評(píng)論(0)
  • CopyRight@ 2005-2022 中國(guó)品牌要聞網(wǎng)
  • 工商注冊(cè)號(hào) 430122000189097
  • ICP備案許證:渝ICP備2022012785號(hào)