天天微資訊！英特爾研究院發(fā)布全新AI擴散模型可根據(jù)文本提示生成360度全景圖

2023-06-22 18:52:54 來源：快科技

【資料圖】

LDM3D是業(yè)界領(lǐng)先的可創(chuàng)建深度圖的生成式AI模型，有望革新內(nèi)容創(chuàng)作、元宇宙和數(shù)字體驗

英特爾研究院宣布與Blockade Labs合作發(fā)布LDM3D（Latent Diffusion Model for 3D）模型，這一全新的擴散模型使用生成式AI創(chuàng)建3D視覺內(nèi)容。LDM3D是業(yè)界領(lǐng)先的利用擴散過程（diffusion process）生成深度圖（depth map）的模型，進而生成逼真的、沉浸式的360度全景圖。LDM3D有望革新內(nèi)容創(chuàng)作、元宇宙應(yīng)用和數(shù)字體驗，改變包括娛樂、游戲、建筑和設(shè)計在內(nèi)的許多行業(yè)。

英特爾研究院人工智能和機器學(xué)習(xí)研究專家Vasudev Lal表示：“生成式AI技術(shù)旨在提高和增強人類創(chuàng)造力，并節(jié)省時間。然而，目前的大部分生成式AI模型僅限于生成2D圖像，僅有少數(shù)幾種可根據(jù)文本提示生成3D圖像。在使用幾乎相同數(shù)量參數(shù)的情況下，不同于現(xiàn)存的潛在擴散模型，LDM3D可以根據(jù)用戶給定的文本提示同時生成圖像和深度圖。與深度估計中的標準后處理方法相比，LDM3D能夠為圖像中的每個像素提供更精準的相對深度，并為開發(fā)者省去了大量用于場景開發(fā)的時間?！?/p>

封閉的生態(tài)系統(tǒng)限制了規(guī)模。英特爾致力于推動AI的真正普及，通過開放的生態(tài)系統(tǒng)讓更多人從這項技術(shù)中受益。計算機視覺領(lǐng)域近年來取得了重大進展，特別是在生成式AI方面。然而，當(dāng)今許多先進的生成式AI模型只能生成2D圖像。與通常只能根據(jù)文本提示生成2D RGB圖像的現(xiàn)有擴散模型不同，LDM3D可以根據(jù)用戶給定的文本提示同時生成圖像和深度圖。與深度估計（depth estimation）中的標準后處理（post-processing）方法相比，LDM3D在使用與潛在擴散模型Stable Diffusion幾乎相同數(shù)量參數(shù)的情況下，能夠為圖像中的每個像素提供更精準的相對深度（relative depth）。

關(guān)鍵詞：

天天微資訊！英特爾研究院發(fā)布全新AI擴散模型 可根據(jù)文本提示生成360度全景圖

天天微資訊！英特爾研究院發(fā)布全新AI擴散模型可根據(jù)文本提示生成360度全景圖