“大語言模型為 AI 產業帶來新的生機,然而語言模型的應用場景有限。要全面打開生成式 AI 的想象力,還是要依托多模態大模型?!?a target="_blank">IDC 中國研究總監盧言霞近日表示。Sora在文生視頻領域真正邁出了第一步,真正做到生成式 AI 驅動生成短視頻。接下來也將刺激其他科技巨頭加快在該領域的技術攻關力度以及產品發布速度。
哪些公司有潛力快速推出類似產品呢?根據盧言霞的判斷,幾個最有潛力的群體包括,在大模型以及 AI 領域投入最為領先的科技巨頭,如 BAT、科大訊飛等;在計算機視覺領域擁有深厚積累的公司,比如商湯、??狄活惖墓?;以及短視頻類公司;更可大膽想象,也或許會培訓出多模態大模型的全新創企。
多模態大模型將率先在短視頻、廣告、互娛、影視、媒體等領域采用,輔助人類員工生成視頻,既可以提高生產速度又可以提高生產數量,還可以創造全新的視覺感受,能夠幫助企業真正實現降本增效、提升用戶體驗。
根據預測,未來 5 年,生成式 AI 生成的文本類文件、圖像類文件、視頻類文件、軟件代碼類文件數量將會越來越平均。而這其中,與圖像文件相關的數據量可能是文本文件的 100 倍,視頻文件是圖像文件的 10 倍。整體來看,由于 GenAI 的采用和使用日益增多,近期和遠期所創建數據的增長速度都將快于近幾年。
盧言霞指出,多模態大模型行業發展的挑戰在于:
? 高質量數據的稀缺:圖像、視頻類數據掌握在少數公司手中。這些數據也需要標注,甚至重新采集,才能用于大模型的訓練。
? 多模態大模型對算力的消耗更高,算力的可獲取性以及成本將是挑戰之一。
? 頂尖的大模型研發人才,也是行業發展的稀缺資源。
此外,多模態大模型將帶來更嚴峻的安全方面的挑戰。一方面多模態大模型將讀取更多的圖像、視頻類數據,這些圖像視頻數據是否合規是否安全,需要得到保障;另一方面,生成的視頻與真實世界之間的差異,是否會影響到人身安全、社會穩定、企業安全等,也需要注意。
當前 Sora 生成的是1分鐘的視頻,對于行業已經是重大突破,何時能生成2分鐘、5分鐘以上的視頻還未知,無論如何多模態大模型的應用都將是顛覆性的。
聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。
舉報投訴
相關推薦
OpenAI加入文生視頻大模型的戰局,AI大模型進入視頻生成的階段,這將進一步刺激AI芯片的需求。 OpenAI發布文生視頻大模型Sora,
發表于 03-28 18:13
?558次閱讀
Sora短期不會向公眾開放 還處于反饋獲取階段 據外媒報道Sora核心團隊在一次采訪中透露,Sora短期不會向公眾開放,Sora大
發表于 03-14 14:55
?393次閱讀
湯姆貓在互動平臺上透露,公司正在積極推進申請接入OpenAI的Sora模型,并計劃進行相關素材制作的測試。目前,湯姆貓尚未正式接入Sora模型。
發表于 03-05 10:20
?392次閱讀
Sora,美國人工智能研究公司OpenAI發布的人工智能文生視頻大模型(但OpenAI并未單純將其視為視頻模型,而是作為“世界模擬器” ),于2024年2月15日(美國當地時間)正式對外發布
發表于 02-22 17:05
?686次閱讀
時其估值約為290億美元),且文生視頻大模型將會大幅推動人工智能基礎設施的需求,英偉達、OpenAI、軟銀等巨頭公司都被曝正在進行AI芯片的制造布局,英偉達也因大模型訓練需要GPU算力支持而股價大漲 。與此同時,受Sora發布的
發表于 02-22 17:00
?1244次閱讀
Sora,美國人工智能研究公司OpenAI發布的人工智能文生視頻大模型(但OpenAI并未單純將其視為視頻模型,而是作為“世界模擬器” ,于2024年2月15日(美國當地時間)正式對外發布
發表于 02-22 16:52
?1906次閱讀
sora模型的上市公司目前沒有相關官方的報道,因此無法給出準確的回答。 Sora能夠獲取現有視頻并對其進行擴展或填充缺失的幀,這一功能在視頻編輯、電影特效等領域具有應用前景,可以幫助用戶快速完成視頻
發表于 02-22 16:46
?585次閱讀
美國當地時間2024年2月15日 ,OpenAI正式發布文生視頻模型Sora ,并發布了48個文生視頻案例和技術報告 ,正式入局視頻生成領域 。Sora能夠根據提示詞生成60s的連貫視頻,“碾壓
發表于 02-22 16:42
?701次閱讀
Sora是一種擴散模型,具備從噪聲中生成完整視頻的能力,它生成的視頻一開始看起來像靜態噪音,通過多個步驟逐漸去除噪聲后,視頻也從最初的隨機像素轉化為清晰的圖像場景,其能夠一次生成多幀預測,確保畫面
發表于 02-21 17:20
?1590次閱讀
奧特曼發布王炸模型Sora OpenAI首個文生視頻模型Sora正式亮相 2月16日凌晨OpenAI的首個文生視頻模型
發表于 02-18 17:41
?614次閱讀
全球人工智能領域的佼佼者OpenAI近日發布了一款名為Sora的短視頻生成模型,該模型能夠根據文字指令即時生成高質量短視頻,引起了業界的廣泛關注。
發表于 02-18 10:16
?750次閱讀
奧特曼,作為科技界的先驅者,近日攜手OpenAI發布了其首個視頻生成模型——Sora。這一創新模型完美繼承了DALL·E 3的卓越畫質和強大指令遵循能力,能夠生成長達一分鐘的高清視頻。
發表于 02-18 10:06
?679次閱讀
不同于單模態模型編輯,多模態模型編輯需要考慮更多的模態信息。文章出發點依然從單模態
發表于 11-09 14:53
?287次閱讀
隨著 GPT-4 和 Stable Diffusion 等模型多模態能力的突飛猛進,多模態大模型已經成為大模型邁向通用人工智能(AGI)目標
發表于 07-10 10:05
?489次閱讀
AI大模型可分為自然語言處理大模型,CV大模型、科學計算大模型等。AI大模型支持的模態更加多樣,
發表于 07-06 12:31
?1629次閱讀
評論