衆所周知,聊天機器人ChatGPT的一夜爆紅,讓人工智能(AI)成為科技領域的“當紅頂流”。除了如今“霸屏”的類似ChatGPT的語言模型之外,AI領域還有大量其他技術:文本生成圖像正在成為一種主流的聊天形式,有望成為該領域下一個“大事件”。
Sora面世成頂流
獲悉,日前,繼去年發布的聊天機器人ChatGPT引領新一輪人工智能(AI)浪潮之後,美國人工智能公司OpenAI再出新動作,正式發布文生視頻模型Sora,表示其正在教授AI理解和模拟運動中的物理世界,目标是訓練模型幫助人們解決需要現實世界交互的問題。
從樣片來看,此次大模型在長視頻(60秒)中表現出令人驚歎的穩定性與前後一緻性。同時,在部分樣片中,Sora還展現了對“物理規律”超強的學習能力,無論是飄逸的毛發還是水體波紋,Sora都能“合乎常理”地呈現出來。
Sora一經面世,強大的逼真視頻生成能力,瞬間成為頂流,話題熱度隻增不減,全球諸多媒體都對其冠以“颠覆性”的美名。OpenAI在技術報告中透露,Sora能夠深刻地理解運動中的物理世界,堪稱為真正的「世界模型」。
業界專業人士預測,Sora它會增加文生視頻能力,提高生成視頻片段的質量,加速可應用性。就好比過去一年中,GPT-4 持續刺痛大模型的神經那樣,事實上,Sora 的出現對全球科技公司來說也是機會大于挑戰的——它會更快加速視頻生成類工具的成熟應用。
AI“文生視頻”改變未來
ChatGPT一年前已在自然語言交互領域取得重大突破,Sora則在AI視頻領域一舉登上行業。如果說,在過去的 2023 年,各大廠大模型均圍繞 GPT-4" 貼身肉搏 ";那麼可以預測,在 2024 年,文生視頻行業會集中火力趕超 Sora。
值得一提的是,就在Sora模型發布的當天,Meta(META.US)重磅推出一個全新的無監督「視頻預測模型」——V-JEPA。V-JEPA的研究表明,就可以一次性預訓練模型,不依賴任何标記數據,然後将模型用于多個不同的任務,如動作分類、細粒度物體交互識别和活動定位,開辟了全新的可能。Meta表示,V-JEPA是在「凍結評估」上表現出色的視頻模型。
微美全息入局AI視頻生成技術有望加速爆發
無獨有偶,公開資料顯示,AI概念上市公司微美全息(WIMI.US)長期以來推動科技與産業互促雙強,推進高水平科技發展,同時發展新質生産力,塑造發展新動能新優勢,不斷增強科技創新對高質量發展支撐引領能力,構建文生視頻模型,達到模拟世界的能力,讓AI生成的視頻更真實。
事實上,微美全息目前能夠提供的解決方案包括了自然語言、視覺、多模态等AI大模型産品系列,充分滿足智能化、高效實時的解決方案和技術支持,帶給用戶全新的類人交互體驗,用戶可以定制專屬的AI大模型,高性能的算力平台使能用戶快速完成模型訓練以及多項自主研發場景落地。
談及新一代人工智能産業高質量發展,面對AI視頻生成領域的廣闊前景,微美全息正加大投入,以自主研發創新提升企業核心競争力,從實際場景切入,推動AI應用落地,推動AI視頻生成進入全新時代,微美全息也是實現自身高水平科技的題中應有之義。
結尾
總體而言,作為AI行業先驅,OpenAI 通過 Sora 驗證了世界模型可行性,驗證了大模型做視頻生成的可行性。它的成功會帶動視頻生成賽道的發展,加速視頻生成的創新和成熟。而未來,這又是一場追随與反超越劇情,十分令人期待的,因為相比較文字和圖片而言,視頻擁有更多的受衆和可能性。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

