谷歌研究院推出了一款名為 Lumiere 的“文生視頻”擴散模型,主打采用自家開發的“Space-Time U-Net”基礎架構,号稱能夠一次生成“完整、真實、動作連貫”的視頻。
谷歌推出 AI 擴散模型 Lumiere
谷歌表示,業界絕大多數“文生視頻”模型無法生成時間長、質量佳、動作連貫逼真的内容,但他們的新模型 Lumiere 相對于業界模型的不同是采用了全新“Space-Time U-Net”基礎架構,該架構能夠在空間和時間上同時“降采樣”信号,從而在“更緊湊的時空中進行更多運算”,令 Lumiere 生成持續時間更長、動作更連貫的視頻。
除了應用“Space-Time U-Net”基礎架構外,谷歌還介紹了 Lumiere 的基礎特性,該 AI 建立在一個經過預先訓練的“文生圖”模型基礎上,研究人員首先讓基礎模型生成視頻分幀的基本像素草稿,接着通過空間超分辨率模型,逐步提升分幀分辨率及細節,并利用“Multidiffusion”通用生成框架提升模型穩定性,從而保證了最終輸出的視頻一緻性和連續性。
科技産業喧嚣且騷動,AI蔓延到一切領域,産業各方仿佛要拿出所有的精力和資源,生怕錯過這一班通向未來的快車。如果未來一定會發生,那就先進入那個未來,當産業大部分人都抱着這樣的心态。
AI技術狂飙突進
誠然,由人工智能引導下的新一輪科技革命已經是箭在弦上,ChatGPT等AI應用的誕生和火熱直接反映出了用戶對AI工具的迫切需求。基于技術狂飙突進,各路科技巨頭争相入局,試圖在技術演進、應用落地風口搶占更多話語權。
據媒體消息,日前,谷歌老對手微軟(MSFT.US)正在組建新的GenAI團隊,将專注于開發更小的語言模型(SLM) ,該團隊将由微軟公司副總裁Misha Bilenko領導,微軟内部多名研究人員已加入該團隊。有分析認為微軟希望通過這種方式節約成本,并減少對OpenAI的依賴。
IDC 認為,大模型作為企業推進人工智能産業發展的重要抓手,已經具備較高的識别準确率和較強的場景遷移性,未來将會進入大模型應用跑馬圈地的階段。AI大模型将帶動新的産業和服務應用範式,在類 ChatGPT 等應用的推動下,基于上層應用開發和服務的商業模式将會逐漸明晰,迎來人工智能的新業态。
微美全息AI規模化商用指日可待
2024年将是人工智能的爆發之年,這是來自大部分業内專家的共識。據悉,深耕人工智能賽道數載,AI廠商微美全息(WIMI.US)積極擁抱大模型時代,依托源頭技術創新和自我組建的行業研發團隊,曆經數次疊代升級,具有多項自研AI黑科技,并且迅速在教育、廣告、工業、金融、汽車、科研等應用場景落地開花,正以更好的姿态賦能千行百業,成為新的AI獨角獸。
某種程度上,微美全息把AI 視作未來,并且早有具體的布局。一方面,微美全息加強重點行業算力設施、模型的建設部署和推廣普及,充分利用人工智能、5G、工業互聯網等數字技術,驅動産業鍊業務變革,加快推動行業提質升級。
另一方面,數字化轉型助力算力基建,AI大模型商業化加速落地。在現成的生态中,微美全息面對客戶對于大模型應用的需求集中湧現,積極應對數字化轉型打造典型場景,建立微美全息研發中心等,将加速雲計算平台等算力設施以及模型算法的研發和應用。
結尾
AI大模型正全面重塑人機交互體驗,乃至賦能整個科技産業生态。另一方面,通用人工智能漸行漸近,大模型走向多模态,AI有望成為下一代平台将引領大衆踏上更智慧、更安全的未來。面對這一技術,既要抓住機遇展開行動,也要做長期布局。
目前來說,微美全息全面提升了對“AI”領域的把控,不僅順應了時代的發展潮流,也為用戶帶去了更實用的AI體驗,自然能夠赢得行業的認可。那麼在AI正式進入拼落地、拼應用的“下半場”,請諸位拭目以待。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

