
近日,據TheInformation報道,OpenAI正在開發一款新的音樂生成工具,能夠根據文本和音頻提示自動創作音樂。
用戶未來或可用其為視頻添加配樂,或為已有的聲樂曲目添加吉他伴奏等器樂伴奏。
這标志着OpenAI在ChatGPT之後,正将其AI能力擴展到文本、圖像和視頻之外的音樂創作領域。目前尚不清楚該工具将作為獨立産品發布,還是整合進ChatGPT或視頻生成模型Sora中。
獲取高質量訓練數據
為提升模型對音樂的理解與生成質量,OpenAI正在與音樂教育領域頂尖機構合作。
OpenAI已經與茱莉亞學院的學生展開合作,這些學生正在為音樂樂譜進行标注,以作為AI模型的訓練數據。
茱莉亞學院是全球最著名的表演藝術教育機構之一,其學生的專業知識和藝術素養将為OpenAI的模型提供高質量的學習素材。
這一合作模式反映了OpenAI将人類藝術與機器學習相結合的更廣泛目标。
該公司強調,此類創新旨在增強人類創造力,而非取代它。
多種創意應用場景
根據報道,OpenAI内部已經讨論了這款音樂模型的具體應用場景。
該工具将支持文本和音頻雙提示輸入,用戶可通過輸入一段描述,要求AI為現有的聲樂曲目添加吉他伴奏。
這一功能可幫助用戶為短視頻添加配樂,使視頻完全由AI生成。
内容創作者可以先用Sora生成一段視頻,然後通過音樂AI即時配上背景音樂,大幅降低内容創作的門檻。
廣告公司也可使用OpenAI的音樂模型來為廣告創作歌詞和旋律,開拓商業應用場景。
從MuseNet到Jukebox
OpenAI對音樂生成領域的探索并非首次。
2019年,OpenAI便推出了音樂生成模型MuseNet。它可以結合最多10種不同樂器的音色,生成古典、搖滾、鄉村等多種不同風格、長達4分鐘的樂曲,但不能進行歌唱。
随後,OpenAI又在2020年發布了會“唱歌”的Jukebox模型。
由于技術和計算成本的限制,它們生成的音樂與人類創作的仍有較大差距,且均未被整合進ChatGPT和Sora中。
在ChatGPT發布前,OpenAI曾探索過生成音樂模型,但近年來公司主要專注于文本轉語音和語音轉文本技術。
全球科技公司逐鹿AI音樂
随着算力和模型架構進步,音樂生成技術正迎來實用化可能,成為繼文本與視頻之後的新一輪AI技術競賽焦點。
谷歌今年5月推出了第二代音樂制作模型Lyria。谷歌特别強調,Lyria可為廣告制作配樂,這與OpenAI音樂模型的潛在商業化方向高度重合。
初創公司Suno和Udio的AI音樂生成産品已成功實現商業化。Suno作為成立僅三年的企業,其年經常性收入已達1.5億美元,比一年前增長近四倍。
中國AI音樂模型也在迅速崛起,字節跳動的Seed-Music、阿裡巴巴的InspireMusic、昆侖萬維的MurekaO1、騰訊的SongGeneration以及MiniMax的Music1.5等模型紛紛亮相。
目前,OpenAI已擁有超過8億活躍用戶,音樂模型将幫助其構建更完整的AI生态系統,進一步提升用戶黏性。
從OpenAI的技術疊代到全球廠商的争相投入,AI音樂正從實驗走向應用,預計将掀起新一輪技術與商業的深度競逐。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.



