跳至內容
AI 新聞站
返回

穩定AI發布全新音訊模型 可創作六分鐘歌曲

Stability AI,背後開發 Stable Diffusion 的公司,即將推出一個新的音訊模型系列,名為 Stability Audio 3.0。該公司聲稱,最高階的模型可以產生超過六分鐘的專業級音樂。公司將在 Stability Audio 3.0 名稱下推出四個新的模型:small SFX(459M 個參數)、small(459M 個參數)、medium(1.4B 個參數),以及 large(2.7B 個參數)。兩種 small 模型適合在裝置上進行最多兩分鐘的音訊與音樂生成。medium 與 large 模型則可以創作長達六分鐘二十秒的完整曲目,並能維持音樂結構與旋律音調。這比 2024 年推出的 Stable Audio 2.0 所能產生的長度多了兩倍以上。Stability AI 將 small SFX、small 與 medium 模型以開放權重的方式提供給任何人使用與修改。2024 年,公司推出了 Stable Audio Open,允許最多產生 47 秒的音樂。這一系列的新模型比起之前的開放版本有顯著進步。large 模型僅能透過 API 與自建付費服務使用。此外,年營收超過 100 萬美元的公司將需要取得企業授權。許多公司,包括 Google 與 ElevenLabs,正在推出與音樂生成相關的模型與工具。然而,正如 Suno 與 Udio 繼續進行的法律爭議所顯示的,數據授權與與音樂廠牌的合作,可能會成為這些服務長期生存的重要因素。去年,Stability AI 與 Warner Music Group 與 Universal Music Group 签訂協議,開發模型與音樂創作工具。公司表示,最新一組音訊模型是基於完全授權的數據所建立。這家 AI 新創公司正在開發一套新的專業音樂人用產品,但未提供更多關於其功能的細節。曾擔任 Universal Audio 與 Fender 首席數位官的 Ethan Kaplan,將加入公司領導 Stability 的專業音樂業務。多家 AI 公司正透過聘請音樂業高管來強化自身聲譽。今年初,Suno 雇請前 Merlin 董事長 Jeremy Sirota 當首席營銷官。ElevenLabs 也聘請來自獨立音樂出版商 Kobalt 的 Derek Cournoyer 當其音樂業務的策略領航員。


分享這篇文章:

上一篇
AI搜尋新創公司正在爆紅
下一篇
納諾爪創辦人拒絕2千萬美元收購提案,轉而籌募1千兩百萬美元種子資金