實體: Stability AI
所有提到 Stability AI 的 AI 新聞與動態。
-
ElevenLabs新音樂生成模型可於歌曲中段切換風格
美國聲效 AI 公司 ElevenLabs 推出了新版音樂生成模型 Music v2,該模型具備在曲目中切換風格的能力,能同時處理人聲與樂曲的複雜度。此版本距離公司首發音樂生成模型已近十個月。新模型可從歌劇切換至重型金屬再返回,在快速說唱時保持連貫性,並能為曲目新增非音樂音效。藝術家可選擇歌曲特定部分,透過提示詞重新創作而不影響其他段落,亦可分段建立歌曲,包含前奏、主歌與副歌,最後將各段拼接。ElevenLabs 表示,新模型在語言、歌詞、人聲與編排方面的表現更可靠。近期 AI 實驗室競相推出能生成專業級音樂的模型,Google、Stability AI 與 Suno 也發布了具備生成更長且複雜曲目能力的模型。在 Google I/O 開發者大會上,Google 透過 Flow Music 工具新增了輕鬆製作翻唱、分段編輯歌曲及生成音樂影片的功能。ElevenLabs 強調,新模型基於授權資料建立,已獲得商業使用許可,使用者可自由使用曲目。鑑於其他 AI 音樂新創如 Suno 與 Udio 曾因版權問題面臨訴訟,與唱片公司達成協議至關重要。新模型現已可在 ElevenLabs 的 ElevenCreative 工具中供行銷與品牌團隊使用,並在新推出的 ElevenMusic 平臺上建立 AI 生成歌曲,預計近期將透過 ElevenAPI 提供服務。
-
穩定AI發布全新音訊模型 可創作六分鐘歌曲
Stability AI 推出全新音訊模型系列 Stability Audio 3.0,旨在提升專業音樂生成能力。該系列包含四種模型:小型 SFX(4.59 億引數)、小型(4.59 億引數)、中型(14 億引數)和大型(27 億引數)。其中,小型 SFX 和小型模型適合在裝置上生成長達兩分鐘的音效與音樂;中型與大型模型則能創作結構完整、旋律穩定的六分二十秒長曲。這比 2024 年推出的 Stable Audio 2.0 生成功能長一倍以上。Stability AI 開放小型 SFX、小型及中型模型的權重供公眾使用與修改,而大型模型僅透過 API 或自託管付費服務提供,且年收入超過一百萬美元的公司需申請企業授權。此前 2024 年推出的 Stable Audio Open 僅支援四十七秒音樂生成,此次升級顯著提升產出長度。Stability AI 已與 Warner Music Group 及 Universal Music Group 簽約,確保最新模型基於完全授權資料訓練。儘管 Google 與 ElevenLabs 等企業也在音樂生成領域投入,但 Suno 與 Udio 的訴訟顯示,資料授權與唱片公司合作對服務長期生存至關重要。此外,Stability AI 前首席數位官 Ethan Kaplan 加入領導專業音樂業務,同期 Suno 與 ElevenLabs 也分別聘請前 Merlin 執行長及 Kobalt 音樂出版商高層以強化專業聲譽。
-
黑森林實驗室籌得3億美元資金,企業估值達32.5億美元
德國人工智慧實驗室 Black Forest Labs 於週一宣佈完成 B 輪融資,籌得 3 億美元,估值達 32.5 億美元。該輪融資由 Salesforce Ventures 和 Anjney Midha (AMP) 共同領投,參與機構包括 a16z、NVIDIA、Northzone、Creandum、Earlybird VC、BroadLight Capital、General Catalyst、Temasek、Bain Capital Ventures、Air Street Capital、Visionaries Club、Canva 以及 Figma Ventures。公司表示將資金用於研發。Black Forest Labs 專注於開發生成與編輯圖片的基礎人工智慧模型,自 2024 年 8 月推出後迅速聞名。該公司去年因被揭露其模型被 Elon Musk 的 Grok 聊天機器人用於生成圖片而受到關注,目前 Adobe、fal.ai、Picsart、ElevenLabs、VSCO 及 Vercel 等多家公司亦在使用其模型。公司近期推出了最新版本的圖片生成模型 Flux 2,該版本據稱在文字與圖片渲染方面表現更佳,並可參考最多 10 張圖片以維持風格與語調,同時支援最高 4K 畫素的圖片生成。Black Forest Labs 的聯合創辦人 Robin Rombach、Patrick Esser 和 Andreas Blattmann 曾為 Stability AI 的 Stable Diffusion 模型開發者。
-
蓋帝放棄對穩定AI的重要版權聲請,但英國訴訟持續進行
美國 Getty Images 於週三在倫敦高等法院撤回了對 Stability AI 的主要侵權指控,這一舉動縮小了關於 AI 公司如何利用版權內容訓練模型的備受關注的法律爭端。儘管此舉並未完全結束案件,Getty 仍在追尋其他指控,並在美國另案起訴。這一發展發生在一天前,美國法官在類似爭議中支援了 Anthropic,裁定未經作者許可使用書籍訓練 AI 違反版權法。Getty 於 2023 年 1 月起訴 Stability AI,指控其未經許可使用數百萬張版權圖片訓練 Stable Diffusion AI 模型,並聲稱生成的許多作品與訓練內容相似,甚至帶有 Getty 的水印。這兩項指控均於週三上午被撤銷。律師 Ben Maling 指出,訓練指控因 Getty 未能建立足夠的英國管轄權聯絡而被撤銷,輸出指控則因未能證明模型重現的內容反映了圖片中創作者的實質部分而被撤銷。Getty 律師將此視為戰略性決定,以便集中於他們認為更強有力的指控。目前保留的指控包括次要侵權指控及商標侵權指控。Getty 主張 AI 模型本身可能侵權,並在英國使用這些模型構成進口侵權物品。Stability AI 表示對 Getty 撤銷多項指控感到高興,並認為商標和誤導性商標指控將失敗,因為消費者不將水印視為 Stability AI 的商業訊息。Getty 美國分部也於 2023 年 2 月對 Stability AI 提起商標和版權侵權訴訟,指控其使用高達 1200 萬張版權圖片,尋求針對 11,383 項作品的損害賠償,每項 15 萬美元,總額達 17 億美元。Getty 表示英國案件的決定不影響美國案件,該案目前等待 Stability AI 動議駁回的決定。此外,Stability AI 還與 Midjourney 和 DeviantArt 一同被一組視覺藝術家指控侵權。Getty Images 本身也擁有利用其 iStock 攝影和影片庫訓練的生成式 AI 產品,允許使用者生成新的可授權圖片和藝術品。