2026 年 5 月 27 日,ElevenLabs 發布第二代音樂生成模型 Music v2,距離第一代(2025 年 8 月 5 日上線)約十個月。最吸睛的能力是風格切換:同一首曲子可以「從歌劇轉到重金屬再轉回來」,而且不破壞音樂連貫性。更重要的是它的授權定位——模型以授權資料訓練,官方明言生成曲目「可供商用」,直接與深陷訴訟的 Suno、Udio 劃清界線。
對內容與行銷團隊來說,這代表 AI 音樂從「玩具」走向「可用素材」:不需要 sync 授權費、不用等清權,就能產出廣告與品牌影片的配樂。
十個月後的第二代
第一代模型上線時只能生成短片段,實用性有限。Music v2 補上了完整歌曲的建構能力:逐段生成(intro、verse、chorus)再縫合,維持結構與連續性,而不是拼湊幾段短樣本。官方同時宣稱在 vocals、編曲與多語言支援上全面改進,還能撐住語速極快的饒舌演繹而不失真。
單曲內換風格:從歌劇到重金屬
風格切換是 v2 的招牌功能。使用者可以在一首曲子進行中改變流派,模型負責讓轉折聽起來自然。這對影視與遊戲配樂尤其實用——場景切換時音樂跟著變,不再需要手動剪接多首片段。
另一個實用細節是非音樂音效的嵌入:生成的曲子裡可以直接放進環境音或效果音,不用後製疊軌。
逐段生成與局部重寫
Music v2 的 inpainting(局部重繪)能力允許使用者選取某一段、用 prompt 重新生成,其他段落原封不動——例如只改 bridge、保留 chorus。這把音樂生成從「一次擲骰子」變成可迭代的編輯流程,工作方式更接近影片剪輯或圖片修圖。
授權資料與商用清權
ElevenLabs 強調 Music v2「與藝人、唱片公司與版權方共同開發」,並延續與 Believe 等方的授權合作。這個定位在 2026 年特別有感:環球與索尼正尋求在 Suno 的訴訟中新增約 61,000 件受版權保護的作品,索尼對 Udio 的訴訟也追加超過 30,000 件錄音。當對手忙著上法院,ElevenLabs 賣的是「拿到就能用」的確定性。
競爭格局與降價
AI 音樂市場在 2026 年上半年急速升溫:Google 的 Lyria 3 Pro 於 3 月 25 日上線,Stability AI 在 5 月 20 日推出可生成六分鐘曲目的音訊模型,Suno 也已更新到 v5.5,Google I/O 上的 Flow Music 則加入翻唱與音樂影片功能。模型加速迭代正是今年的基調(我們在開年觀察就提過這條線索)。
ElevenLabs 的回應除了能力升級,還有價格:ElevenAPI 調降最多 50%,ElevenCreative 自助方案降最多 40%。Music v2 現已在 ElevenMusic(今年 4 月 2 日上線的 App)與 ElevenCreative 開放使用,API 則標明「即將推出」。對開發者與內容團隊而言,下一季的 AI 音樂工具選型,版權確定性與 API 可用性會是比「誰生成得更好聽」更硬的判準。
參考來源
- ElevenLabs’ new music-generation model can switch genres mid-track — TechCrunch
- Introducing Music v2 — ElevenLabs
- ElevenLabs releases a new AI-powered music generation app — TechCrunch
本文由 AI 協助自上述來源整理,經人工審核後發布。
