Generative AI

ElevenLabs Music v2 登場:單曲內從歌劇唱到重金屬的 AI 音樂模型

ElevenLabs 推出 Music v2 音樂生成模型:單曲內可從歌劇切到重金屬、逐段重新生成、嵌入音效,並以授權資料訓練、可直接商用。本文解析其能力、降價策略與 AI 音樂市場競爭。

ElevenLabs Music v2 登場:單曲內從歌劇唱到重金屬的 AI 音樂模型 — 文章封面
本頁內容6 個段落
  1. 十個月後的第二代
  2. 單曲內換風格:從歌劇到重金屬
  3. 逐段生成與局部重寫
  4. 授權資料與商用清權
  5. 競爭格局與降價
  6. 參考來源

2026 年 5 月 27 日,ElevenLabs 發布第二代音樂生成模型 Music v2,距離第一代(2025 年 8 月 5 日上線)約十個月。最吸睛的能力是風格切換:同一首曲子可以「從歌劇轉到重金屬再轉回來」,而且不破壞音樂連貫性。更重要的是它的授權定位——模型以授權資料訓練,官方明言生成曲目「可供商用」,直接與深陷訴訟的 Suno、Udio 劃清界線。

對內容與行銷團隊來說,這代表 AI 音樂從「玩具」走向「可用素材」:不需要 sync 授權費、不用等清權,就能產出廣告與品牌影片的配樂。

十個月後的第二代

第一代模型上線時只能生成短片段,實用性有限。Music v2 補上了完整歌曲的建構能力:逐段生成(intro、verse、chorus)再縫合,維持結構與連續性,而不是拼湊幾段短樣本。官方同時宣稱在 vocals、編曲與多語言支援上全面改進,還能撐住語速極快的饒舌演繹而不失真。

單曲內換風格:從歌劇到重金屬

風格切換是 v2 的招牌功能。使用者可以在一首曲子進行中改變流派,模型負責讓轉折聽起來自然。這對影視與遊戲配樂尤其實用——場景切換時音樂跟著變,不再需要手動剪接多首片段。

另一個實用細節是非音樂音效的嵌入:生成的曲子裡可以直接放進環境音或效果音,不用後製疊軌。

逐段生成與局部重寫

Music v2 的 inpainting(局部重繪)能力允許使用者選取某一段、用 prompt 重新生成,其他段落原封不動——例如只改 bridge、保留 chorus。這把音樂生成從「一次擲骰子」變成可迭代的編輯流程,工作方式更接近影片剪輯或圖片修圖。

授權資料與商用清權

ElevenLabs 強調 Music v2「與藝人、唱片公司與版權方共同開發」,並延續與 Believe 等方的授權合作。這個定位在 2026 年特別有感:環球與索尼正尋求在 Suno 的訴訟中新增約 61,000 件受版權保護的作品,索尼對 Udio 的訴訟也追加超過 30,000 件錄音。當對手忙著上法院,ElevenLabs 賣的是「拿到就能用」的確定性。

競爭格局與降價

AI 音樂市場在 2026 年上半年急速升溫:Google 的 Lyria 3 Pro 於 3 月 25 日上線,Stability AI 在 5 月 20 日推出可生成六分鐘曲目的音訊模型,Suno 也已更新到 v5.5,Google I/O 上的 Flow Music 則加入翻唱與音樂影片功能。模型加速迭代正是今年的基調(我們在開年觀察就提過這條線索)。

ElevenLabs 的回應除了能力升級,還有價格:ElevenAPI 調降最多 50%,ElevenCreative 自助方案降最多 40%。Music v2 現已在 ElevenMusic(今年 4 月 2 日上線的 App)與 ElevenCreative 開放使用,API 則標明「即將推出」。對開發者與內容團隊而言,下一季的 AI 音樂工具選型,版權確定性與 API 可用性會是比「誰生成得更好聽」更硬的判準。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵