2025 年 6 月 18 日,以圖片生成起家的 Midjourney 終於跨出下一步:推出首款影片生成模型 V1。對這個以美學風格聞名的品牌來說,這是補上產品線缺口的一步,也是對 Google Veo 3、OpenAI Sora、Runway Gen 4 等早早上路的競爭者的正式回應。
V1 走的是圖生影片路線,而不是直接文字生影片:你給它一張圖——可以用 Midjourney 自己的圖片模型生成,也可以上傳外部圖片——它把靜態畫面動起來。從功能定位到計價方式,V1 都更像是給既有社群的禮物,而不是對競品的正面攻擊。價格不便宜,但公司把它定位成 Engadget 轉述的「給所有人的第一款影片模型」,顯然志不在好萊塢特效生產線,而在廣大的個人創作者。
V1 怎麼用
具體規格是這樣的:一次生成四段 5 秒短片;每段可以延長 4 秒,最多延長四次,總長約 21 秒。動畫模式分兩種——自動模式讓模型自己決定畫面怎麼動,手動模式則由你用文字描述想要的運鏡與畫面變化,系統照著描述去做。
另外還有低動態與高動態兩檔設定,控制鏡頭與主體的運動幅度。TechCrunch 的第一手試用把輸出描述為偏向「超現實感」而非寫實電影感,早期用戶反應整體正面。發布當天即可在 Midjourney 的網頁版與 Discord 使用,與它既有的圖片工作流接在一起。對已經熟悉 Midjourney 介面的用戶來說,學習成本幾乎為零,影片工具就放在圖片工具旁邊。
定價與用量限制
影片生成的成本約為圖片的 8 倍,這是 V1 最直接的使用門檻。入門方案是每月 10 美元的 Basic 訂閱;每月 60 美元的 Pro 與 120 美元的 Mega 訂閱戶,則可以在速度較慢的 Relax 模式下無限量生成影片,用量天花板完全取決於訂閱檔位。
公司明言這套定價會在一個月內重新評估——等於承認影片運算成本還在摸底,這一個月的觀察期,也是對新產品計價失準的對沖。對照競品的計費方式:Veo 3 綁在 Google 的高階訂閱與 API 計費上,Runway 按點數收費,Midjourney 選擇把影片壓在自己的訂閱牆內,靠既有圖片用戶基盤攤平成本,這在當時是相當不同的商業路線:輕度用戶按用量付費,重度用戶包月吃到飽,與圖片時代培養使用習慣的打法一脈相承。
競爭格局:晚了但不同
必須承認,V1 在時間點上是追趕者。Sora、Runway Gen 4、Adobe Firefly、Google Veo 3 都已上市數月甚至更久,其中 Veo 3 更以原生音訊與寫實感搶下大部分話題。但 Midjourney 的差異化路線很清楚:不做商業 B-roll 生產線,主打風格化影片與創作者的視覺品味。
TechCrunch 引述執行長 David Holz 的說法,影片只是過渡站,公司真正想要的是「能進行即時開放世界模擬」的模型,下一步計畫包含 3D 渲染與即時模型。換句話說,V1 的意義不在影片市場本身,而在替即時模擬累積資料與工程基礎——這個長期目標的宣示,比 V1 的規格更值得記住。從產品節奏看,這也是一次合理的資源調度:圖片端的使用者與風格資料,正好是訓練與調校影片模型最需要的燃料,先服務既有社群再往外擴張,比一開始就搶商業市場更符合公司的位置。
版權陰影與後續路線
發布時機也頗為微妙:就在一週前,迪士尼與環球才對 Midjourney 提起版權訴訟,指控其輸出涉及《辛普森家庭》的荷馬與星際大戰的黑武士等受保護角色。影片模型上線時,Midjourney 特別請用戶「負責任地使用這些技術」——在訴訟背景下,這句提醒不只是客套話。訴訟與發布同時推進,讓 V1 的每一次展示都帶有雙重意涵;公司選擇照常上線,某種程度上也是宣示產品路線不會因訴訟停擺。對創作者社群而言,這場訴訟的走向,也會決定他們的作品未來能在多少保障下使用這些工具。
從 2026 年回看,V1 是 Midjourney 從圖片公司轉型為多模態創作平台的起點:規格上它不是當時最強的影片模型,但 8 倍計價、訂閱內吃到飽的組合,把門檻壓在既有圖片訂閱戶伸手可及的範圍內,也讓它成為觀察創作者市場如何接納影片生成的一個樣本。
參考來源
- Midjourney launches its first AI video generation model, V1 - TechCrunch
- Midjourney adds AI video generation - Engadget
本文由 AI 協助自上述來源整理,經人工審核後發布。
