影片生成的帳單是按秒累計的,所以選模型的第一個問題不是「哪家品質最好」,而是:這支片必須多長?開頭或結尾要不要釘死在某一張圖上?OpenRouter 在 2026 年 9 月 29 日發布的比較文章,把四條 image-to-video 模型線——Veo 3.1、Seedance、Kling、Grok Imagine Video——放在同一套 API 下對照,正好把這兩個問題變成可查表的決策。
先分清兩種「用圖」方式
同一張圖進請求,有兩種完全不同的角色。frame_images 把圖釘成影片的精確第一幀、最後一幀,或兩者;input_references 則只是給模型參考素材,不固定幀位置。如果產品影片必須以指定產品照開場,那是 image-to-video;如果只是要角色長相一致,用 reference-to-video 就夠,而且通常更省。兩個欄位同時送出時,frame_images 會覆蓋生效。
注意一件事:不是每個模型都支援首尾兩種幀角色,要用 GET /api/v1/videos/models 回傳的 supported_frame_images 陣列確認,而不是看模型名字猜。
時長與幀控制先篩掉一半
按 OpenRouter 在 2026 年 9 月 11 日核對的設定表,各家差異比想像中大:
- Veo 3.1 系列:4、6、8 秒,支援首尾幀與選配音訊;Veo 3.1 與 Fast 到 4K,Lite 停在 1080p。Lite 起價 $0.03/秒,完整版 $0.20/秒起。
- Seedance 2.5:4 到 30 秒,480p 或 720p,是這次比較中唯一能一次生成 20 或 30 秒鏡頭的模型,且接受多達 50 個圖像、影片、音訊參考資產。480p 起價約 $0.1028/秒。
- Kling v3.0:3 到 15 秒,720p,首尾幀控制,音訊選配且會加價(Standard 無音訊 $0.084/秒,有音訊 $0.126/秒)。
- Grok Imagine Video 1.5:1 到 15 秒,最高 1080p,但只支援
first_frame——開場能釘,結尾不能。要讓片尾停在第二張精確圖,只能換 Veo、Seedance 或 Kling。
所以決策順序很清楚:先按時長淘汰(8 秒以上、需要首尾幀的,Veo Lite 就不夠用;需要 30 秒的只剩 Seedance 2.5),再比較剩下的解析度、音訊與價格。迭代階段用便宜模型跑 prompt 和運動效果,定案後才上高解析度——OpenRouter 自家的 image-to-video cookbook 也是基於同樣理由選 google/veo-3.1-lite 做示範。
兩個容易踩的計費陷阱
第一,Seedance 不是按秒計費,是按 video token 計費:token 數等於高 × 寬 × 時長 × 24 ÷ 1,024。模型頁上的每秒數字只是 480p 的換算起始值,升到 720p、1080p 或 4K 時要回到 token 公式重算。
第二,提交影片任務本身就是計費行為。OpenRouter 的 TypeScript SDK 預設對 5XX 錯誤做最長一小時的指數退避重試——如果伺服器已收下任務、卻在回傳 job ID 前出現暫時性錯誤,自動重試會開出第二個付費任務,而客戶端只看得到第二個。提交時傳 { retries: { strategy: "none" } } 關掉重試,讓失敗明確浮出來再手動決定,是比較安全的做法。
另外送出前先驗證圖片 URL:curl -I 確認回 200 且 content type 是 image/jpeg、image/png 或 image/webp。瀏覽器開得了,不代表供應商的伺服器抓得到——session cookie、HTML 轉址或 bot 檢查都會讓任務白白失敗。
幾個補充的判斷界線
音訊那欄的讀法要小心:Grok Imagine Video 1.5 不暴露 generate_audio 參數,但模型描述說它會生成音效、環境音與對白,所以標為 Yes;舊版描述沒提音訊,就標 Not listed。同理,「Not listed」代表描述裡沒寫,不代表實測被拒——OpenRouter 建議上線前用 reference-to-video cookbook 先確認。
還有兩點會影響選型:Veo 3.1 Fast 與 Lite 的描述列出 SynthID 浮水印,有內容來源標示或浮水印需求的要留意;Seedance 全系列僅提供 hosted API,沒有公開權重或授權,無法本地或離線部署。這些細節在上週那篇成本與控制取捨的整理裡也有類似的結論——規格表能告訴你能不能做,但部署限制和計費結構才決定該不該上。
實務上的下一步很簡單:把你的時長上限、幀角色需求、解析度下限列成三個條件,用 /api/v1/videos/models 的回傳值過濾,再對剩下的模型按秒算一次最貴情境的成本。規格會持續變動,OpenRouter 也提醒數字僅供比較,報價前回到模型頁確認。
參考來源
本文由 AI 協助自上述來源整理,經人工審核後發布。
