MiniMax 正式發布新一代 AI 影片生成模型 H3,在多個關鍵維度上推進了 AI 影片創作的邊界。
H3 最顯著的升級在於將輸出解析度提升至 2K,同時原生整合音效生成能力,不再需要後製另外配音。更重要的是多模態參考輸入設計,創作者可同時提供人物外觀、風格圖像、鏡頭運動指示等多種參考素材,讓 AI 在一個生成流程中同時處理視覺一致性與敘事邏輯。
重點
- 2K 解析度:明顯高於多數競品,適合需要高畫質輸出的製作需求
- 原生音效:影片生成與聲音同步,省去後期對齊音效的步驟
- 多模態參考輸入:人物、風格、運鏡可一次指定,減少多輪迭代
- 局部編輯:支援對已生成影片的特定段落進行修改,更接近非線性剪輯的邏輯
- 技術限制:API 存取與商業授權細節仍需關注
編輯按
AI 影片生成的競爭已從「能不能生成」進化到「夠不夠接近製作流程」。MiniMax H3 的多模態輸入設計讓它更像一個製作工具而非實驗性功能,但能否整合進真實創作流程,仍取決於生成穩定性與可控性的實際表現。
本文由 AI 整理,原文:AI郵報