內容表
MiniMax H3 的影片編輯提示詞若能分清楚「要改什麼」與「哪些內容必須保留」,結果會更容易控制。先定義編輯目標並保護身分與動作,再對照原始影片和輸出結果。若鏡頭概念有大幅改變,應重新生成。
H3 支援參考素材驅動的生成,以及搭配多模態情境的影片編輯。它能使用原始影片,再加入文字、圖片、影片或音訊參考,產生修改後的結果;但它不是手動時間軸編輯器。
MiniMax 官方資料展示了影片編輯、動作轉移、音訊沿用與語音參考流程。H3-Context-IR 可在生成前解讀輸入內容,並回傳增強後的提示詞。
V2 生成端點可直接輸出 768P 或 2K。MiniMax 也為符合條件的 768P 結果提供獨立的 2K 再生成端點。再生成是選用的解析度流程,不是每次取得 2K 輸出前的必要步驟。
模型會重新生成結果,不提供影格層級遮罩、分層軌道、精準剪接,或手動多關鍵影格時間軸控制。首尾影格輸入屬於另外的圖片轉影片生成模式。
這項差異會影響提示詞寫法。「換掉牆面」只說明要改什麼;有效的編輯指示也要定義哪些人物、動作、相機、標誌與音訊必須維持穩定。
撰寫編輯指示前,先列出受保護的元素。檢視原始影片,找出維持鏡頭連續性的關鍵。
| 元素 | 要確認的問題 |
|---|---|
| 主體 | 臉部、身形、服裝與髮型是否都必須保持一致? |
| 動作 | 手勢、步伐或產品動作是否必須維持不變? |
| 相機 | 角度、鏡頭感、裁切與相機運動是否都要保留? |
| 構圖 | 物件位置與彼此間距是否要固定? |
| 產品 | 形狀、材質、標籤、顏色與標誌是否必須精確保留? |
| 背景 | 哪些部分可以改變?哪些空間結構必須保留? |
| 文字 | 字幕、包裝文案或招牌是否必須維持可讀? |
| 音訊 | 對話、節奏、環境音與效果音是否都要保留? |
先保護一旦改變就會讓影片無法使用的元素。產品廣告可能最重視標籤;角色場景則可能要先保護臉部與服裝。
不要把每個像素都鎖死。模型需要空間執行編輯要求。保護身分與連續性,同時讓目標區域能夠改變。
不要寫成一大段描述,改用結構化編輯需求:
Change:
Keep:
Avoid:
Motion:
Camera:
Audio:
Final look:
這種結構更容易找出互相矛盾的要求,也能把畫面修改與製作限制分開。
Change the background from a plain studio wall to a rainy neon city street at night. Keep the same person, face, clothing, hand motion, camera angle, clip rhythm, and product in their right hand. Avoid changing the logo, adding extra text, or replacing the person's hairstyle. Keep the audio natural and do not add new dialogue.
處理產品影片時,請更明確地列出受保護細節:
Change only the table surface from white marble to dark walnut. Keep the bottle shape, green glass, gold cap, front label, label text, reflections, camera push-in, and hand position unchanged. Avoid new props, extra labels, color shifts, or camera shake. Preserve the original audio.
第二個提示詞縮小了編輯範圍,也點出一般指示容易忽略的品牌風險。

結構化編輯需求能在生成前更容易看出矛盾。
參考素材往往比文字更能精確定義地點、質感、服裝或產品。目標包含明確視覺細節時,請使用參考素材。
為每項參考素材指定清楚的用途:
MiniMax 文件說明了 H3 的情境與參考任務。媒體格式、限制與控制項目可能因 API、產品介面及第三方整合而異;請依實際使用管道準備參考素材。
參考素材彼此也可能衝突。若目標背景的相機角度不同,模型可能被迫改變構圖;若角色參考穿著另一套服裝,也可能削弱「保留服裝」的指示。
應依修改幅度選擇製作流程。
| 選擇此路徑 | 最適合 | 範例 |
|---|---|---|
| 透過參考素材轉影片進行小範圍 H3 編輯 | 只改一項視覺屬性,原始表演仍可沿用 | 保留人物與動作,只更換牆面 |
| 重新生成 H3 影片 | 鏡頭意圖或構圖發生變化 | 把靜態產品影片改成節奏更快的亮相鏡頭 |
| 直接以 2K 生成 H3 影片 | 新輸出從一開始就應採用 2K | 在 V2 生成請求中選擇 2K |
| H3 2K 再生成 | 已核准且符合條件的 H3 768P 結果需要 2K 版本 | 可用時,依文件使用 task ID 或 base video 管道 |
| 以影格重建 | 開頭與結尾必須符合預先設計的狀態 | 產品從密封包裝轉換成開啟狀態 |
| 以圖片轉影片重建 | 要把一張已核准的靜態圖片變成新鏡頭 | 從品質最好的影格重新製作受損影片 |
| 外部編輯器 | 精準剪接、字幕、音樂、疊加圖層或調色時間點 | 加入標誌收尾卡,並讓剪接點對齊音軌 |
原始影片已有正確表演與構圖時,適合做小範圍編輯。若動作、取景或場景邏輯必須改變,請重新生成。新輸出可直接選擇 2K;只有已核准的 768P 結果符合該獨立流程條件時,才使用 2K 再生成。
若工作需要精準剪接或影格專用的品牌疊加圖層,任何提示詞都無法取代時間軸。
一個提示詞可以包含多項限制,但每次生成仍應只有一個主要創意目標。互不相關的修改要拆開處理。
例如,不要在同一次請求中更換背景、服裝與相機,還要求加入雨景。先改背景,確認身分與動作無誤,再判斷是否要另做一次氣氛調整。
高風險品牌影片可依此順序處理:
縮短原始片段也能減少漂移。只在自然剪接點分段,例如停頓、相機停止或手勢完成之處;不要切斷必須保持連續的快速動作。
保留未修改的原始檔與每個已核准的中間版本。後續處理可能修好一個元素,卻破壞另一個元素;版本紀錄能清楚呈現這項取捨。
不要只看最終影片。請把原始影片與輸出結果中相同時間點的影格並排比較。
檢查開頭、中點與最後一影格,再以正常速度播放兩段影片。
| 檢查範圍 | 通過條件 | 問題訊號 |
|---|---|---|
| 要求的修改 | 目標元素已有明確改變 | 修改缺失或不完整 |
| 身分 | 仍能辨識為同一主體 | 臉部、頭髮、身形或服裝改變 |
| 動作 | 原始動作保持連貫 | 手勢時間點或四肢路徑改變 |
| 相機 | 預定取景保持不變 | 裁切、角度或相機運動漂移 |
| 產品 | 形狀、標籤與顏色保持不變 | 標誌改變或包裝變形 |
| 背景 | 新場景保持穩定 | 空間結構閃爍,或與主體重疊 |
| 文字 | 必要文字仍清楚可讀 | 字母在不同影格間變形 |
| 音訊 | 聲音符合編輯需求 | 對話或時間點意外改變 |
若要求的修改成功,受保護元素卻失敗,請調整 Keep 與 Avoid 條件。若整體構圖都必須改變,則應重新生成。
比較時請使用實際原始影片與生成結果擷取的影格。靜態圖片編輯無法驗證動作、時間一致性或音訊連續性。
版本名稱要保持清楚易讀:
sourceA_city-bg_keep-audio_v01
sourceA_city-bg_lock-logo_v02
sourceA_new-generation-wide-shot_v03
這項紀錄可避免團隊拿不相干的設定互相比較。
MiniMax H3 即將在 DomoAI 上線。正式推出後,我們會立即分享消息,敬請期待。
目前你可以使用 Omni Reference 中的 Seedance 2.5 。在 H3 正式加入 DomoAI 前,可先透過 MiniMax 使用 H3 生成,再以 DomoAI 準備來源素材或完成後製。請依尚待解決的問題選擇合適工具。
擷取或重新製作已核准的來源影格,再使用 多模型圖片生成器與編輯器修正。GPT Image 2、Nano Banana 2 與 Nano Banana Pro 適合處理標誌、手部、產品標籤、服裝與背景瑕疵。
若仍有一張可用的靜態畫面,可透過 圖片轉影片重建。若開頭與結尾都需要明確構圖,請使用 多幀轉影片。這些是獨立的 DomoAI 生成路徑,不是 H3 影片編輯模式。
DomoAI 的 AI UGC 廣告流程 可串連產品視覺、動作、主持人片段與不同平台版本。每個版本都要維持宣傳主張、標誌與產品定鏡一致。
DomoAI Screen Keying 可輸出綠幕或透明背景影片,供 CapCut、Premiere Pro 等編輯器使用。遮罩、圖層、字幕與精準品牌位置,仍應在外部軟體處理。
請在身分、動作與文字都通過檢查後,再使用 影片放大(Video Upscaler) 。它可透過降噪與細節增強,將最終影片提升至 4K。
畫質提升無法還原錯誤的標誌或漂移的臉部,請先修正生成結果。
把身分細節移到 Keep 條件,加入已核准的臉部或產品參考,並減少同一次生成中的相機與照明變化。
明確描述景深與遮擋關係。指出主體要留在前景,新環境必須位於主體後方。
固定精確位置與文字內容。若文字仍會改變,請在外部編輯器合成已核准的圖像。
明確要求身體動作、手勢時間點與影片節奏保持不變。若動作本身就需要修改,請重新生成,不要勉強做局部編輯。
檢查中點與動作轉換,縮小目標區域,或把影片拆成更短的片段。
加入明確的音訊指示,並確認目前模式的實際行為。需要精準對話、音樂與效果音混音時,請使用外部軟體。
可以,但它是透過重新生成,而不是時間軸編輯。MiniMax 文件列出搭配多模態情境的原始影片編輯;可用輸入與控制項目取決於實際使用管道。
MiniMax-H3 可直接生成 2K。它另有獨立的 再生成端點 ,可把符合條件的 768P 結果轉成 2K 版本。依權限不同,請求可以使用 source_task_id ,或使用一個 base_video完整重現原始生成內容。task ID 管道需要白名單權限,base video 管道則有額外檔案要求。
在 Keep 條件中寫明主體固定的身分、服裝、動作與位置。單靠文字無法清楚定義主體時,請加入乾淨的參考素材。
MiniMax 官方 H3 儲存庫示範了原始影片編輯流程,其中會沿用背景音訊,並透過語音參考加入對話。精確的音訊控制仍取決於實際使用管道。
原始表演與構圖要保留時,選擇編輯;動作、相機意圖、構圖或場景邏輯改變時,則重新生成。新的高解析度輸出可直接選擇 2K;再生成只適用於已可用且符合條件的 768P 結果。
好的編輯提示詞不只描述想要的改變,也會定義原始影片中值得保留的元素。
保存原始檔、提示詞、設定與已核准輸出,讓之後每次修改都從明確、可追溯的製作狀態開始。
寫好 Change、Keep 與 Avoid 條件,再比較三個相同時間點的影格,確認後才核准結果。
最近的文章