
內容表
是。MiniMax H3 已以開放權重模型的形式公開,但完整 H3 系統並非全部開放,也不是不受限制。MiniMax 依自訂 Community License 公開 H3-Base FL2VA 與 H3-Base Ref2VA 權重;Context-IR 仍是託管式服務,Regenerate-2K 也未包含在目前的公開版本中。
MiniMax 將 H3 稱為開放模型。對於技術和商業決策, 開放權重 是更準確的描述。
這項區別很重要。開放權重讓開發人員可依授權條款檢查、執行、修改與整合已發布的模型元件,但不代表完整訓練流程、所有正式環境模組或無限制使用權也一併公開。
MiniMax 於 2026 年 7 月 31 日推出 H3,並在 8 月 2 日公開 H3-Base 權重。相關檔案可在官方H3模型庫與 GitHub 程式庫取得。
以下是該版本包含的內容以及可下載套件以外的剩餘內容:
| 項目 | 目前狀態 | 對使用者的意義 |
|---|---|---|
| H3-Base FL2VA 權重 | 已公開 | 支援在本機以文字或首尾幀生成影音 |
| H3-Base Ref2VA 權重 | 已公開 | 支援在本機以多模態參考素材生成影片 |
| 推論程式庫與整合 | 已公開 | 支援自架實驗和自訂管線 |
| Context-IR 實作 | 託管,非公開 | MiniMax的前處理和編排系統無法在本機修改 |
| Regenerate-2K | 不在目前版本中 | 本機H3-Base並非完整的官方2K路徑 |
| 完整訓練方法與資料 | 未列為已發布 | 此版本未建立完整的訓練可重複性 |
| 授權條款 | 自訂 Community License | 開放權重並不意味著不受限制的全球或商業使用 |
這是一次有意義的發布。它也比“完全開放原始碼”一詞所暗示的範圍更窄。
MiniMax 公開兩個針對不同任務的 H3-Base checkpoint。兩者都能生成帶有原生立體聲音訊的影片,但接受的控制方式不同。
| checkpoint | 主要工作 | 輸入 | 文件記載的本機輸出 |
|---|---|---|---|
| H3-Base FL2VA | 文字與畫面引導的生成 | 文字,可搭配零張、一張或兩張起訖圖片 | 768p 影片與音訊 |
| H3-Base Ref2VA | 多模態參考生成 | 文字加參考圖片或影片,可選擇加入音訊;音訊不能是唯一媒體輸入 | 768p 影片與音訊 |
FL2VA 指首尾幀生成影音。沒有圖片時可從文字生成影音;一張圖片可指定首幀或尾幀,兩張圖片則可指定兩端。
Ref2VA 指以參考素材生成影音。圖片、影片片段與選用音訊可以分別引導目標片段的不同部分;參考音訊必須搭配至少一張圖片或一段影片,文字則說明各素材的角色。
官方儲存庫分發原始checkpoint系列和 Diffusers 相容檔案。 MiniMax 記錄原始checkpoint的 BF16 精度。它還將發布的 Omni Transformer 權重描述為 CFG 蒸餾。
每個 checkpoint 都不只是單一 Transformer 檔案。官方 H3 模型卡列出了專門的 Omni Transformer 及其支援組件:
MiniMax 將 H3-Omni-Transformer 描述為密集型單一資料流模型,可同時預測影片與音訊的潛在表示,再由對應的 VAE 解碼成最終影音結果。
FL2VA 和 Ref2VA 權重是分開的,因為它們的工作不同。下載一個任務系列不會自動新增另一個任務系列。
完整官方系統包含三個模組,目前只有中間的生成模組開放權重。
自由格式的文字、圖片、影片與音訊脈絡
↓
Context-IR — 託管式;實作未公開
↓
H3-Base FL2VA 或 Ref2VA — 公開權重;本機 768p 流程
↓
Regenerate-2K — 目前的公開版本未包含
Context-IR 在 H3-Base 生成前,負責自由格式多模態內容的前處理與編排。
MiniMax 將 Context-IR 描述為一個多層託管系統。它的實作不是開放權重版本的一部分。開發者可以呼叫官方服務或根據MiniMax的提示指導來建立自己的前處理邏輯。
自行建立的前處理管線可以達到類似目的,但僅僅替 H3-Base 整理參考素材,並不會讓它成為官方 Context-IR 實作。
H3-Base 接收準備好的脈絡並產生具有立體聲音訊的 768p 影片。這是 MiniMax 作為 FL2VA 和 Ref2VA checkpoint發布的部分。
最初公開的推論流程使用全注意力。MiniMax 表示日後會公開稀疏注意力實作,但尚未公布日期。
Regenerate-2K 會接收 H3-Base 的 768p 結果與原始脈絡,設計上不同於傳統的獨立畫質提升工具。
該模組不在目前的公開版本中。 MiniMax 記錄了一個官方混合工作流程,該流程結合本機 H3-Base、託管式 Context-IR 與 Regenerate-2K 端點。
此混合工作流程可以產生官方 2K 路徑。它不是一個完全本機的、開放權重的 2K 管線。
在本機執行 H3-Base,可直接控制兩個已發布的生成 checkpoint,但它不會重現 MiniMax 的完整託管 H3 系統。
需要從文字生成,或用首幀、尾幀或兩者引導片段時,請選 FL2VA。需要圖片、影片與選用音訊引導身分、風格、動作、鏡頭、聲音或音效時,請選 Ref2VA。兩個 checkpoint 的本機輸出皆為 768p 影音;完整 2K 流程仍依賴開放權重套件之外的託管式元件。
MiniMax 列出了 SGLang、vLLM、Diffusers 和 ComfyUI 作為推理選項。它們提供了基於程式碼和基於節點的方法來執行或試驗已發布的checkpoint。
無論選擇哪種方式,自架都會把營運責任移交給您。您必須管理模型儲存、依賴項、運算、效能、更新、存取控制、安全措施和輸出審核。因此,本機部署不一定免費,也不一定天然具備隱私保障:成本包括硬體或託管、電力、工程時間、儲存、監控和失敗的執行,而隱私取決於您的日誌、素材儲存、存取策略、第三方節點和周邊應用程式。
H3 客製化可分為三層。前兩層不必修改模型權重;第三層則要有工程驗證並審查授權條款。
| 圖層 | 您可以合理地客製化什麼 | 目前邊界 |
|---|---|---|
| 生成 | 提示、鏡頭順序、持續時間、比率、端點幀和參考角色 | 結果仍然是機率性的;來源不保證完美的身分或運動鎖定 |
| 管線 | 前處理、參考組織、推理參數、節點、儲存、審查以及週邊應用邏輯 | 官方 Context-IR 內部仍託管;第三方節點不是 MiniMax 保證 |
| 模型 | 在授權條款允許的情況下修改發布的權重並創建衍生品 | 無官方微調配方、LoRA 訓練器、資料包、最低硬體或結果保證 |
先調整輸入規劃,不要急著修改權重。把身分、動作、攝影機與音訊參考分開,為每項素材指定明確角色,並把目標動作縮小到可檢查的範圍。
使用 FL2VA 時,先決定要固定開場構圖、結尾構圖或兩者。使用 Ref2VA 時,則要決定每個創作變數由哪項素材控制。
這些選擇可以大大改變結果。這些仍屬一般推論設定,不是模型微調。
團隊可以圍繞已發布的checkpoint建立素材驗證、提示組裝、佇列、儲存、審核、評估和重試邏輯。基於節點的工具還允許團隊向創作者提供選定的推論設定。
這一層通常提供比訓練更實際的控制。它可以標準化輸入,收集可比較的輸出,並在昂貴的推理開始之前防止無效請求。
然而,自訂前處理器不是 Context-IR。社群工作流程不代表官方效能承諾;無論用於內部或面向客戶的系統,都應記錄這些界線。
該儲存庫表示 MiniMax 發布了完整的 H3-Omni-Transformer 權重以支援進一步的開發,包括微調。該授權條款還定義並允許在其條件內使用模型衍生品。
這不代表已有可直接使用的訓練工作流程。 MiniMax 尚未發布官方 H3 微調配方、一鍵式 LoRA 訓練器、訓練資料發布或經過驗證的最小硬體路徑。
社群提供的訓練方法應視為實驗。採用前請記錄來源、版本、資料權利、輸出品質與硬體假設。
此處比較的是營運責任與模組可用性,不是選擇 H3 存取方式的一般指南。
| 決策區 | 本機 H3-Base | MiniMax 託管式服務 |
|---|---|---|
| 基礎設施 | 您操作模型檔案並進行推理 | MiniMax 營運託管式服務 |
| 情境處理 | 不包括 Context-IR 實作;建置前處理或呼叫託管式服務 | Context-IR 可透過託管式服務取得 |
| 輸出路徑 | 基本生成為768p;官方混合2K路徑仍呼叫託管模組 | 端對端API提供768P和2K |
| 客製化 | 基礎設施、管線和允許的權重修改 | 請求和應用邏輯 |
| 主要職責 | 部署、安全、維護和授權條款合規性 | API 整合、輸出處理和服務條款 |
MiniMax H3 社群授權條款適用於已公開資料。這是自訂授權,而不是 MIT 或 Apache 這類標準寬鬆授權。
本摘要僅供一般資訊參考,並非法律建議。請查看現行授權條款,並依您的情況尋求合格的專業建議。
該授權條款將其適用區域定義為全球範圍內,但四個排除區域除外:歐盟、英國、韓國和美國。
其對已發布 H3 資料的授權只適用於 Applicable Territory。排除地區的組織可以向 MiniMax 申請正式授權條款。
領土限制也適用於 H3 Works 及其產出或結果。該協議不授權其在適用區域之外使用、複製、修改、散佈或展示。
MiniMax 的官方授權問答對託管式 API 的描述有所不同。它表示該 API 在全球範圍內可用,並有供應商運營的保障措施。
如果沒有這種區別,請勿直接把原始權重的地域規則套用到託管式 API。 API 使用者仍須遵守平台條款和適用法律。
該授權條款規定,當商業產品和服務年收入超過 2000 萬美元時,需要事先書面授權。這段文字並不是單指公司總收入。
使用H3或H3作品的商業產品或服務必須顯著展示 MiniMax H3 在他們的使用者界面中。單獨的短語 Powered by MiniMax H3 顯示為鼓勵性措辭,而不是相同的強制顯示規則。
閾值並不是唯一的條件。領土、可接受的使用、保障措施、下游條款、通知和第三方權利也適用。
散布時必須把協議一併提供給接收者。修改的檔案需要顯著的修改通知。非託管發行版也需要指定的授權條款 NOTICE 檔案。
託管產品必須使使用者遵守保護條款並採取合理的保護措施。可接受的使用政策也要求對公開環境中的內容進行明確的機器生成揭露。
MiniMax 對授權下產生的輸出不享有任何權利。使用者仍然對輸出、後期使用和第三方權利負責。
MiniMax 並未在模型卡中發布 H3-Base 的通用最低 GPU 要求。其 SGLang 指令顯示了四 GPU 部署範例,但範例並非最低限度。
官方儲存庫還列出了幾種執行時和部署方法。不同的框架、精度選擇、量化、解析度和剪輯長度會改變記憶體和速度。
ComfyUI 教學使用最佳化的模型檔案和本機節點。但文件仍未把任何單一消費級 GPU 定為所有 H3 工作流程的官方基準。
在購買硬體之前,請測試您計劃執行的確切checkpoint和工作流程。記錄軟體版本、精度、量化、峰值 VRAM、生成時間和輸出品質。
避免將一個社群基準變成一項普遍要求。runtime 或量化方式一變,硬體需求資訊很快就會過時。
執行checkpoint只是採用開放權重模型的一部分。在將 H3-Base 設為生產依賴項之前,請確認特定用例的模型範圍、授權條件和操作要求:
MiniMax H3 介面展示和發布通知。模型檔案和授權條款可能會更改。保留每個生產決策所使用的確切版本的副本。
不是。H3-Base FL2VA 與 H3-Base Ref2VA 已公開權重,但完整系統並未公開;自訂 Community License 也限制可使用的地區與方式。
可下載 H3-Base FL2VA 與 H3-Base Ref2VA。FL2VA 涵蓋文字與首尾幀任務,Ref2VA 用於參考素材引導的影音生成。
目前只靠開放權重版本不行。H3-Base 輸出 768p;官方 2K 流程使用託管式 Regenerate-2K 階段與原始生成脈絡。
已公開權重可在授權範圍內修改並建立衍生作品,但 MiniMax 尚未發布官方 H3 微調方法或一鍵 LoRA 訓練流程。
MiniMax 沒有指定通用的最低 GPU 需求。文件範例與支援的 runtime 只能作為起點,無法保證所有 checkpoint、精度與影片設定。
授權在 Applicable Territory 與各項條件下提供權利,並包含額外商業條款。使用前應檢查地區、營收門檻、介面顯示、聲明、安全措施與可接受使用義務。
權重的標準 Community License 排除這些地區,但組織可申請正式授權。MiniMax 官方 Q&A 則把託管式 API 描述為設有安全措施的全球服務。
MiniMax H3 的公開權重讓本機推論與授權範圍內的客製化成為可能,但不代表所有模組、地區或用途都不受限制。投入基礎設施前,請比較營運與授權負擔。
MiniMax H3 已正式發布,但目前尚未在 DomoAI 上線。H3 即將接入 DomoAI;在 DomoAI 可用後,我們會再公布消息。
最近的文章