100% 免費示範存取
開啟嵌入式參考 Space,體驗可用的 MiniMax H3 工作流程,無須向 Free Video AI 付費、購買點數或在此訂閱。

透過嵌入式示範完全免費使用 MiniMax H3,接著探索官方範例和開源 H3-Base 部署方式。利用文字、圖像、影片和音訊情境、原生立體聲,以及完整 H3 工作流程中最高 2K 的輸出建立多模態影片。
直接在下方試用由社群託管的 MiniMax H3 參考介面。Free Video AI 不會對此嵌入式體驗收取點數、訂閱費或存取費。
此示範由外部 Hugging Face Space 託管及營運。提示詞和上傳的參考素材由該服務處理,而非在 Free Video AI 本機處理。可用性、佇列、限制、內容審核和資料處理均由 Space 提供者控制。
在新分頁開啟示範H3 將多模態理解、影片生成、編輯和同步音訊統一至一套通用系統,不必將每項創意任務拆分給不同模型。
開啟嵌入式參考 Space,體驗可用的 MiniMax H3 工作流程,無須向 Free Video AI 付費、購買點數或在此訂閱。
描述文字、圖像、參考影片和音訊與目標之間的關係。H3 旨在理解完整關聯,而不是各自獨立處理每項輸入。
在文件所述的 H3 系統中,以原生 32 kHz 立體聲輸出同步生成畫面和聲音,包括對白、環境音效和音樂。
官方規格涵蓋 4–15 秒輸出、24 FPS,以及常見的橫向、方形、直向和電影畫幅比例。
完整 H3 流程可在 2K 下重新生成 768p 基礎結果,同時重用原始多模態情境,以還原更忠實的細緻內容。
開發者可下載 FL2VA 和 Ref2VA H3-Base 檢查點、檢視實作內容,並建置自行託管的 768p 生成工作流程。
透過 Flaq AI 提供的三種專用端點,將免費實驗延伸至可重複執行的正式工作流程,分別支援文字、圖片與多模態參考生成影片。
正在尋找 Seedance 2.0 的替代方案嗎?MiniMax H3 將多模態控制、原生音訊、開放的 H3-Base 權重及正式環境 API 選項整合於靈活的工作流程中。
以提示詞引導的動作、同步音訊及代管式 API 工作流程讓來源圖片動起來,適合商品展示、人物肖像、廣告與視覺概念。
透過穩定端點,直接從詳細提示詞生成影音片段,適用於可重複執行的創意自動化與可擴充的影片製作。
當正式製作需要比純提示詞生成更精細的控制時,可利用多模態參考素材引導角色一致性、視覺風格、動作、語音及聲音。
API 可用性、價格、速率限制與模型行為由 Flaq AI 提供,並可能有所變更。用於正式環境前,請先查閱最新的 API 文件與價格資訊。
這些可重現的 768p 輸出來自 MiniMax H3 官方 GitHub 儲存庫,展示三種核心生成模式。
範例影片由 MiniMax-AI 在 MiniMax-H3 儲存庫中提供。結果會因提示詞、參考素材、檢查點、推論設定、硬體和工作流程而異。
文件所述的 H3 系統將深入情境解讀、基礎音訊影片生成和高解析度再生成分開,同時在整個工作流程中保留原始創意情境。

語言成為提示詞與混合媒體之間的橋樑,用來描述主體、鏡頭、動態、聲音及目標輸出之間的關係。
託管的預處理系統理解自由形式的多模態指令,並將其轉換成用於生成的結構化表示。
開放基礎模型透過通用 H3-Omni Transformer 聯合預測視覺和音訊潛變量,並生成 768p 音訊影片輸出。
最終模組會重用基礎結果和原始情境來重新生成更高解析度的細節,而不只是套用傳統超解析度。
使用單一多模態工作流程探索商業概念、敘事場景、品牌設計、動作參考和同步音訊影片構想。
憑藉更強的指令遵循和文字呈現能力,為產品廣告、行銷活動概念、發布視覺、商品陳列畫面和社群廣告製作原型。
在製作前,將場景描述、角色圖像、動作參考和聲音指導轉換成短篇電影化試片。
探索動態品牌識別、產品網站概念、片頭序列、動態海報和品牌視覺系統。
轉移動作、保留主體、參考視覺風格,或運用音訊和影片情境描述特定轉換。
依循不同藝術方向創作角色片段、遊戲開場、風格化 3D 短片、動態海報和視覺實驗。
測試短篇音訊影片概念;文件指出其可穩定支援 11 種語言的對白,其他語言則有不同品質表現。
從嵌入式示範開始,明確說明各項參考素材之間的創意關係,並檢查完整的音訊影片結果。
開啟嵌入式 Space,選擇可用的文字、首尾幀或多模態參考工作流程。
撰寫精確提示詞並加入支援的參考素材。說明哪些圖像、影片、語音、動作、聲音或風格應影響目標結果。
提交任務、等待託管佇列,接著檢查動作、主體一致性、文字、對白、音效、音樂和整體指令遵循效果。
官方儲存庫提供 FL2VA 和 Ref2VA 檢查點,以及 SGLang、vLLM、diffusers 和 ComfyUI 的使用方案。先從本機 768p H3-Base 工作流程開始,驗證硬體和使用情境後再擴充。
hf download MiniMaxAI/MiniMax-H3 \
--include "model_index.json" "FL2VA/*" \
--local-dir MiniMax-H3
sglang serve \
--model-path MiniMaxAI/MiniMax-H3 \
--num-gpus 4 --ulysses-degree 4 \
--performance-mode speed \
--host 0.0.0.0 --port 30010 \
--model-variant fl2va
下載模型權重前,請閱讀 Community License、儲存庫指南、檢查點大小及特定框架的 GPU 需求。
文字和首尾幀生成請使用 FL2VA;工作流程需要混合圖像、影片和音訊參考時則使用 Ref2VA。
將 Hugging Face 下載範圍限定為一個任務系列,或讓 diffusers 取得所需元件,以減少儲存空間和設定時間。
啟動所選框架、重現一個官方案例、比較音訊影片輸出,再決定是否整合託管的 2K 工作流程。
重要:開放權重並不表示 GPU 運算免費。部署前請閱讀 MiniMax H3 Community License。目前開放版本包含 H3-Base,而 H3-Context-IR 和 H3-Regenerate-2K 是完整官方 2K 工作流程使用的託管元件。
生成 H3 片段後,可使用工具套件的其他功能在本機提高其工作解析度、修正方向,或剪輯更短的精華片段。
繼續閱讀介紹發布資訊、開放實作、檢查點、工作流程和模型授權的一手資料。