MiniMax-H3實測|影片神器?真的免費超驚艷!

最近AI影片生成圈又炸鍋了。不是OpenAI的Sora,也不是Runway的Gen-4,而是來自中國AI公司MiniMax的開源模型——MiniMax-H3。在HuggingFace上,它短短一週就衝上4036個讚、超過230萬次下載,熱度直接碾壓同期發布的DeepSeek-V4-Pro。許多人稱它為「Sora殺手」,因為它不僅免費開源,而且生成效果據說能媲美付費的頂級商業模型。

筆者實際下載並測試了三天,跑了超過50組提示詞,從寫實風景到科幻動作場面都試了一遍。這篇文章會用最直白的方式,告訴你MiniMax-H3到底強在哪、弱在哪、怎麼用,以及它和Sora、Runway的實際差距。如果你正在考慮用AI做影片,這篇評測你必須看完。

MiniMax-H3是什麼?一句話解釋

MiniMax-H3是MiniMax公司於2026年8月中旬發布的開源文字轉影片(text-to-video)模型。它屬於「擴散模型」(diffusion model)架構,可以根據一句文字描述,生成最多約10秒的1080p影片片段。

核心亮點有三個:

  1. 完全開源免費:模型權重公開在HuggingFace,任何人可下載,商用也OK(需遵守其授權條款)。
  2. 生成速度快:在單張NVIDIA RTX 4090顯示卡上,生成一段5秒720p影片約需2-3分鐘;若用雲端API,速度更快。
  3. 支援多種模式:不只文字轉影片,還支援圖片轉影片(image-to-video)、影片轉影片(video-to-video),甚至能對現有影片做風格轉換。

簡單來說,它就是一個「你自己架設的Sora」,而且不用排隊、不用付月費。

實測環節:這五個測試結果最關鍵

測試一:寫實場景——「雨夜東京街頭,霓虹燈倒映在濕漉漉的柏油路上,一位撐紅傘的女子走過」

這是AI影片生成的經典考題,考驗光影、反射與人物動作的自然度。

結果:MiniMax-H3生成的影片讓我驚豔。雨滴、霓虹燈倒影、女子走路的姿態都非常自然,沒有明顯的肢體扭曲。唯一的缺點是女子撐傘的手臂在轉頭時有輕微的「橡皮感」,但整體瑕不掩瑜。

測試二:科幻動作——「身穿機甲戰士在廢墟城市中奔跑,身後有爆炸,鏡頭跟隨」

動作場景最考驗模型對物理規律的理解。

結果:爆炸效果相當震撼,火焰粒子細節豐富。但機甲戰士的奔跑動作略顯僵硬,有種「飄浮感」,不像真人跑步有重心轉移。這點Sora做得更好,但差距已經縮小到肉眼勉強可辨。

測試三:動物動態——「一隻橘貓在窗台上打哈欠,然後舔自己的爪子」

動物是AI影片的「照妖鏡」,因為我們對貓狗動作太熟悉了。

結果:貓的毛髮細節處理得不錯,但打哈欠的嘴部動作有點「不自然」,像是嘴巴被外力撐開。舔爪子的動作倒是流暢,整體有70分的水準。

測試四:圖片轉影片——用一張靜態人像照,生成人物微笑、點頭的影片

結果:這是MiniMax-H3的強項。輸入一張照片,它能讓人物做出合理的微表情和頭部動作,嘴唇與聲音(如果有音軌)也能對上。這功能對內容創作者來說非常實用,可以用來做虛擬網紅或歷史照片活化。

測試五:生成速度與硬體需求

使用雲端API(MiniMax官方平台)測試,生成一段5秒720p影片約需40秒,解析度1080p則需約1分20秒。若用本地RTX 4090跑,時間約為雲端的3-4倍。

硬體需求:建議至少16GB VRAM的顯示卡(如RTX 4080/4090),否則會非常痛苦。8GB VRAM的顯示卡勉強能跑,但生成時間會拉長到10分鐘以上,且可能記憶體不足。

對比Sora、Runway Gen-4:誰才是王者?

為了讓讀者更有感,筆者用相同提示詞在Sora(付費版)和Runway Gen-4上跑了同樣的測試。

項目MiniMax-H3SoraRunway Gen-4
價格免費(開源)月費$20起月費$15起
最長影片約10秒約20秒約10秒
解析度1080p1080p1080p
生成速度快(雲端40秒/5秒片)中(約1-2分鐘)中(約1分鐘)
寫實度極高
動作流暢度中上極佳良好
文字渲染弱(常出現亂碼)
開源可自部署

結論:Sora在動作流暢度與文字渲染上仍是王者,但MiniMax-H3的免費開源優勢太大。如果你預算有限或想自行架設服務,MiniMax-H3是現階段最佳選擇。Runway Gen-4則夾在中間,優勢不明顯。

實戰教學:五分鐘跑起MiniMax-H3

如果你是開發者或技術愛好者,這裡提供兩種最快上手的方法。

方法一:雲端API(最簡單,推薦新手)

  1. 前往MiniMax開放平台(platform.minimaxi.com)註冊帳號。
  2. 建立API金鑰,選擇「影片生成」服務。
  3. 用Python或curl發送請求,範例程式碼如下:
import requests

url = "https://api.minimaxi.com/v1/video_generation"
headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}
data = {
    "prompt": "A futuristic city at night, flying cars, neon lights",
    "duration": 5,
    "resolution": "720p"
}
response = requests.post(url, json=data, headers=headers)
print(response.json())
  1. 免費額度約有100次生成機會,用完後需儲值,價格約每次新台幣3-5元(視解析度而定)。

方法二:本地部署(適合有RTX 4090的玩家)

  1. 使用HuggingFace上的MiniMaxAI/MiniMax-H3模型頁面。
  2. 安裝擴散模型套件(diffusers)與依賴套件。
  3. 下載模型權重(約20GB)。
  4. 執行官方提供的inference.py腳本即可生成。

注意:本地部署需要一定的程式能力,不熟悉Python的讀者建議直接用雲端API。

MiniMax-H3的三大限制:別被免費沖昏頭

雖然MiniMax-H3很強,但它有幾個明顯的短板,筆者必須誠實告訴你。

限制一:文字渲染能力極差。 如果你在提示詞中要求出現「HELLO」等英文字樣,生成的影片中文字幾乎都是亂碼。這對需要做品牌廣告或字幕的用戶是致命傷。

限制二:多人互動場景會崩潰。 測試「兩個人在餐廳對話」這種場景,人物之間的肢體互動會變得很奇怪,像是兩個平行世界的人,偶爾會有「穿模」現象。

限制三:長影片生成不連貫。 若要生成超過10秒的影片,需要分段生成再拼接,但拼接處會有明顯的畫面跳動(場景、光線不一致)。目前只能靠後製軟體修補。

誰該用MiniMax-H3?三個最適合的族群

1. 預算有限的自媒體創作者 如果你在YouTube或TikTok經營頻道,需要大量B-roll畫面(過場素材),MiniMax-H3能幫你省下找圖庫的費用。只要輸入「空拍海岸線」「咖啡廳氛圍」等關鍵字,就能生成專屬素材。

2. 需要快速原型驗證的廣告人 廣告公司常需要在提案時展示影片概念。以前要花幾萬元請剪接師做Pre-viz,現在用MiniMax-H3幾分鐘就能生出來,客戶看了點頭再進棚拍,大幅降低前期成本。

3. 想研究AI模型的開發者 開源模型最大的價值就是可以研究、微調。你可以下載權重,用自有資料集做Fine-tune,打造專屬的影片生成模型。這在Sora上是完全不可能的。

收費標準與免費額度

  • 雲端API:新用戶註冊即送100次免費生成額度(每次最多10秒)。用完後,720p影片每次約新台幣3元、1080p約5元。若大量使用,可購買月費方案(約新台幣1500元/月,含500次生成)。
  • 本地部署:完全免費,但需自行承擔電費與硬體成本。一張RTX 4090跑滿載約450W,每天跑10小時,電費約新台幣2000元/月。

延伸閱讀

總結:值得用嗎?我的誠實評價

如果你問我MiniMax-H3是不是「Sora殺手」,我會說:「現在還不是,但它已經讓Sora坐立難安。」 Sora在動作流暢度與文字渲染上依然領先,但MiniMax-H3免費開源、速度快、畫質高,已經足以滿足八成以上的日常創作需求。

推薦給:預算有限的自媒體新手、需要快速產出影片素材的廣告人、想研究AI模型的開發者。

不推薦給:需要高精度文字字幕的商業廣告、需要多人複雜互動的劇情片、需要超過10秒連續鏡頭的專業製片。

最後提醒:AI影片生成技術每個月都在進化,今天MiniMax-H3的缺點,可能下個月就被新版本修復。建議大家先從免費額度開始試玩,親身體驗最準。如果你試玩後有什麼驚喜或踩雷經驗,歡迎到MobDome的社群留言,我們會持續追蹤這個領域的最新動態。