為什麼你該學這招?

你是不是也覺得AI影片生成聽起來很酷,但實際操作起來卻像在解謎?每次看到別人用AI做出超有質感的影片,自己卻連模型都載不下來,只能默默關掉分頁?

別擔心,這篇文章就是要幫你打破這個門檻。MiniMax-H3是最近在HuggingFace上爆紅的影片生成模型,一週內就衝到三千多個讚,下載量超過兩萬六千次。為什麼它這麼受歡迎?因為它把過去需要專業團隊才能完成的影片製作,濃縮成「打一行字、按一個鍵」的簡單動作。

接下來,我會用最白話的方式,帶你從零開始跑一次完整的流程。你不用懂程式碼,不用有高階顯卡,甚至不用知道「擴散模型」是什麼鬼——只要跟著步驟做,五分鐘內就能看到自己親手生成的AI影片。

MiniMax-H3到底是什麼?

為什麼它跟其他模型不一樣?

先講結論:MiniMax-H3是目前少數「同時支援文字轉影片」和「圖片轉影片」的開源模型。意思是,你可以只輸入一段文字描述,它就能生成對應的影片;也可以丟一張圖片給它,讓它把靜態畫面變成動態場景。

這對一般使用者來說超實用。舉例來說,你手上有張產品照片,想做成15秒的宣傳短片放在IG上——過去你得學After Effects或Premiere,花好幾個小時;現在只要把照片丟給MiniMax-H3,輸入「產品在桌上緩慢旋轉,背景有柔和的光線變化」,它就幫你搞定。

另一個亮點是它跟ComfyUI的整合度非常高。ComfyUI是目前最流行的AI繪圖介面之一,很多人已經在用它的節點式工作流程。MiniMax-H3可以直接掛進ComfyUI裡,讓你在同一個介面中完成「生圖→生影片」的完整流程,不用跳來跳去。

第一步:先準備好你的工具

我需要買貴鬆鬆的顯示卡嗎?

很多人聽到「AI影片生成」就以為需要頂級顯卡,其實不盡然。MiniMax-H3有幾個不同的使用方式,你可以根據自己的設備來選擇:

方式一:直接線上試玩(最簡單)

如果你只是想快速體驗,HuggingFace上有官方提供的試玩空間(Demo Space)。你只需要一個免費帳號,就能在瀏覽器上直接輸入提示詞、生成影片。不用安裝任何東西,也不用管顯卡規格。缺點是排隊時間有時比較長,而且有生成次數限制。

方式二:用ComfyUI跑(推薦給想認真玩的人)

如果你已經有ComfyUI,可以透過「Comfy-Org/MiniMax-H3」這個整合包來使用。這個版本的特別之處在於它把模型轉成單一檔案(diffusion-single-file),下載後直接拖進ComfyUI就能用,不用另外安裝外掛或調整一堆參數。

方式三:本機跑(需要一定硬體)

如果你有8GB以上VRAM的顯示卡(例如RTX 3060以上),可以考慮直接下載模型權重在本機執行。這樣的好處是沒有使用次數限制,也能完全掌控生成過程。但如果你是新手,建議先從方式一或方式二開始。

第二步:寫出會讓AI聽話的提示詞

為什麼我寫的提示詞AI都聽不懂?

這應該是最多人卡關的地方。你可能輸入「做一個很酷的影片」,結果跑出來一個莫名其妙的畫面,然後就放棄了。其實不是AI笨,而是它需要更「具體」的指令。

寫提示詞有一個黃金公式:主體+動作+場景+氛圍+鏡頭語言

舉個例子,如果你想做一個「夕陽下的城市」影片,不要只寫「城市影片」,而是寫:

「空拍鏡頭從高樓大廈上方俯瞰,夕陽將整座城市染成金黃色,車流在街道上緩緩移動,雲層緩慢流動,畫面溫暖而寧靜,4K畫質,電影感。」

看出差別了嗎?後者告訴AI「鏡頭怎麼拍」(空拍、俯瞰)、「畫面裡有什麼」(高樓、車流、雲層)、「色調是什麼」(金黃、溫暖)、「整體氛圍如何」(寧靜、電影感)。AI收到的資訊越豐富,生成的影片就越接近你腦中的畫面。

這裡再給你三個可以直接複製的模板:

模板一:食物宣傳片 「特寫鏡頭,剛出爐的麵包放在木桌上,奶油慢慢融化,蒸氣裊裊上升,背景是溫馨的咖啡廳,暖色燈光,畫面誘人,淺景深效果。」

模板二:產品展示 「產品從黑色背景中緩緩浮現,360度旋轉展示,表面有光澤反射,科技感光影效果,簡潔專業,商業廣告風格。」

模板三:自然風景 「延時攝影,山谷中的雲海翻湧,陽光穿透雲層灑落,樹林隨風搖曳,鳥群飛過畫面,清新自然,高動態範圍。」

第三步:實際操作流程

到底要按哪幾個鍵?

好,現在我們來實際走一遍。以ComfyUI為例,整個流程大概分五個步驟:

1. 下載並安裝ComfyUI

如果你還沒裝,先去ComfyUI官網下載桌面版。安裝過程很直覺,就像安裝一般軟體一樣,下一步下一步就完成了。

2. 載入MiniMax-H3工作流程

到ComfyUI的官方工作流程庫,搜尋「MiniMax-H3」,下載對應的JSON檔案。然後在ComfyUI介面中,把這個檔案拖進去,它會自動載入所有需要的節點。

3. 輸入提示詞

在畫面中找到「CLIP Text Encode」節點,把你的提示詞貼進去。記得在「Positive」的地方貼你想看到的內容,如果你想指定不要出現什麼(例如「不要有文字浮水印」),就貼在「Negative」的位置。

4. 設定參數

一般來說,你只需要調整三個參數:解析度(建議先從720p開始試)、幀數(決定影片長度,30幀約等於1秒)、步數(建議設在20-30之間,太高會跑很久,太低畫質會變差)。其他參數先保持預設就好。

5. 按下執行

點擊「Queue Prompt」按鈕,剩下的就交給電腦。第一次跑可能要等幾分鐘,這是正常的,因為它要下載模型檔案。之後再跑就會快很多。

跑完之後,在「Save Video」節點的地方就能看到你的影片檔案。通常會存成MP4格式,可以直接上傳到社群媒體或剪進你的專案裡。

常見問題

Q: MiniMax-H3跟其他影片生成模型比起來,有什麼優勢? A: 最大的優勢是它的「單一檔案」設計,讓它在ComfyUI上安裝超簡單,不用處理一堆依賴套件。而且它同時支援文字轉影片和圖片轉影片,一個模型兩種用途,對新手來說CP值很高。

Q: 我的顯示卡只有4GB VRAM,跑得動嗎? A: 4GB VRAM比較勉強,建議先從HuggingFace的線上試玩開始。如果真的想在本機跑,可以試試看把解析度降到480p,幀數減少,但畫質會明顯下降。老實說,如果預算允許,升級到8GB VRAM的顯卡體驗會好非常多。

Q: 生成的影片有浮水印嗎? A: 如果你用HuggingFace的線上試玩,生成的影片會有官方浮水印。但在ComfyUI本機跑的話,完全沒有浮水印,可以自由使用生成的內容。

Q: 提示詞要用英文寫還是中文寫? A: 建議用英文寫,因為模型訓練資料以英文為主,英文提示詞的效果通常比較好。如果你英文不太好,可以先寫中文再用翻譯軟體轉成英文,重點是把細節描述清楚。

Q: 為什麼我生成的影片人物臉部會扭曲? A: 這是目前所有AI影片模型的通病,尤其在人臉特寫或快速動作時特別明顯。建議可以加入「穩定臉部」或「減少快速移動」這類關鍵字,或者把生成步數調高一點,都能稍微改善這個問題。

延伸閱讀

總結:你其實離AI影片大師只差一步

回顧一下,我們今天學會了三件事:第一,MiniMax-H3是什麼、為什麼它值得你花時間學;第二,怎麼寫出讓AI聽話的提示詞,讓生成的影片符合你的期待;第三,實際在ComfyUI上跑一遍完整的生成流程。

其實AI影片生成沒有想像中那麼遙不可及。你不需要懂深度學習,不需要會寫程式,只要有基本的電腦操作能力,加上一點點耐心,就能創作出過去需要專業團隊才能完成的內容。下次當你看到別人的IG限動有超酷的動態影片時,你就能自信地說:「這個我也會做!」

現在就打開電腦試試看吧。第一次跑出來的結果可能不完美,但每一次調整提示詞、每一次微調參數,都是在往更好的作品邁進。等你做出第一個滿意的影片時,你會發現——原來創作可以這麼簡單。