為什麼你該學這招?
你是不是也覺得AI影片生成聽起來很酷,但實際操作起來卻像在解謎?每次看到別人用AI做出超有質感的影片,自己卻連模型都載不下來,只能默默關掉分頁?
別擔心,這篇文章就是要幫你打破這個門檻。MiniMax-H3是最近在HuggingFace上爆紅的影片生成模型,一週內就衝到三千多個讚,下載量超過兩萬六千次。為什麼它這麼受歡迎?因為它把過去需要專業團隊才能完成的影片製作,濃縮成「打一行字、按一個鍵」的簡單動作。
接下來,我會用最白話的方式,帶你從零開始跑一次完整的流程。你不用懂程式碼,不用有高階顯卡,甚至不用知道「擴散模型」是什麼鬼——只要跟著步驟做,五分鐘內就能看到自己親手生成的AI影片。
MiniMax-H3到底是什麼?
為什麼它跟其他模型不一樣?
先講結論:MiniMax-H3是目前少數「同時支援文字轉影片」和「圖片轉影片」的開源模型。意思是,你可以只輸入一段文字描述,它就能生成對應的影片;也可以丟一張圖片給它,讓它把靜態畫面變成動態場景。
這對一般使用者來說超實用。舉例來說,你手上有張產品照片,想做成15秒的宣傳短片放在IG上——過去你得學After Effects或Premiere,花好幾個小時;現在只要把照片丟給MiniMax-H3,輸入「產品在桌上緩慢旋轉,背景有柔和的光線變化」,它就幫你搞定。
另一個亮點是它跟ComfyUI的整合度非常高。ComfyUI是目前最流行的AI繪圖介面之一,很多人已經在用它的節點式工作流程。MiniMax-H3可以直接掛進ComfyUI裡,讓你在同一個介面中完成「生圖→生影片」的完整流程,不用跳來跳去。
第一步:先準備好你的工具
我需要買貴鬆鬆的顯示卡嗎?
很多人聽到「AI影片生成」就以為需要頂級顯卡,其實不盡然。MiniMax-H3有幾個不同的使用方式,你可以根據自己的設備來選擇:
方式一:直接線上試玩(最簡單)
如果你只是想快速體驗,HuggingFace上有官方提供的試玩空間(Demo Space)。你只需要一個免費帳號,就能在瀏覽器上直接輸入提示詞、生成影片。不用安裝任何東西,也不用管顯卡規格。缺點是排隊時間有時比較長,而且有生成次數限制。
方式二:用ComfyUI跑(推薦給想認真玩的人)
如果你已經有ComfyUI,可以透過「Comfy-Org/MiniMax-H3」這個整合包來使用。這個版本的特別之處在於它把模型轉成單一檔案(diffusion-single-file),下載後直接拖進ComfyUI就能用,不用另外安裝外掛或調整一堆參數。
方式三:本機跑(需要一定硬體)
如果你有8GB以上VRAM的顯示卡(例如RTX 3060以上),可以考慮直接下載模型權重在本機執行。這樣的好處是沒有使用次數限制,也能完全掌控生成過程。但如果你是新手,建議先從方式一或方式二開始。
第二步:寫出會讓AI聽話的提示詞
為什麼我寫的提示詞AI都聽不懂?
這應該是最多人卡關的地方。你可能輸入「做一個很酷的影片」,結果跑出來一個莫名其妙的畫面,然後就放棄了。其實不是AI笨,而是它需要更「具體」的指令。
寫提示詞有一個黃金公式:主體+動作+場景+氛圍+鏡頭語言。
舉個例子,如果你想做一個「夕陽下的城市」影片,不要只寫「城市影片」,而是寫:
「空拍鏡頭從高樓大廈上方俯瞰,夕陽將整座城市染成金黃色,車流在街道上緩緩移動,雲層緩慢流動,畫面溫暖而寧靜,4K畫質,電影感。」
看出差別了嗎?後者告訴AI「鏡頭怎麼拍」(空拍、俯瞰)、「畫面裡有什麼」(高樓、車流、雲層)、「色調是什麼」(金黃、溫暖)、「整體氛圍如何」(寧靜、電影感)。AI收到的資訊越豐富,生成的影片就越接近你腦中的畫面。
這裡再給你三個可以直接複製的模板:
模板一:食物宣傳片 「特寫鏡頭,剛出爐的麵包放在木桌上,奶油慢慢融化,蒸氣裊裊上升,背景是溫馨的咖啡廳,暖色燈光,畫面誘人,淺景深效果。」
模板二:產品展示 「產品從黑色背景中緩緩浮現,360度旋轉展示,表面有光澤反射,科技感光影效果,簡潔專業,商業廣告風格。」
模板三:自然風景 「延時攝影,山谷中的雲海翻湧,陽光穿透雲層灑落,樹林隨風搖曳,鳥群飛過畫面,清新自然,高動態範圍。」
第三步:實際操作流程
到底要按哪幾個鍵?
好,現在我們來實際走一遍。以ComfyUI為例,整個流程大概分五個步驟:
1. 下載並安裝ComfyUI
如果你還沒裝,先去ComfyUI官網下載桌面版。安裝過程很直覺,就像安裝一般軟體一樣,下一步下一步就完成了。
2. 載入MiniMax-H3工作流程
到ComfyUI的官方工作流程庫,搜尋「MiniMax-H3」,下載對應的JSON檔案。然後在ComfyUI介面中,把這個檔案拖進去,它會自動載入所有需要的節點。
3. 輸入提示詞
在畫面中找到「CLIP Text Encode」節點,把你的提示詞貼進去。記得在「Positive」的地方貼你想看到的內容,如果你想指定不要出現什麼(例如「不要有文字浮水印」),就貼在「Negative」的位置。
4. 設定參數
一般來說,你只需要調整三個參數:解析度(建議先從720p開始試)、幀數(決定影片長度,30幀約等於1秒)、步數(建議設在20-30之間,太高會跑很久,太低畫質會變差)。其他參數先保持預設就好。
5. 按下執行
點擊「Queue Prompt」按鈕,剩下的就交給電腦。第一次跑可能要等幾分鐘,這是正常的,因為它要下載模型檔案。之後再跑就會快很多。
跑完之後,在「Save Video」節點的地方就能看到你的影片檔案。通常會存成MP4格式,可以直接上傳到社群媒體或剪進你的專案裡。
常見問題
Q: MiniMax-H3跟其他影片生成模型比起來,有什麼優勢? A: 最大的優勢是它的「單一檔案」設計,讓它在ComfyUI上安裝超簡單,不用處理一堆依賴套件。而且它同時支援文字轉影片和圖片轉影片,一個模型兩種用途,對新手來說CP值很高。
Q: 我的顯示卡只有4GB VRAM,跑得動嗎? A: 4GB VRAM比較勉強,建議先從HuggingFace的線上試玩開始。如果真的想在本機跑,可以試試看把解析度降到480p,幀數減少,但畫質會明顯下降。老實說,如果預算允許,升級到8GB VRAM的顯卡體驗會好非常多。
Q: 生成的影片有浮水印嗎? A: 如果你用HuggingFace的線上試玩,生成的影片會有官方浮水印。但在ComfyUI本機跑的話,完全沒有浮水印,可以自由使用生成的內容。
Q: 提示詞要用英文寫還是中文寫? A: 建議用英文寫,因為模型訓練資料以英文為主,英文提示詞的效果通常比較好。如果你英文不太好,可以先寫中文再用翻譯軟體轉成英文,重點是把細節描述清楚。
Q: 為什麼我生成的影片人物臉部會扭曲? A: 這是目前所有AI影片模型的通病,尤其在人臉特寫或快速動作時特別明顯。建議可以加入「穩定臉部」或「減少快速移動」這類關鍵字,或者把生成步數調高一點,都能稍微改善這個問題。
延伸閱讀
總結:你其實離AI影片大師只差一步
回顧一下,我們今天學會了三件事:第一,MiniMax-H3是什麼、為什麼它值得你花時間學;第二,怎麼寫出讓AI聽話的提示詞,讓生成的影片符合你的期待;第三,實際在ComfyUI上跑一遍完整的生成流程。
其實AI影片生成沒有想像中那麼遙不可及。你不需要懂深度學習,不需要會寫程式,只要有基本的電腦操作能力,加上一點點耐心,就能創作出過去需要專業團隊才能完成的內容。下次當你看到別人的IG限動有超酷的動態影片時,你就能自信地說:「這個我也會做!」
現在就打開電腦試試看吧。第一次跑出來的結果可能不完美,但每一次調整提示詞、每一次微調參數,都是在往更好的作品邁進。等你做出第一個滿意的影片時,你會發現——原來創作可以這麼簡單。