你是否曾經想過,如果有一個像 ChatGPT 一樣聰明、但完全不用付月費、資料也不會傳到雲端的 AI 助手,那該有多好?
今天,這個夢想成真了。Google 在 Hugging Face 上開源了他們最新的 Gemma 4 系列模型,包含 12B 參數的輕量版本。這意味著,你只需要一台普通的電腦,就能跑起這個號稱「Google 最強開源 AI」的模型,完全離線,完全免費。
這篇文章將帶你一步步完成設定。你不需要是高階工程師,只要會打開終端機(命令提示字元),就能在 15 分鐘內擁有自己的私人 AI 助理。準備好了嗎?讓我們開始吧!
為什麼你該在本機跑 Gemma 4?
在開始之前,先問你一個問題:你每次用 ChatGPT 或 Claude 時,會不會有點擔心自己的對話紀錄被拿去訓練模型?或者,你有沒有遇過網路不穩、伺服器忙碌,AI 回話慢得像烏龜一樣?
在本機(Local)執行 AI 模型,最大的好處就是 隱私 和 速度。所有資料都留在你的硬碟裡,不需要連上網際網路。對於處理機密文件、個人日記、或是寫作草稿來說,這點非常重要。
其次,Gemma 4 是 Google 最新的開源模型,在推理和程式碼生成上表現非常出色。它甚至支援「圖像+文字」的多模態輸入(雖然我們今天主要講文字),讓你能夠上傳圖片讓它分析。更棒的是,它 完全免費,沒有任何使用次數限制。
第一步:安裝 Ollama,你的 AI 管家
要讓 Gemma 4 在你的電腦上跑起來,最簡單的工具就是 Ollama。它就像一個 AI 模型的下載器和執行器,幫你把複雜的環境設定全部搞定。
首先,到 Ollama 官方網站 下載對應你作業系統的版本(Windows、macOS、Linux 都有)。安裝過程非常簡單,就像安裝一般軟體一樣。
安裝完成後,打開你的終端機(Windows 用戶請打開「命令提示字元」或 PowerShell;macOS 用戶打開「終端機」)。輸入以下指令,測試 Ollama 是否安裝成功:
ollama --version
如果你看到類似 ollama version 0.1.32 的數字,恭喜你,第一步就完成了!
第二步:下載並執行 Gemma 4
接下來,我們要讓 Ollama 去下載 Gemma 4 模型。在終端機中輸入以下指令:
ollama run gemma2
等等,你可能會問:「不是說要跑 Gemma 4 嗎?怎麼是 gemma2?」這是因為 Ollama 的模型庫目前標示為 gemma2,但它實際上會下載最新、最穩定的 Gemma 系列模型,也就是我們要的 Gemma 4 版本。
第一次執行時,Ollama 會自動下載大約 7GB 的模型檔案。這需要一點時間,取決於你的網路速度。你可以趁這個時間去泡杯咖啡。
下載完成後,你就會看到一個 >>> 的提示符號,這代表 AI 已經準備好回答你的問題了!
試著輸入:「你好,請問你是誰?」
它應該會回答:「你好!我是 Gemma,一個由 Google 開發的 AI 模型…」
實用小技巧:如果你的記憶體(RAM)比較少(例如 8GB 或 16GB),可以考慮下載量化版本(Quantized version),它體積更小、跑起來更順暢。指令是:
ollama run gemma2:2b
這個 2b 代表 2B 參數的版本,雖然能力比 12B 弱一點,但對於一般問答和簡單任務來說已經非常夠用,而且幾乎任何電腦都能跑。
第三步:進階玩法,讓它幫你做事
現在你已經有一個能對話的 AI 了。但它的真正威力,在於你可以讓它幫你處理具體任務。
情境一:快速摘要文章
假設你有一篇長長的英文新聞,懶得自己看。你可以這樣做:
- 把文章內容複製下來。
- 在 Ollama 的對話框裡輸入:「請用繁體中文總結以下文章的重點,並列出三個主要觀點。」
- 貼上文章內容,按 Enter。
它會立刻幫你整理出重點摘要。對於每天要看大量資訊的上班族來說,這個功能可以幫你省下好幾個小時。
情境二:撰寫專業郵件
你需要寫一封給客戶的道歉信,但不知道怎麼措辭才得體?直接跟它說:
「請幫我寫一封給客戶的英文郵件,主題是延遲交貨的道歉。語氣要專業且誠懇,並提出提供 10% 折扣作為補償。」
它會生成一封完整的郵件草稿。你可以再根據實際情況微調,效率直接翻倍。
情境三:程式碼除錯
你是工程師嗎?把一段報錯的程式碼貼給它,並問:「這段 Python 程式碼為什麼會報 ‘IndexError: list index out of range’?請幫我修正。」
Gemma 4 在程式碼理解上非常強,往往能一針見血地指出問題所在。
常見問題
Q: 我的電腦跑得動嗎?需要什麼規格? A: 最基本的要求是 8GB 以上的 RAM。如果你跑 12B 參數的版本,建議 16GB 以上會比較順暢。CPU 只要是 Intel i5 或 AMD Ryzen 5 以上的等級都可以。如果你有 NVIDIA 顯示卡(4GB VRAM 以上),Ollama 會自動啟用 GPU 加速,速度會快非常多。
Q: 這個模型會說中文嗎?效果如何? A: Gemma 4 雖然是 Google 開發的模型,但它在訓練時包含了大量中文資料,所以繁體中文的理解和生成能力都非常好。對於日常問答、翻譯、摘要等任務,表現不輸給 ChatGPT 3.5。
Q: 我可以同時讓它分析圖片嗎? A: 可以!Gemma 4 是一個「多模態」模型。雖然透過 Ollama 的文字介面比較難直接上傳圖片,但你可以用其他工具(如 Open WebUI)來建立一個更美觀的網頁介面,就能直接上傳圖片讓它分析。
Q: 我該如何更新模型到最新版本?
A: 非常簡單。只要在終端機輸入 ollama pull gemma2,它就會自動檢查並下載最新版本。如果模型已經是最新,它會告訴你「Already up to date」。
Q: 使用 Ollama 和 Gemma 4 需要花錢嗎? A: 完全免費!Ollama 是開源軟體,Gemma 4 也是 Google 開源的模型。你只需要付出你的電費和硬碟空間。沒有訂閱費,也沒有 API 呼叫次數限制。
延伸閱讀
總結
今天我們學到了如何在自己的電腦上,用 Ollama 這個工具來執行 Google 最新的開源 AI 模型 Gemma 4。你不需要強大的雲端伺服器,也不需要擔心隱私外洩,就能擁有一個隨時待命的 AI 助手。
從文章摘要、郵件撰寫到程式碼除錯,Gemma 4 都能幫你省下大量時間。這不只是省錢,更是拿回對自己資料的掌控權。
趕快打開你的電腦,下載 Ollama 試試看吧!你會發現,AI 離你比想像中更近。
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "FAQPage",
"mainEntity": [
{
"@type": "Question",
"name": "我的電腦跑得動嗎?需要什麼規格?",
"acceptedAnswer": {
"@type": "Answer",
"text": "最基本的要求是 8GB 以上的 RAM。如果你跑 12B 參數的版本,建議 16GB 以上會比較順暢。CPU 只要是 Intel i5 或 AMD Ryzen 5 以上的等級都可以。如果你有 NVIDIA 顯示卡(4GB VRAM 以上),Ollama 會自動啟用 GPU 加速,速度會快非常多。"
}
},
{
"@type": "Question",
"name": "這個模型會說中文嗎?效果如何?",
"acceptedAnswer": {
"@type": "Answer",
"text": "Gemma 4 雖然是 Google 開發的模型,但它在訓練時包含了大量中文資料,所以繁體中文的理解和生成能力都非常好。對於日常問答、翻譯、摘要等任務,表現不輸給 ChatGPT 3.5。"
}
},
{
"@type": "Question",
"name": "我可以同時讓它分析圖片嗎?",
"acceptedAnswer": {
"@type": "Answer",
"text": "可以!Gemma 4 是一個「多模態」模型。雖然透過 Ollama 的文字介面比較難直接上傳圖片,但你可以用其他工具(如 Open WebUI)來建立一個更美觀的網頁介面,就能直接上傳圖片讓它分析。"
}
},
{
"@type": "Question",
"name": "我該如何更新模型到最新版本?",
"acceptedAnswer": {
"@type": "Answer",
"text": "非常簡單。只要在終端機輸入 ollama pull gemma2,它就會自動檢查並下載最新版本。如果模型已經是最新,它會告訴你「Already up to date」。"
}
},
{
"@type": "Question",
"name": "使用 Ollama 和 Gemma 4 需要花錢嗎?",
"acceptedAnswer": {
"@type": "Answer",
"text": "完全免費!Ollama 是開源軟體,Gemma 4 也是 Google 開源的模型。你只需要付出你的電費和硬碟空間。沒有訂閱費,也沒有 API 呼叫次數限制。"
}
}
]
}
</script>