生活分享

Mac mini 當家用 AI 伺服器:統一記憶體、售價與區網設定

把 Mac mini 放在家裡當常開的 AI 伺服器,手機和筆電連區網就能用本機模型。本文整理 2026 年 9 月 14 日 apple.com/tw 上 Mac mini 的晶片、統一記憶體選項與新台幣售價,說明統一記憶體為什麼適合跑本機模型,並照 Ollama 與 Open WebUI 官方文件寫出 macOS 安裝、常駐與開放到區網的做法與風險,以及 Apple 官網有的耗電數字。

更新日期: 閱讀時間約 10 分鐘

插圖:一個圓角方塊代表放在家中的小主機,三條線連到手機、筆電與平板的簡化外框,旁邊是一疊代表模型檔案的長條
圖片:Mokaair (© Mokaair)

想把 留在自己家裡跑,Mac mini 是目前最容易擺得下、也最安靜的一種選擇,原因不在晶片有多快,而在它的記憶體是 CPU 與 GPU 共用的統一記憶體:模型不必先擠進顯示卡那一小塊顯示記憶體(VRAM),所以「買多少記憶體」幾乎就等於「能載入多大的模型」。結論先講:真正的決定權在統一記憶體容量,而 2026 年 9 月 14 日 apple.com/tw 上的 Mac mini,統一記憶體從 16GB 到 64GB。

這篇會帶你做完三件事:看懂 apple.com/tw 當天列出的機型、統一記憶體選項與新台幣售價;照 Ollama 與 Open WebUI 的官方文件,把 Mac mini 設定成開機就在跑、家裡其他裝置連區網就能用的服務;並且弄清楚「開放到區網」這一步的官方做法與風險。文中的規格、價格、指令與檔案大小全部來自官方頁面,效能推估、跑分與通路價一律不寫。

統一記憶體為什麼適合跑本機模型

一般的顯示卡桌機跑本機模型時,模型權重要從系統記憶體搬進顯示卡的顯示記憶體,放不下就得拆開放或退回 CPU 執行。Apple 晶片走的是另一條路。Apple 開發者文件在 Metal 的 hasUnifiedMemory 屬性上寫的定義是「一個布林值,表示 GPU 是否與 CPU 共用它全部的記憶體」,同一份資料 CPU 與 GPU 都看得到,不必為了給 GPU 用而複製一份。對本機模型來說,這代表你買到的統一記憶體幾乎整塊都能拿來放模型,而不是被一張卡的容量鎖死。

Ollama 官方的硬體支援頁對這件事只寫了一句:Ollama 透過 Metal API 在 Apple 裝置上做 GPU 加速。也就是說,在 Apple 晶片的 Mac 上不必另外處理驅動程式或 CUDA。Apple 自己的 Mac mini 產品頁也直接點名了這類軟體,寫「Mac mini 經過最佳化,可執行世界上最先進的 AI app」,並列出 Ollama 與 LM Studio Bionic 這些 app。

第二個要看的數字是記憶體頻寬。apple.com/tw 的技術規格頁寫:M6 搭 16GB 統一記憶體是 153GB/s,加選到 24GB 或 32GB 會變成 170GB/s,M5 Pro 則是 307GB/s。頻寬決定資料在記憶體與運算單元之間搬得多快,但官網沒有把它換算成每秒幾個 token,這篇也不替它換算。

  • 統一記憶體是 CPU 與 GPU 共用的同一塊記憶體,模型不必先複製進顯示記憶體
  • 能載入多大的模型,看的是統一記憶體總量,選購時記憶體容量比晶片名稱重要
  • 記憶體頻寬官網有寫(153GB/s、170GB/s、307GB/s),但官網沒有給對應的生成速度

當天官網的 Mac mini:晶片、記憶體與售價

2026 年 9 月 14 日的 apple.com/tw,Mac mini 還在預訂狀態,商店頁寫著「9 月 22 日開始發售」與「每位顧客限購兩部 Mac mini」。技術規格頁列出四種標準機型:三種是 Apple M6 晶片(12 核心 CPU、12 核心 GPU、雙 16 核心神經網路引擎),一種是 Apple M5 Pro 晶片(15 核心 CPU、16 核心 GPU、16 核心神經網路引擎),M5 Pro 另可選配 18 核心 CPU 與 20 核心 GPU 的版本。

統一記憶體的選項照官網是:M6 機型的標準配置有 16GB 與 24GB 兩種,最高可加選到 32GB;M5 Pro 標準是 24GB,可加選 48GB 或 64GB。整條產品線的價格,官網商品頁標示的範圍是 NT$29,900 到 NT$255,380。下表只列官網當天六個標準配置的價格,加選記憶體、SSD 或 10Gb 乙太網路後的價格以官網配置頁為準。

查證於 2026 年 9 月 14 日。售價為 apple.com/tw 商品頁當天標示的新台幣價格;檔案大小為 ollama.com/library 標示,不是效能保證。
官網標準配置統一記憶體(頻寬)官網售價(新台幣)Ollama 模型庫標示的檔案大小
M6,12 核心 CPU/12 核心 GPU,256GB SSD16GB(153GB/s)NT$29,900qwen3:latest 5.2GB、gemma4:latest 9.6GB
M6,12 核心 CPU/12 核心 GPU,512GB SSD16GB(153GB/s)NT$36,900gpt-oss:latest 14GB 已很接近 16GB
M6,12 核心 CPU/12 核心 GPU,512GB SSD24GB(170GB/s)NT$43,900qwen3:30b 19GB、gemma4:26b 19GB
M6,12 核心 CPU/12 核心 GPU,1TB SSD32GB(170GB/s)NT$61,400qwen3:32b 20GB、gemma4:31b 20GB
M5 Pro,15 核心 CPU/16 核心 GPU,512GB SSD24GB(307GB/s)NT$59,900與 24GB 那一列相同
M5 Pro,18 核心 CPU/20 核心 GPU,1TB SSD64GB(307GB/s)NT$112,400gpt-oss:120b 65GB,已超過 64GB

表格裡有一件事值得停下來想:M6 加到 32GB 加 1TB SSD 的 NT$61,400,已經比 M5 Pro 24GB 版本的 NT$59,900 貴。同樣的錢,一邊買到比較大的記憶體、一邊買到比較高的頻寬與比較多的核心,官網沒有告訴你哪個組合跑模型比較好,這個判斷得自己下。

記憶體選多少:只看官方標示的檔案大小

「這台跑得動什麼模型」沒有官方對照表,查得到的官方數字只有兩種:模型在 Ollama 模型庫上標示的檔案大小,以及 Ollama 文件依顯示記憶體決定的預設上下文視窗。把兩者放在一起,可以得到一個很粗但誠實的判斷方式:模型檔案要放得進統一記憶體,還要留出上下文視窗與系統本身要用的空間。以下是 2026 年 9 月 14 日 ollama.com/library 上的檔案大小。

  • qwen3:latest 5.2GB、qwen3:14b 9.3GB、qwen3:30b 19GB、qwen3:32b 20GB
  • gemma4:e2b 7.2GB、gemma4:12b 7.6GB、gemma4:latest 9.6GB、gemma4:26b 19GB、gemma4:31b 20GB
  • gpt-oss:latest 14GB、gpt-oss:120b 65GB
  • 同一個模型的量化版本差很多,例如 gemma4:31b 的 q4_K_M 是 20GB、q8_0 是 34GB

上下文視窗也要吃記憶體。Ollama 文件寫預設的上下文視窗是 4096 個 token,並依顯示記憶體分三級給預設值:小於 24 GiB 是 4k、24 到 48 GiB 是 32k、48 GiB 以上是 256k;文件同時建議網頁搜尋、代理(Agent)與寫程式這類任務至少設到 64000 個 token。這份分級是照顯示記憶體寫的,官網沒有另外給 Apple 晶片的對照表,實際載到哪裡請用 ollama ps 看 PROCESSOR 欄位。

把 Mac mini 設定成常開的家用 AI 伺服器

Ollama 的 macOS 文件寫的系統需求是 macOS Sonoma(v14)或更新版本,加上 Apple M 系列晶片(CPU 與 GPU 都支援),x86 的 Intel Mac 只有 CPU。安裝方式是掛載 ollama.dmg,把 Ollama 應用程式拖進系統的「應用程式」檔案夾;第一次啟動時如果 PATH 裡找不到 ollama 指令,它會請你授權在 /usr/local/bin 建立連結。模型與設定存在使用者目錄下的 .ollama,文件提醒模型「可能有幾十到幾百 GB」,SSD 容量要一起算進去。

下載模型、開始對話、看目前載入了什麼 · bash
ollama run gemma4
ollama ps
ollama stop gemma4

常開靠兩件事。第一,官方 FAQ 寫 macOS 與 Windows 版的 Ollama 安裝時會註冊成登入項目,登入就自己啟動(同一段也寫了怎麼關掉:在「系統設定」搜尋「登入項目」,於「允許在背景執行」底下把 Ollama 關掉)。第二,模型預設只在記憶體裡留 5 分鐘就卸載,官方提供 OLLAMA_KEEP_ALIVE 環境變數或 API 的 keep_alive 來改,設成 -1 代表一直留著。在 macOS 上以應用程式方式執行時,官方指定的環境變數設法是 launchctl setenv,設完要重新啟動 Ollama 應用程式。

讓模型留在記憶體裡不自動卸載(macOS 官方設法,設完重啟 Ollama) · bash
launchctl setenv OLLAMA_KEEP_ALIVE "-1"

接下來才是家用伺服器的重點:預設情況下 Ollama 只綁在 127.0.0.1:11434,也就是只有這台 Mac mini 自己連得到。官方 FAQ 的做法是用 OLLAMA_HOST 改綁定位址,改成 0.0.0.0:11434 就會對同一個區網開放。

把 Ollama 開放到區網(Ollama FAQ 的官方做法) · bash
launchctl setenv OLLAMA_HOST "0.0.0.0:11434"

這一步要想清楚再做。Ollama 的 API 文件寫得很明白:本機透過 localhost 的 11434 埠存取 Ollama API 時不需要任何驗證;文件裡需要驗證的情形只有雲端模型、發佈模型與下載私有模型。換句話說,一旦綁到 0.0.0.0,同一個區網裡的任何裝置都能直接呼叫它、載入模型、吃掉記憶體。自己家裡的區網可以接受,往公網開就不行。

架構圖:Mac mini 上的 Ollama 與 Open WebUI 經由家中區網,被手機、平板與筆電的瀏覽器使用
由左往右看:Mac mini 上跑兩個服務,經由家中區網被其他裝置使用;底下的紅框是唯一一條不能省的安全規則。 · 圖片:Mokaair (© Mokaair)
閱讀完整文字說明

左邊是一台常開的 Mac mini,統一記憶體 16GB 至 64GB、記憶體頻寬 153 至 307GB/s,上面跑兩個服務:Ollama 預設只綁 127.0.0.1 的 11434 埠,Open WebUI 的介面在 3000 埠。中間是家中區網,要讓區網連得到,必須把 OLLAMA_HOST 設成 0.0.0.0:11434 並重新啟動 Ollama 應用程式。右邊是手機、平板與筆電,用瀏覽器連 Mac mini 的區網位址加上 3000 埠,例如 192.168.1.100 加 3000,第一個註冊的帳號是管理員。底部的紅框提醒:Ollama 官方文件說本機 API 端點不需要驗證,所以 11434 埠只能留在區網,不要讓路由器對外轉發;要從外面連,官方文件列的做法是前面加代理伺服器、ngrok 或 Cloudflare Tunnel。

家人要用的介面:Open WebUI

命令列不適合拿給家人用,這正是 Open WebUI 存在的理由。它官方的「Sharing Open WebUI」頁寫得很直白:跑本機模型時,一台夠力的伺服器可以服務整個團隊,而不需要每一張桌子上都擺一台跑得動模型的電腦;使用者不必安裝任何東西,打開瀏覽器連進去就好。官方快速開始頁給的是 Docker 指令。

Open WebUI 官方快速開始的 Docker 指令(先用 openssl rand -hex 32 產生密鑰) · bash
docker run -d -p 3000:8080 \
  --add-host=host.docker.internal:host-gateway \
  -v open-webui:/app/backend/data \
  -e WEBUI_SECRET_KEY=your-secret-key \
  --name open-webui --restart always \
  ghcr.io/open-webui/open-webui:main

官方對每個旗標的解釋是:3000:8080 把介面放在這台機器的 3000 埠;open-webui 這個 volume 裝的是聊天記錄、使用者與設定,文件寫「never run without it」;add-host 那一行讓容器連得到跑在這台機器上的 Ollama;restart always 讓它重開機之後自己回來。WEBUI_SECRET_KEY 要固定下來,否則每次重建容器所有人都會被登出。

怎麼連進去,官方列的第一種方式就是最簡單的:同一個區網或 VPN 的人,用這台機器的區網位址加上 3000 埠就能開,文件給的例子是 192.168.1.100 加 3000。第一個註冊的帳號會成為管理員,之後註冊自動關閉;要讓家人加入,到頭像底下的 Settings、Admin、Authentication 打開 New Sign Ups,新帳號會停在 Pending 等你核准(介面以官網當天版本為準)。

Open WebUI 的強化指南第一節談的就是網路位置:這套軟體是為「私人、可信任的網路」設計的,跟資料庫、容器登錄或 CI 伺服器一樣,建議放在 VPN、零信任存取代理,或帶驗證與 IP 白名單的反向代理後面。家用情境把這句話翻成白話就是:留在區網裡,不要直接往公網開。

耗電、噪音,還有和顯示卡桌機的取捨

常開的機器一定會被問電費,所以這裡只寫 Apple 官網有的數字。技術規格頁寫現行 Mac mini 的最大連續功率是 155W,待機時操作者位置的聲壓位準是 5 dBA。Apple 支援文件〈Mac mini 耗電量與熱輸出(BTU)的相關資訊〉列到 2024 年機型為止:Mac mini(2024 年)搭 M4、16GB、256GB SSD 是閒置 4W、最大 65W,搭 M4 Pro、64GB、8TB SSD 是閒置 5W、最大 140W。M6 與 M5 Pro 機型當天還沒有列進那一頁,實際的閒置與最大功耗以官網為準。

至於該買 Mac mini 還是組一台裝顯示卡的桌機,這篇不做跨平台的數字比較,因為官網之間沒有可以直接比的共同基準。可以先分開想兩個問題:顯示記憶體要多少、預算怎麼配,以及自己養一台到底划不划算。這兩題同系列各有專篇。

最後提醒一件常被混在一起的事:Apple Intelligence 是 Apple 內建在系統裡的 AI 功能,和你自己用 Ollama 跑的模型是兩套完全不同的東西,只是剛好可以住在同一台 Mac mini 上。想知道系統內建的那一套在台灣能做到什麼,那是另一篇的題目。

  • 生活分享

    Claude Code、Codex 搭本機模型:兩種接法怎麼選

    Claude Code 與 Codex 搭配本機模型有兩種接法:代理照常連雲端、把大量雜務交給腳本或 MCP 工具去問本機模型,或是把代理的模型整個換成本機模型。這篇用資料能不能出門、上下文開得夠不夠長、工作的類型三個問題幫你選,並對照 Ollama、LM Studio、Anthropic 與 OpenAI 的官方文件,分清楚本機權重、Ollama 的 cloud 標籤與供應商端點是三種不同的東西。

  • 生活分享

    把本機模型包成 MCP 工具,Claude Code 與 Codex 共用一支伺服器

    用官方 Python SDK 寫一支 stdio 的 MCP 伺服器,把本機的 Ollama 模型包成工具,Claude Code 與 Codex 就能共用:工具只收 inbox 底下的路徑,只回分類結果與結果檔路徑,不回信件原文。文中列出兩邊的登記指令、逾時與輸出上限的官方預設值,以及換成別家本機模型只改環境變數 LOCAL_MODEL 的做法,步驟都來自官方文件。

  • 生活分享

    把 Claude Code、Codex 整個換成本機模型:Ollama 與 LM Studio 設定與還原

    Ollama、LM Studio 與 Codex 的文件寫了把 Claude Code、Codex 整個換成本機模型的接法:Ollama 用 ollama launch 一行指令或手動設定,LM Studio 先開本機伺服器再設環境變數或加 --oss。這篇把四種組合的指令、兩家文件建議的上下文長度、Claude Code 用 /status 確認連到誰的方法,以及用完怎麼還原整理在一起;需要先裝好 Ollama 或 LM Studio,並且已有 Claude Code 或 Codex。

  • 生活分享

    Claude Code、Codex 搭本機模型的注意事項:開工前的檢查清單

    Claude Code 或 Codex 搭本機模型之前,先照一張表逐項核對:代理讀不讀得到原始檔、現在連的是誰、標籤是不是 :cloud、上下文實際開多長、逾時與輸出量、怎麼驗收。每一項寫怎麼檢查,並指出詳見同組哪一篇,另外收進供應商端點、條款與授權、繁體中文用字檢查;檢查方法取自 Anthropic、OpenAI、Ollama 與 DeepSeek 的官方文件。

最新旅遊情報攻略

資料來源

生活分享