生活分享

AI 寫程式的費用怎麼算:token、訂閱與 API 額度

AI 寫程式的帳單有兩套算法:訂閱制付月費換一段時間區間的額度,API 按每百萬 token 計價。這篇用 2026 年 9 月官網當天查到的數字(模型與 API 價格在 10 月 5 日重新查證),說明 token 是什麼計價單位、為什麼代理每一輪都重送整段上下文所以比聊天燒得快、提示詞快取怎麼把重複輸入降到十分之一,並列出 Claude、ChatGPT、Copilot、Cursor、Gemini CLI 的入門方案與代表模型的 API 價格,附一條估算算式、一個算到底的範例與六個省錢做法。

更新日期: 閱讀時間約 10 分鐘

插圖:一個終端機視窗裡有三根越來越高的長條,旁邊是一個計量表,代表用量隨輪數累積並被計價
圖片:Mokaair (© Mokaair)

用 寫程式的費用只有兩套算法:訂閱制付固定月費,換一段時間區間裡的額度;API 按 token 計價,用多少算多少。兩邊共用同一個單位 token,而代理(Agent)比聊天視窗燒得快,是因為它每一輪都重送整段上下文,模型每用一次工具還會再送一次請求。

這篇先把 token、上下文視窗與提示詞快取講成看得懂的計價規則,再排出各家官網的方案價格與 API 單價(2026 年 9 月 14 日查證,模型與 API 價格 10 月 5 日重新查證),最後給一條算式、一個算到底的範例與六個省錢做法。

token 是計價單位,不是字數

按量計費的 AI 服務,帳單單位都是 token,不是字數也不是次數。OpenAI 的說明中心把 token 描述成「可以是一個字元、一個字的一部分、一整個字或標點符號」,並給了英文換算:1 個 token 大約 4 個字元、大約四分之三個英文單字,100 個 token 大約等於 75 個英文單字;Anthropic 的名詞表則寫,對 Claude 來說一個 token「大約代表 3.5 個英文字元」。

中文呢。兩家都只給英文換算,也都加了但書:Anthropic 寫「確切數量會依使用的語言而不同」,OpenAI 寫「其他語言的字元、單字與 token 之間可能有不同的關係」。中文一個字算幾個 token 沒有官方比例,要準就得實際量。同一段文字換個模型數字也會變:Anthropic 的價格頁註明 Claude 4.7 之後的模型換了新器,同樣的文字大約多出 30% 的 token。

  • 輸入 token:送進去的所有東西,含系統提示詞、工具定義、專案規則檔與先前整段對話。
  • 輸出 token:模型生成的內容。思考過程也算輸出,官方文件寫明思考 token 以輸出 token 計費。
  • 快取 token:重複送而且命中快取的那段輸入,另有較低的單價。

為什麼代理比聊天燒得快:每一輪都重送整段上下文

模型本身沒有記憶。OpenAI 的對話狀態文件寫得很直接:每一次生成請求都是獨立而且無狀態的,而且「這條鏈上所有先前的輸入 token 都會以輸入 token 計費」。Anthropic 的上下文視窗文件說同一件事:先前每一輪都被完整保留,、每一則訊息、工具結果與工具定義全部都算。

聊天視窗裡累積得慢,每輪只多幾百個 token,代理不一樣。Claude Code 的官方文件寫得很具體:每送一則訊息就是一次新的 API 請求,工具會把系統提示詞、專案上下文、先前每一則訊息與工具結果全部重送;模型每用一次工具,就再送一次請求帶上那批結果。假設起始上下文 30,000 個 token、每輪新增 2,000 個,第 2 輪的輸入就是 32,000 個,第 40 輪是 108,000 個。

所以一個開了一整天的 session,即使只問一句話,用量還是跳很多。Anthropic 的成本文件把原因列成長上下文、快取失效、排程任務照樣觸發,以及上下文壓縮本身也要讀完要摘要的那段對話;同一份文件給的參考值是企業部署平均每位開發者每個有使用的日子約 13 美元、每月 150 到 250 美元。

圖解:一次代理請求由四層內容組成,輸入量隨輪數累積,下方比較訂閱制與 API 兩條計價路徑
左邊是一次請求裡有什麼,右邊是輸入量怎麼隨輪數長大,下面是兩條計價路徑。 · 圖片:Mokaair (© Mokaair)
閱讀完整文字說明

左半邊把一次代理請求拆成四層:系統提示詞與工具定義、專案上下文、先前每一輪的對話與工具結果、這一輪的新訊息;前三層每一輪都一樣,是提示詞快取能省下來的部分。右半邊用三根長條顯示輸入量怎麼隨輪數長大:第 1 輪 30,000 個 token、第 2 輪 32,000 個、第 40 輪 108,000 個;每輪新增 2,000 個 token,40 輪的輸入合計 2,760,000 個。下半部比較兩條計價路徑:訂閱制付固定月費,額度以每五小時區間或每月 credits 計,官網不把額度換算成 token;API 按每百萬 token 計價,輸入與輸出分開,命中快取的輸入以 0.1 倍計算。

提示詞快取:重複送的那一段可以只算十分之一

既然每輪都重送同一包開頭,把它存起來就能省。提示詞快取(Prompt Caching)是比對這次請求的開頭和最近處理過的內容,一樣的部分重用計算結果。比對要完全相符,前面改一個字,後面全部重算。

Anthropic 的價格頁列出三個倍率:五分鐘快取寫入是基本輸入價的 1.25 倍、一小時寫入 2 倍、快取讀取 0.1 倍,並寫明五分鐘版讀到一次就回本、一小時版讀到兩次回本;可快取的最短長度依模型而定,Claude Sonnet 5.5 是 512 個 token、Haiku 4.5 是 4,096 個。OpenAI 則預設就開,GPT-5.6 之後的模型最低 1,024 個可見輸入 token,寫入快取是未快取輸入價的 1.25 倍,命中的部分多數模型是 0.1 倍、GPT-6.1 Sol 是 0.05 倍,最多省 95%。

要注意的是什麼會讓快取失效。Claude Code 的文件列了一整份清單,其中幾項是互動時很容易做的動作。

  • 中途換模型:每個模型有自己的快取,換過去等於整段重讀。
  • 改 effort 等級或開啟快速模式:同樣會讓整包重算。
  • 連上或斷開 MCP 伺服器、啟停外掛:工具定義在最前面一層,一改就全毀。
  • 執行壓縮指令:用摘要換掉整段歷史,對話那層本來就會重建。

官方的建議很簡單:開頭就把模型與 effort 等級選定,壓縮留到兩個任務之間再做。

訂閱制:月費換一段時間區間的額度

訂閱制是付固定月費換一段時間區間的額度,超過就等重設或另外加購。各家的額度單位都不一樣,多半不用 token 表示,很難直接互比。

Anthropic 的個人方案分免費、Pro 與 Max,官網寫 Pro 每五小時區間的用量至少是免費版的 5 倍,Max 分 5x 與 20x 兩級。OpenAI 的 Codex 定價頁把單位寫成每五小時區間的本機訊息則數,每個模型上限不同,例如 Plus 的 GPT-6 Luna 是 350 到 3,000 則,Pro 方案目前沒有五小時上限;說明中心另外寫明 Codex 有五小時與每週兩個視窗。實際則數會隨官網調整,以官網為準。

GitHub Copilot 走 credits:1 個 AI credit 等於 0.01 美元,一次互動的成本取決於用哪個模型與消耗多少 token,各方案每月配一筆基本 credits。Cursor 每個方案都含一定額度的模型用量,超過之後的 on-demand 是事後計費,沒用完的額度不會累積到下個月。Gemini CLI 用個人 Google 帳號登入則是每分鐘 60 次、每天 1,000 次請求。

ChatGPT 的數字 2026 年 10 月 6 日、Claude 與三列 API 的數字 10 月 5 日、Copilot、Cursor 與 Gemini CLI 的數字 9 月 14 日於各供應商官網查得;額度單位照官網寫法,官網沒列的寫明未列,其他細項以官網為準。
方案計費方式單位官網數字
Claude Pro訂閱每五小時區間月繳 20 美元、年繳每月 17 美元
Claude Max 5x/20x訂閱每五小時區間自每月 100 美元起
ChatGPT Go訂閱官網未列估計則數每月 8 美元,桌面 App 可用 GPT-6 Luna(逐步開放)
ChatGPT Plus訂閱每五小時區間訊息則數每月 20 美元
ChatGPT Pro訂閱方案內含用量,目前沒有五小時上限每月 100/200/500 美元
Copilot Pro訂閱加 credits每月 AI credits每月 10 美元,基本 1,000
Copilot Pro+/Max訂閱加 credits每月 AI credits每月 39/100 美元,基本 3,900/10,000
Cursor Pro/Pro+/Ultra訂閱加超額每月含用量每月 20/60/200 美元
Gemini CLI(Google 帳號)免費額度每分鐘與每日請求數每分鐘 60 次、每天 1,000 次
Claude API用量每百萬 tokenSonnet 5.5 輸入 2、輸出 10 美元
OpenAI API用量每百萬 tokenGPT-6 Luna 輸入 0.10、輸出 0.50 美元
Gemini API用量每百萬 tokenGemini 3.8 Flash 輸入 0.75、輸出 3.75 美元

API 計費:每百萬 token 算一次

API 沒有月費,開一把金鑰用多少算多少,單位是每百萬 token(官方寫成 per MTok),輸入與輸出分開計價,輸出通常是輸入的五倍。以下是各家官網上的代表模型。

  • Anthropic:Claude Opus 5.5 每百萬 token 輸入 4 美元、輸出 20 美元;Sonnet 5.5 是 2 與 10 美元;Haiku 4.5 是 1 與 5 美元。
  • OpenAI:GPT-6 Astra 輸入 10 美元、快取輸入 1 美元、輸出 50 美元;GPT-6 Luna 是 0.10、0.01 與 0.50 美元。
  • Google:Gemini 3.8 Flash 輸入 0.75 美元、輸出 3.75 美元,官網註明這個價格到 2026 年 12 月 31 日,2027 年 1 月 1 日起改為 1.50 與 7.50 美元。

同一家的旗艦與輕量模型可以差到 100 倍,這是省錢最大的槓桿:改命名、補測試交給輕量模型,架構決策才用旗艦模型。

估一個小專案要多少錢

算式只有一條,把輸入、快取讀取與輸出三段分開乘,再加起來。

按 token 計費的算式 · text
費用 = 輸入 token × 輸入單價 ÷ 1,000,000
     + 快取讀取 token × 快取讀取單價 ÷ 1,000,000
     + 輸出 token × 輸出單價 ÷ 1,000,000

難的不是算式,是估 token。可以這樣拆:起始上下文有多大、每一輪新增多少、總共要跑幾輪。

舉個例子。用 Claude Sonnet 5.5 的 API,輸入每百萬 2 美元、輸出每百萬 10 美元、快取讀取每百萬 0.20 美元、五分鐘快取寫入每百萬 2.50 美元;起始上下文 30,000 個 token、每輪新增 2,000 個、跑 40 輪、每輪輸出 1,000 個。因為每輪都重送整包,40 輪的輸入合計 2,760,000 個 token,輸出共 40,000 個。

範例:同一個 40 輪的代理任務,有沒有命中快取的差別 · text
沒有快取
  輸入 2,760,000 × 2  ÷ 1,000,000 = 5.52 美元
  輸出    40,000 × 10 ÷ 1,000,000 = 0.40 美元
  合計 5.92 美元

命中快取
  快取寫入   108,000 × 2.50 ÷ 1,000,000 = 0.27 美元
  快取讀取 2,652,000 × 0.20 ÷ 1,000,000 = 0.53 美元
  輸出        40,000 × 10   ÷ 1,000,000 = 0.40 美元
  合計 1.20 美元

快取寫入的 108,000 是起始的 30,000 加上 39 輪各新增的 2,000,每段內容只會寫進快取一次;其餘 2,652,000 是重複讀到的,以 0.1 倍計價。同一個任務 5.92 美元變成 1.20 美元。

訂閱制沒辦法這樣算,因為官網不把額度換算成 token。反過來做:先看用量畫面,看自己一天吃掉多少比例,再推估一個月夠不夠。

省錢:六個官方文件寫過的做法

  1. 讓快取命中:開頭就把模型與 effort 等級選定,中途不換,壓縮留到任務之間。
  2. 簡單的事用小模型:改命名、補測試、整理格式交給輕量模型。
  3. 把上下文控制住:換不相關的工作就開新對話,用不到的 MCP 伺服器關掉。
  4. 把任務講清楚:官方點名「改善這個專案」會觸發大範圍掃描,「在 auth.ts 的 login 函式加上輸入驗證」則只讀必要的檔案。
  5. 先規劃再實作:複雜任務先讓代理提一個方向給你看過,避免走錯之後重做。
  6. 固定流程用非互動模式跑:每天要做的檢查寫成一行指令一次跑完。

用量儀表板在哪裡看

  • Claude:Claude Code 裡輸入斜線 usage 指令,或到 claude.ai 設定的 Usage;用 API 看 Claude Console 的 Usage 頁。
  • ChatGPT 與 Codex:開設定或 Codex 的用量頁,也可以在 Codex CLI 裡輸入斜線 status 指令。
  • GitHub Copilot:官方文件寫用量儀表板會顯示目前額度與已經用掉的量。
  • Cursor:儀表板的 Spending 分頁,有兩個用量池的即時用量與 on-demand 費用。
  • Gemini CLI:輸入斜線 stats 指令,顯示這次 session 的 token 用量與快取節省。

  • 生活分享

    單價之外:快取、長上下文門檻與 tokenizer 怎麼改變帳單

    每百萬 token 的單價只是起點。這篇把三個官網有寫、但不在主價目表上的欄位攤開:快取命中價(多數家原價 10%,DeepSeek 低到 2%、xAI 要 25%)、長上下文加價門檻(xAI 明寫跨過去整筆請求都用高價計,Anthropic 則完全沒有這道門檻),以及各家 tokenizer 切出來的 token 數不一樣。附一套重估帳單的順序。

  • 生活分享

    各家 AI 模型總表:同級距的 token 規格與官方自報分數

    把 OpenAI、Anthropic、Google、xAI、阿里巴巴、Mistral、MiniMax、DeepSeek、Moonshot、Z.AI 各家官網當天的模型攤成四張表:旗艦、中階、輕量各一張,每一列同時給上下文視窗、最大輸出與每百萬 token 輸入輸出價,另加一張十二個開放權重模型的參數與授權表。效能欄只抄官網自己公布的分數,並說明為什麼六家官網用的 benchmark 幾乎沒有交集。

  • 生活分享

    OpenRouter:一把金鑰用遍各家模型

    OpenRouter 用一個 OpenAI 相容端點接上各家模型,官網 FAQ 寫儲值收 5.5% 手續費、token 價格不加價。這篇照 openrouter.ai 當天的文件走完註冊與金鑰、儲值與退款規則、模型頁每百萬 token 價格怎麼讀、免費模型每天能跑幾次、provider 欄位怎麼指定路由與資料留存,附 Python 與 curl 最小範例,以及誰適合、誰不適合。

  • 生活分享

    本機 vs 雲端 AI 成本試算:訂閱、API 與電費怎麼算

    把雲端訂閱、API 按量與本機三種付法放進同一條算式:訂閱月費照官網,API 取 Sonnet 5、gpt-5.6-terra、Gemini 3.1 Pro 的每百萬 token 價格,本機用 apple.com/tw 的 Mac mini 售價攤提,加 Apple 官方耗電量與台電住宅電價級距。輕度聊天、每天處理文件、開發者大量呼叫三個情境各算一次,結論是什麼情況本機才划算。

最新旅遊情報攻略

資料來源

生活分享