生活分享

API 價格比較:每百萬 token 各家多少

接 API 之前先把價目表攤開:這篇抄下 OpenAI、Anthropic、Google Gemini、xAI、阿里雲百鍊、Mistral、MiniMax、DeepSeek 八家官網當天的旗艦、中階、輕量三級每百萬 token 輸入與輸出價,寫出快取價、批次折扣、免費層條款與計費幣別,最後附一段一萬次對話的算式讓你代入自己的用量。不評分、不宣稱實測,只照官網欄位排。

更新日期: 閱讀時間約 12 分鐘

三條由粗到細的橫向色帶疊在一起,每條帶子上放著大小不一的圓點代表不同價位,右側是一個圓角方框與幾條計算用的橫線
圖片:Mokaair (© Mokaair)

要接 API 的人第一個該回答的不是哪家比較聰明,而是同一份工作丟進去,帳單差幾倍。照官網當天的標準價看,最貴的旗艦每百萬輸出 token 要 50 美元,最便宜的輕量模型不到半美元,中間隔了一百倍以上;而且同一家內部從旗艦到輕量的落差,常常比不同家之間還大。

這篇把八家官網定價頁在 2026 年 9 月 15 日當天的數字抄下來,各取旗艦、中階、輕量三級的每百萬 token 輸入與輸出價,再寫出快取與批次折扣、免費層條款、計費幣別,最後給一段可以自己代入用量的算式。這裡不打分數、不宣稱實測,只照官網寫得出來的欄位排,看完你要能自己判斷該盯哪一欄。

價目表上真正要看的四個欄位

每一家的定價頁長得都不一樣,但影響帳單的欄位就四個:輸入價、輸出價、快取價、批次價。輸入是你送進去的提示詞、系統指示與整段對話紀錄,輸出是模型吐出來的字。多數家的輸出價是輸入價的三到五倍,所以讓模型少講一點,通常比讓它少讀一點更省。

  • 輸入:提示詞、系統指示、貼進去的文件與整段對話紀錄都算,上下文視窗塞得越滿,每一次呼叫的輸入就越貴。
  • 輸出:模型產生的字。推理模型的思考過程多半也算輸出,Google 的定價頁乾脆把欄位名稱寫成「輸出價(含思考 token)」。
  • 快取:重複送出的相同開頭可以只付一小筆讀取費,但通常要先付一筆寫入費,回本要讀幾次官網都有寫。
  • 批次:不急著要答案,改成非同步整批丟進去,多數家給五折。

還沒搞清楚 token 怎麼數的,先看 ;訂閱制與 API 額度的差別,站上有 。

旗艦級:10 美元對 50 美元是天花板,不是每家都這樣收

OpenAI 的定價頁把 gpt-6-astra 放在旗艦那一排,短上下文每百萬輸入 10.00 美元、輸出 50.00 美元,快取過的輸入 1.00 美元;長上下文另有一欄,輸入 20.00 美元、輸出 75.00 美元。同一排還有 gpt-5.6-sol,輸入 4.00 美元、輸出 20.00 美元,頁面下方註明這個促銷價至少到 2026 年 11 月 21 日。

Anthropic 的 API 定價頁上,Claude Fable 5.1 每百萬輸入 10 美元、輸出 50 美元,快取命中 0.25 美元;下一階的 Claude Opus 5 是輸入 5 美元、輸出 25 美元。同一頁有一條註記值得記下來:Claude Sonnet 5 原訂 2026 年 9 月 1 日調成 3 美元與 15 美元的漲價不會發生,2 美元與 10 美元成為標準價。這是價目表會往下走、不是只會往上走的例子。

旗艦這一級並不是每家都收到 50 美元。Google 的 gemini-3.1-pro-preview 在 20 萬 token 以內是輸入 2.00 美元、輸出 12.00 美元,超過就跳到 4.00 美元與 18.00 美元;xAI 的 grok-4.6 在 20 萬 token 以內是輸入 2.00 美元、輸出 6.00 美元,快取過的輸入 0.50 美元,超過門檻後兩欄都翻倍;阿里雲百鍊的 qwen3.8-max 在新加坡站是輸入 2 美元、輸出 6 美元。

再往下差距更明顯。MiniMax 的 MiniMax-M3 在 51.2 萬輸入 token 以內標著「永久五折」,折後輸入 0.30 美元、輸出 1.20 美元,快取讀取 0.06 美元;DeepSeek 的 deepseek-v4-pro 尖峰時段輸入 1.32 美元、輸出 3.96 美元,離峰再對折。換句話說,「旗艦」是各家自己的命名,不是同一個價位帶。

中階與輕量:同一家內部的落差更大

OpenAI 的 gpt-5.6-terra 是輸入 2.00 美元、輸出 12.00 美元,同一代的 gpt-5.6-luna 只要 0.20 美元與 1.20 美元,兩者差了十倍;再往回看,gpt-5-mini 是 0.25 美元與 2.00 美元,gpt-5-nano 是 0.05 美元與 0.40 美元。Anthropic 這一級是 Claude Sonnet 5,輸入 2 美元、輸出 10 美元,快取命中 0.20 美元;輕量的 Claude Haiku 4.5 是輸入 1.00 美元、輸出 5.00 美元。

Google 的 gemini-3.8-flash 把到期日寫在價格旁邊:2026 年 12 月 31 日前輸入 0.75 美元、輸出 3.75 美元,2027 年 1 月 1 日起變成 1.50 美元與 7.50 美元;更早一代的 gemini-3.5-flash 是 1.50 美元與 9.00 美元,輕量的 gemini-3.5-flash-lite 是 0.30 美元與 2.50 美元。這一家把同一個級距的新舊兩代放在同一頁,新的反而比舊的便宜。

Mistral 的分級跟名字對不上:mistral-medium-latest(Mistral Medium 3.5)是輸入 1.50 美元、輸出 7.50 美元,反而比掛著旗艦名字的 mistral-large-latest(Mistral Large 3,0.50 美元與 1.50 美元)貴,最小的 mistral-small-latest(Mistral Small 4)是 0.15 美元與 0.60 美元。阿里雲百鍊的 qwen3.7-plus 在 25.6 萬 token 以內是 0.40 美元與 1.60 美元,qwen3.8-flash 是 0.15 美元與 0.47 美元。MiniMax-M2.7 是 0.30 美元與 1.20 美元,DeepSeek 的 deepseek-flash 尖峰是 0.30 美元與 1.20 美元、離峰 0.15 美元與 0.60 美元。

把三級的區間攤開來看:旗艦每百萬輸入 0.30 到 10.00 美元、輸出 1.20 到 50.00 美元;中階輸入 0.40 到 2.00 美元、輸出 1.60 到 12.00 美元;輕量輸入 0.15 到 1.00 美元、輸出 0.47 到 5.00 美元。三段區間互相重疊,某一家的旗艦可能比另一家的輕量還便宜,所以選型不能只看級距名稱。

三條橫向價格帶,由上到下是旗艦、中階、輕量,每條標出每百萬 token 的輸入與輸出價格區間,兩端各標一個廠商的模型名稱
三條帶子畫的是各級距的價格區間,不是排名;兩端是區間的最低與最高,中間任何一家都可能落在別條帶子的範圍內。價格為 2026 年 9 月 15 日官網標準價。 · 圖片:Mokaair (© Mokaair)
閱讀完整文字說明

三條由上到下的價格帶,分別是旗艦級、中階級與輕量級,每一條標出各家官網當天每百萬 token 的輸入與輸出價格區間。旗艦級輸入 0.30 到 10.00 美元、輸出 1.20 到 50.00 美元,區間兩端是 MiniMax-M3 與 gpt-6-astra。中階級輸入 0.40 到 2.00 美元、輸出 1.60 到 12.00 美元,區間兩端是 qwen3.7-plus 與 gpt-5.6-terra。輕量級輸入 0.15 到 1.00 美元、輸出 0.47 到 5.00 美元,區間兩端是 qwen3.8-flash 與 Claude Haiku 4.5。三段區間互相重疊,畫的是區間不是排名,價格為 2026 年 9 月 15 日官網標準價。

快取、批次與離峰:官網真的寫出來的折扣

快取是把重複的開頭存起來,下一次只付很小的讀取費。Anthropic 寫成倍率:5 分鐘寫入 1.25 倍、1 小時寫入 2 倍、命中 0.1 倍(Claude Fable 5.1 是 0.025 倍),並說明 5 分鐘那種讀一次就回本、1 小時要讀兩次。OpenAI 直接在表上列快取輸入價,旗艦是標準輸入價的十分之一。阿里雲百鍊寫明顯式快取建立算標準輸入價的 125%、命中算 10%。Mistral 的定價頁寫快取輸入最多省 90%。Google 則是把快取分成單價與每小時儲存費兩筆,gemini-3.8-flash 是 0.075 美元加每百萬 token 每小時 0.50 美元。

快取到底在快取什麼,可以看 ;實際怎麼設斷點、怎麼跟批次一起用,站上有 。

批次的折扣比較一致:OpenAI、Anthropic、Google、Mistral 與阿里雲百鍊的官網都寫五折,Google 的方案欄直接標成「Batch API(成本降低 50%)」,gemini-3.8-flash 的批次價是輸入 0.375 美元、輸出 1.875 美元。xAI 是例外,定價頁列出只有 grok-4.3 與 grok-4.20 系列享八折,並寫明沒列到的模型沒有批次折扣,也就是旗艦的 grok-4.6 不打折。DeepSeek 不做批次,改用時段:尖峰是週一到週五世界協調時間 01:00 至 04:00 與 06:00 至 10:00,其餘時段一律半價。

免費層、幣別,以及台灣付不付得了

免費層寫得最清楚的是 Google。Gemini API 定價頁的方案欄把免費層寫成「部分模型有限度使用」與「免費的輸入與輸出 token」,付費層則多了快取、批次與較高的速率限制。真正要看的是最後一行條款:免費層寫「內容會用於改進我們的產品」,付費層寫「內容不會用於改進我們的產品」,而且每個模型的表格底下都再標一次是與否。旗艦的 gemini-3.1-pro-preview 免費層那一格寫的是「不提供」,想免費試的只能從 Flash 那幾檔開始。

其他家的免費額度形式不同。阿里雲百鍊在新加坡站給每個模型 100 萬 token 的免費額度,從開通、模型發布或申請通過起算 90 天,並寫明其他地區沒有這個額度。Anthropic 的定價頁常見問題寫新用戶會拿到少量免費額度試用。Mistral 把兩個端點標成免費。OpenAI、xAI、MiniMax 與 DeepSeek 的免費層,官網定價頁當天沒有寫,以官網為準。

幣別部分,八家定價頁上標的都是美元;Mistral 的頁面多一個美元與歐元的切換鈕,阿里雲百鍊則是分區計價,新加坡站用美元、中國站用人民幣,兩張表不能直接放在一起比。至於台灣能不能直接付款,官網查得到名單的有三家:OpenAI 的支援國家與地區頁、Anthropic 的支援國家頁、Google 的 Gemini API 可用地區頁都列了台灣。xAI、Mistral、MiniMax、DeepSeek 與阿里雲百鍊當天沒有可以直接引用的台灣付款說明,以官網為準。

怎麼估:一萬次對話的算式

把價目表換成帳單只需要兩個數字:一個月送進去多少輸入 token、拿回來多少輸出 token。下面用一個假設情境自己算一次,一萬次對話、每次輸入 2,000 個 token、輸出 500 個。這組數字是為了示範算式而假設的,不是任何產品的實測結果,換成你自己的用量才有意義。

自己算一次:一萬次對話的月費用(假設值,單價為 2026 年 9 月 15 日官網標準價) · text
假設(把數字換成你自己的)
  對話次數 = 10,000
  每次輸入 = 2,000 tokens -> 輸入合計 = 20,000,000 tokens = 20 個百萬
  每次輸出 = 500 tokens   -> 輸出合計 =  5,000,000 tokens =  5 個百萬

公式(單價 = 每百萬 token 美元)
  月費用 = 20 x 輸入單價 + 5 x 輸出單價

代入
  gpt-6-astra        20 x 10.00 + 5 x 50.00 = 450.00 美元
  Claude Sonnet 5    20 x  2.00 + 5 x 10.00 =  90.00 美元
  gemini-3.8-flash   20 x  0.75 + 5 x  3.75 =  33.75 美元
  MiniMax-M3         20 x  0.30 + 5 x  1.20 =  12.00 美元
  qwen3.8-flash      20 x  0.15 + 5 x  0.47 =   5.35 美元

這段算式沒有算進去的
  快取折扣、批次五折、離峰半價、推理模型的思考 token、
  搜尋與工具呼叫的次數費、超過門檻的長上下文加價欄。

同一份工作,450.00 美元與 5.35 美元之間差了八十幾倍,而這還沒動用任何折扣。所以真正的問題不是哪一家便宜,而是你的工作能不能接受最便宜那一欄的模型;這件事只有你自己拿真實資料跑得出來。下面是一套可以自己做的核對步驟。

  1. 抓真實用量:從上個月實際跑過的請求裡挑十筆,看回應的用量欄位或各家的 token 計算端點,算出每次的平均輸入與輸出 token。
  2. 代公式:把平均值乘上預估次數,代進上面的算式,一家算一個數字,先不要考慮折扣。
  3. 再看折扣欄:提示詞前面有沒有一大段固定不變的內容,有就把快取價換進去;工作能不能等到隔天,能等就換批次價或離峰價。
  4. 補上表格沒有的欄位:超過門檻的長上下文加價、推理模型的思考 token、搜尋與工具呼叫的次數費、區域推論的加價。
  5. 拿最小的預算跑一天真實流量,把帳單抓回來跟你的估算對一次,差多少就把差額補進假設裡再估一輪。

想把估算做得更細,站上有 ;如果你在考慮乾脆把模型跑在自己機器上,成本要怎麼比可以看 。

各家官網 2026 年 9 月 15 日當天的標準價,照官網幣別(美元)未做換算,未套用快取、批次與離峰折扣;DeepSeek 與其餘型號的價格寫在內文。
廠商模型(級距)輸入/百萬 token輸出/百萬 token
OpenAIgpt-6-astra(旗艦)10.00 美元50.00 美元
AnthropicClaude Fable 5.1(旗艦)10 美元50 美元
AnthropicClaude Opus 5(旗艦)5 美元25 美元
OpenAIgpt-5.6-terra(中階)2.00 美元12.00 美元
Googlegemini-3.1-pro-preview(旗艦,20 萬 token 內)2.00 美元12.00 美元
AnthropicClaude Sonnet 5(中階)2 美元10 美元
MistralMistral Medium 3.5(中階)1.50 美元7.50 美元
xAIgrok-4.6(旗艦,20 萬 token 內)2.00 美元6.00 美元
阿里雲百鍊qwen3.8-max(旗艦,新加坡站)2 美元6 美元
AnthropicClaude Haiku 4.5(輕量)1.00 美元5.00 美元
Googlegemini-3.8-flash(中階,年底前)0.75 美元3.75 美元
MiniMaxMiniMax-M3(旗艦,折後)0.30 美元1.20 美元

你的情況該看哪一欄

同一張表,不同的工作要盯的欄位不一樣。與其問哪家最便宜,不如先確認自己的請求長什麼樣子,再回去看對應的那一欄。

  • 輸出很長(寫報告、翻譯整份文件、產生程式碼):先看輸出價,它通常是輸入價的三到五倍,旗艦與輕量在這一欄拉開最多。
  • 輸入很長、輸出很短(分類、抽欄位、內容審核):重點在輸入價與快取價,輸出價再高也只佔一小部分。
  • 每次都送同一份系統指示或同一批文件:看快取命中價與寫入倍率,回本要讀幾次官網都寫了。
  • 結果可以等到隔天(整批翻譯、批次標註、離線分析):看批次欄,五折與八折的差別就在這裡,也要確認你要的模型有沒有被列進折扣名單。
  • 時段可以自己挑:DeepSeek 是八家裡唯一按時段計價的,離峰半價對排程跑的工作很直接。
  • 上下文常常超過 20 萬 token:確認有沒有第二層長上下文價,OpenAI、Google、xAI 與 MiniMax 都有,一超過門檻就是整筆請求都用高價計。
  • 資料不想被拿去改進產品:看免費層與付費層的條款差別,Google 這一欄寫得最直接。

  • 生活分享

    AI 寫程式的費用怎麼算:token、訂閱與 API 額度

    AI 寫程式的帳單有兩套算法:訂閱制付月費換一段時間區間的額度,API 按每百萬 token 計價。這篇用 2026 年 9 月官網當天查到的數字(模型與 API 價格在 10 月 5 日重新查證),說明 token 是什麼計價單位、為什麼代理每一輪都重送整段上下文所以比聊天燒得快、提示詞快取怎麼把重複輸入降到十分之一,並列出 Claude、ChatGPT、Copilot、Cursor、Gemini CLI 的入門方案與代表模型的 API 價格,附一條估算算式、一個算到底的範例與六個省錢做法。

  • 生活分享

    單價之外:快取、長上下文門檻與 tokenizer 怎麼改變帳單

    每百萬 token 的單價只是起點。這篇把三個官網有寫、但不在主價目表上的欄位攤開:快取命中價(多數家原價 10%,DeepSeek 低到 2%、xAI 要 25%)、長上下文加價門檻(xAI 明寫跨過去整筆請求都用高價計,Anthropic 則完全沒有這道門檻),以及各家 tokenizer 切出來的 token 數不一樣。附一套重估帳單的順序。

  • 生活分享

    各家 AI 模型總表:同級距的 token 規格與官方自報分數

    把 OpenAI、Anthropic、Google、xAI、阿里巴巴、Mistral、MiniMax、DeepSeek、Moonshot、Z.AI 各家官網當天的模型攤成四張表:旗艦、中階、輕量各一張,每一列同時給上下文視窗、最大輸出與每百萬 token 輸入輸出價,另加一張十二個開放權重模型的參數與授權表。效能欄只抄官網自己公布的分數,並說明為什麼六家官網用的 benchmark 幾乎沒有交集。

  • 生活分享

    OpenRouter:一把金鑰用遍各家模型

    OpenRouter 用一個 OpenAI 相容端點接上各家模型,官網 FAQ 寫儲值收 5.5% 手續費、token 價格不加價。這篇照 openrouter.ai 當天的文件走完註冊與金鑰、儲值與退款規則、模型頁每百萬 token 價格怎麼讀、免費模型每天能跑幾次、provider 欄位怎麼指定路由與資料留存,附 Python 與 curl 最小範例,以及誰適合、誰不適合。

最新旅遊情報攻略

資料來源

生活分享