生活分享

AI 寫程式代理操作步驟比較:同一個需求在三個工具怎麼做

沒有三家的付費帳號就跑不出可信的跑分,所以這篇比的是操作步驟:同一個匯率換算小工具的需求,在 Claude Code、Codex CLI 與 Gemini CLI 上各自怎麼安裝登入、動手前怎麼確認權限、產出從哪裡看、規則寫在 CLAUDE.md、AGENTS.md 還是 GEMINI.md、非互動模式與費用怎麼算。全部依三家官方文件於 2026 年 9 月 14 日查證,附一套自己在家測的方法。

閱讀時間約 8 分鐘

插圖:左邊一個提示詞對話框,分出三條路徑通往三個終端機視窗,每條路徑上各有一個核准關卡。
圖片:Mokaair (© Mokaair)

同一個需求交給三個 寫程式代理(Agent),誰寫得比較好?這篇不回答這個問題。我們手上沒有三家的付費帳號與額度,跑不出可信的分數,所以改比另一件更有用的事:同一個需求在 Claude Code、Codex CLI 與 Gemini CLI 上各自要按哪些步驟、在哪裡停下來確認、產出去哪裡看、錢從哪裡扣。

內容全部依 Anthropic、OpenAI 與 Google 三家的官方文件,查證日是 2026 年 9 月 14 日。讀完你會拿到一份可直接貼進終端機的共用提示詞、三個工具的安裝與登入指令、三套權限模式的正式名稱,以及一套自己在家測的方法。

這篇比的是操作步驟,不是跑分

坊間的比較文常給一張分數表,但那些分數多半來自少數幾題,換個專案就翻盤,模型一換更是全部作廢。真正決定你用得順不順的,是流程上不會天天變的差異:怎麼登入、代理動手前會不會先問你、它改了什麼去哪裡看、規則寫在哪個檔案、用量從哪裡扣。

這些都是官方文件寫死的事實,你自己也查得到。誰寫的程式比較好則要用你自己的專案去測,最後一節會給方法。想先弄清楚「跑分」與「評測」分別指什麼,站上另有兩篇名詞解釋。

同一個需求:一個匯率換算的單頁小工具

要讓三邊條件一致,需求必須先固定。我們挑一個小到能一次做完、又要動到好幾個檔案的題目:一個匯率換算的單頁小工具。匯率寫在本機設定檔裡,不連外部服務,測試才不會受網路品質影響。

三個工具共用的同一份提示詞(貼上前不要改動) · text
需求:做一個匯率換算的單頁小工具。
1. 只用一個 HTML 檔、一個 CSS 檔、一個 JavaScript 檔,不要使用任何外部套件或 CDN。
2. 匯率放在 rates.json,至少包含 TWD、USD、JPY、EUR 四種幣別。
3. 使用者輸入金額、選來源幣別與目標幣別,畫面即時顯示換算結果,四捨五入到小數點後兩位。
4. 金額空白或不是數字時,在欄位下方顯示提示文字,不要跳出警告視窗。
5. 寫一份 README.md,說明怎麼在本機打開這個頁面。
完成後列出你新增或修改的每一個檔案,並說明你用什麼方法確認第三點與第四點真的成立。

把這段提示詞原封不動貼給三個代理,是比較能成立的前提。它把要做什麼、不做什麼、怎樣算完成都寫清楚,最後一句還要求代理自己說明怎麼驗證。怎麼寫代理接得住的提示詞,站上另有一篇專門談。

安裝與登入:三個工具的第一步不一樣

三家都提供終端機一行指令的安裝方式。Claude Code 在 macOS、Linux 與 WSL 用官方安裝指令,Windows 用 PowerShell 版本,另支援 Homebrew 與 WinGet;Codex CLI 另有 npm 與 Homebrew;Gemini CLI 標準做法是 npm 全域安裝。

三個工具的安裝指令(各取官方文件列出的其中一種) · bash
# Claude Code:macOS、Linux 與 WSL 的官方安裝指令
curl -fsSL https://claude.ai/install.sh | bash
claude --version

# Codex CLI:macOS 與 Linux 的官方安裝指令
curl -fsSL https://chatgpt.com/codex/install.sh | sh

# Gemini CLI:用 npm 全域安裝
npm install -g @google/gemini-cli

登入這一步的差別比安裝大,因為它直接決定你用不用得起。

  • Claude Code:執行 claude 就會提示登入。可用 Claude Pro、Max、Team 或 Enterprise 訂閱,也可用 Claude Console 的預付額度帳號或企業雲端供應商。
  • Codex CLI:執行 codex 後選「Sign in with ChatGPT」,或直接執行 codex login。也可用 API 金鑰,但官方文件寫明那會改走標準 API 計價,不動用 ChatGPT 方案的額度。
  • Gemini CLI:執行 gemini 後在認證選單選「Login with Google」,用現有的 Google 帳號登入;另兩種方式是 Gemini API 金鑰與 Vertex AI。

三個工具的入門步驟,站上各有一篇從頭帶一次。

動手前怎麼確認權限,動完怎麼看產出

代理要改你的檔案、在你的電腦上跑指令,所以三家都有一組「它可以自己做到哪裡」的設定,名字各不相同,交需求前先看一眼在哪個模式。

  • Claude Code 叫權限模式,六個值:default(介面上叫 Manual,多數動作都問你)、acceptEdits、plan、auto、dontAsk、bypassPermissions。官方文件寫明終端機上的 Pro、Max 與 Team 方案起始模式是 auto,由另一個模型代你審查;按 Shift+Tab 切換。
  • Codex CLI 分核准政策與沙箱兩層:政策有 on-request、never、granular,沙箱有 workspace-write、read-only 與 danger-full-access。官方把組合包成預設,Auto 等於 workspace-write 加 on-request;輸入 /permissions 直接挑 Auto 或 Read Only。
  • Gemini CLI 用旗標 approval-mode,三個值:default 每次工具呼叫都問、auto_edit 自動核准 replace 與 write_file 這類編輯工具、yolo 全部自動核准。沙箱預設關閉,官方寫明用 yolo 時會預設開啟。
三個工具各自把權限收緊一點的寫法 · bash
# Claude Code:Manual 模式,多數動作都先問你
claude --permission-mode default

# Codex CLI:唯讀沙箱,需要時才要求核准
codex --sandbox read-only --ask-for-approval on-request

# Gemini CLI:自動核准編輯工具,其他工具仍然詢問
gemini --approval-mode auto_edit

代理停下來之後,要看的是它到底改了什麼。Claude Code 與 Codex CLI 都有 /diff 列出工作目錄的變更,Codex 還會連 Git 沒追蹤的新檔案一起顯示。要退回去,Claude Code 用 /rewind,Codex 用 /review 複查,Gemini CLI 得先開啟 checkpointing 再用 /restore 還原。真正的驗收仍在你自己:照那五點在瀏覽器裡點過去。

三欄對照圖,並排列出 Claude Code、Codex CLI 與 Gemini CLI 從安裝、登入、權限確認、脈絡檔案到驗收的五個步驟,最下方是三邊共用的驗收條件。
由左往右看是同一個工具的完整流程,由上往下看是同一個步驟在三個工具的做法;最下面一條是三邊必須一致的驗收條件。 · 圖片:Mokaair (© Mokaair)
閱讀完整文字說明

三欄對照圖。左欄依序列出五個步驟:安裝、登入、權限確認、脈絡檔案、看產出。Claude Code 用官方安裝指令或 Homebrew、WinGet 安裝,執行 claude 以訂閱或 Console 帳號登入,權限模式有 default、plan、acceptEdits、auto 等六個值,脈絡檔案是 CLAUDE.md,用 /diff 看變更、/rewind 回到檢查點。Codex CLI 用官方安裝指令或 npm、Homebrew 安裝,執行 codex login 以 ChatGPT 帳號或 API 金鑰登入,用 /permissions 選 Auto 或 Read Only 預設,脈絡檔案是 AGENTS.md,用 /diff 看變更、/review 再複查一次。Gemini CLI 用 npm 全域安裝,執行 gemini 後選 Login with Google,旗標 approval-mode 有 default、auto_edit、yolo 三個值,脈絡檔案是 GEMINI.md,先開 checkpointing 再用 /restore 還原。三者的脈絡檔案都用 /init 產生初稿。圖的最下方是三邊共用的驗收條件:同一份提示詞、同一個起點、同一張核對清單,每一輪都記下花了多少時間、用掉多少額度、你自己動手改了幾處。

脈絡檔案、非互動模式與費用怎麼算

三家都讓你把專案規則寫成一個檔案,每次開始自動讀進去:Claude Code 讀 CLAUDE.md,Codex 讀 AGENTS.md,Gemini CLI 預設讀 GEMINI.md,三者都用 /init 產生初稿。要注意官方文件明講 Claude Code 不讀 AGENTS.md,專案已經有 AGENTS.md 的話,在 CLAUDE.md 用一行匯入語法引進來即可。

要把代理接進腳本或持續整合流程,三家也都有不進入互動介面、跑完就結束的模式。

三個工具的非互動執行方式 · bash
# Claude Code:非互動執行,並先指定可用的工具
claude -p "把 rates.json 補上 KRW 幣別" --allowedTools "Read,Edit"

# Codex CLI:非互動執行,輸出 JSON Lines 事件
codex exec "把 rates.json 補上 KRW 幣別" --json

# Gemini CLI:非互動執行,輸出機器可讀的 JSON
gemini -p "把 rates.json 補上 KRW 幣別" --output-format json

費用差在「額度從哪裡扣」。Claude Code 走 Claude 訂閱,官網列出 Free 每月 0 美元不含 Claude Code,Pro 每月 20 美元與 Max 每月 100 美元起都寫明包含;也可改用 Claude Console 預付額度,照 API 計價。Codex 走 ChatGPT 訂閱,官網列出 Free 每月 0 美元、Go 每月 8 美元、Plus 每月 20 美元、Pro 每月 100 美元起,超過內含額度後用 credits 續用。Gemini CLI 用 Google 帳號登入有免費層,官方額度頁寫每人每天 1,000 次、每分鐘 60 次請求;Gemini API 金鑰的免費層是每天 250 次、每分鐘 10 次,只到 Flash 模型。

三家都沒把「一天能跑幾個任務」寫成絕對數字:Claude 的 Pro 與 Max 只寫包含 Claude Code,Codex 的 Pro 只寫「比 Plus 多 5 倍或 20 倍的用量」,Google AI Pro 與 AI Ultra 只寫「依固定價訂閱計算」。這三項與台灣實際付款金額都以官網為準。

六個面向的對照,內容只取三家官方文件寫出來的部分,查證日 2026 年 9 月 14 日。
工具安裝與登入權限確認脈絡檔案非互動模式費用方式
Claude Code官方安裝指令、Homebrew 或 WinGet;執行 claude 後用訂閱或 Console 帳號登入權限模式 default、acceptEdits、plan、auto、dontAsk、bypassPermissions;Shift+Tab 切換CLAUDE.md(/init 產生;不讀 AGENTS.md,需自行匯入)claude -p,可加 --output-format jsonClaude 訂閱 Pro 或 Max,或 Claude Console 預付額度照 API 計價
Codex CLI官方安裝指令、npm 或 Homebrew;執行 codex 或 codex login,用 ChatGPT 帳號登入核准政策 on-request、never、granular 搭配沙箱 workspace-write、read-only;/permissions 挑預設AGENTS.md(/init 產生;全域放在使用者目錄,專案從 Git 根往下逐層疊加)codex exec,可加 --jsonChatGPT 訂閱 Go、Plus 或 Pro,超過額度用 credits;改用 API 金鑰則照 API 計價
Gemini CLInpm 全域安裝、npx 或 Homebrew;執行 gemini 後選 Login with Googleapproval-mode 三個值:default、auto_edit、yolo;另有工具白名單與沙箱GEMINI.md(/init 產生;檔名可設定,/memory 檢視)gemini -p,可加 --output-format jsonGoogle 帳號免費層每天 1,000 次請求;或用 Gemini API 金鑰、Vertex AI 依用量計費

自己在家測:相同提示、相同驗收條件、記三件事

步驟比較只能告訴你流程長什麼樣,不能告訴你哪個工具在你的專案上好不好用。這件事只能自己測,測得有沒有意義取決於條件有沒有固定。

  1. 同一份提示詞:用上面那段,一字不改。中途想補充的話三邊都要補一樣的內容,不然這一輪作廢。
  2. 同一個起點:三次都從同一個空資料夾或 Git 提交開始,測完就還原,不要讓下一個工具接手前一個留下的程式碼。
  3. 同一組驗收條件:把提示詞那五點抄成核對清單,在瀏覽器裡一條條點過去。能跑不等於做對,換算算錯或空白欄位沒提示都算沒過。
  4. 記時間:從貼上提示詞到驗收通過的分鐘數,包含你自己補提示、重跑與手動修正。
  5. 記額度:跑完看用量,Claude Code 用 /usage,Codex 用 /status,Gemini CLI 用 /stats。
  6. 記你改了幾處:代理交件後你動手改了幾個檔案、幾行,這數字比任何跑分都誠實。

同一題至少跑兩輪再下結論,同一個模型跑兩次結果本來就會有差。幾輪之後你多半會發現,差別不在誰比較聰明,而在哪個工具的權限模式跟你比較合拍。想看還有哪些同類工具,站上有一篇總覽。

  • 生活分享

    Claude Code、Codex 搭本機模型:兩種接法怎麼選

    Claude Code 與 Codex 搭配本機模型有兩種接法:代理照常連雲端、把大量雜務交給腳本或 MCP 工具去問本機模型,或是把代理的模型整個換成本機模型。這篇用資料能不能出門、上下文開得夠不夠長、工作的類型三個問題幫你選,並對照 Ollama、LM Studio、Anthropic 與 OpenAI 的官方文件,分清楚本機權重、Ollama 的 cloud 標籤與供應商端點是三種不同的東西。

  • 生活分享

    把本機模型包成 MCP 工具,Claude Code 與 Codex 共用一支伺服器

    用官方 Python SDK 寫一支 stdio 的 MCP 伺服器,把本機的 Ollama 模型包成工具,Claude Code 與 Codex 就能共用:工具只收 inbox 底下的路徑,只回分類結果與結果檔路徑,不回信件原文。文中列出兩邊的登記指令、逾時與輸出上限的官方預設值,以及換成別家本機模型只改環境變數 LOCAL_MODEL 的做法,步驟都來自官方文件。

  • 生活分享

    把 Claude Code、Codex 整個換成本機模型:Ollama 與 LM Studio 設定與還原

    Ollama、LM Studio 與 Codex 的文件寫了把 Claude Code、Codex 整個換成本機模型的接法:Ollama 用 ollama launch 一行指令或手動設定,LM Studio 先開本機伺服器再設環境變數或加 --oss。這篇把四種組合的指令、兩家文件建議的上下文長度、Claude Code 用 /status 確認連到誰的方法,以及用完怎麼還原整理在一起;需要先裝好 Ollama 或 LM Studio,並且已有 Claude Code 或 Codex。

  • 生活分享

    Claude Code、Codex 搭本機模型的注意事項:開工前的檢查清單

    Claude Code 或 Codex 搭本機模型之前,先照一張表逐項核對:代理讀不讀得到原始檔、現在連的是誰、標籤是不是 :cloud、上下文實際開多長、逾時與輸出量、怎麼驗收。每一項寫怎麼檢查,並指出詳見同組哪一篇,另外收進供應商端點、條款與授權、繁體中文用字檢查;檢查方法取自 Anthropic、OpenAI、Ollama 與 DeepSeek 的官方文件。

最新旅遊情報攻略

資料來源

生活分享