生活分享
AI 寫程式代理操作步驟比較:同一個需求在三個工具怎麼做
沒有三家的付費帳號就跑不出可信的跑分,所以這篇比的是操作步驟:同一個匯率換算小工具的需求,在 Claude Code、Codex CLI 與 Gemini CLI 上各自怎麼安裝登入、動手前怎麼確認權限、產出從哪裡看、規則寫在 CLAUDE.md、AGENTS.md 還是 GEMINI.md、非互動模式與費用怎麼算。全部依三家官方文件於 2026 年 9 月 14 日查證,附一套自己在家測的方法。
閱讀時間約 8 分鐘

同一個需求交給三個 AI人工智慧(Artificial Intelligence)是什麼人工智慧是涵蓋多種技術與應用的總稱,不等於聊天機器人,也不必一定會產生文字。本文從 OECD 的系統定義出發,以照片分類和社區資源推薦為例,說明輸入、推導、輸出與人的目標如何連結,整理它與機器學習、深度學習和生成式 AI 的關係。讀完能用具體問題判斷一項 AI 功能在做什麼,並分辨能力、自治程度與可信度。閱讀全文 寫程式代理(Agent),誰寫得比較好?這篇不回答這個問題。我們手上沒有三家的付費帳號與額度,跑不出可信的分數,所以改比另一件更有用的事:同一個需求在 Claude Code、Codex CLI 與 Gemini CLI 上各自要按哪些步驟、在哪裡停下來確認、產出去哪裡看、錢從哪裡扣。
內容全部依 Anthropic、OpenAI 與 Google 三家的官方文件,查證日是 2026 年 9 月 14 日。讀完你會拿到一份可直接貼進終端機的共用提示詞、三個工具的安裝與登入指令、三套權限模式的正式名稱,以及一套自己在家測的方法。
這篇比的是操作步驟,不是跑分
坊間的比較文常給一張分數表,但那些分數多半來自少數幾題,換個專案就翻盤,模型一換更是全部作廢。真正決定你用得順不順的,是流程上不會天天變的差異:怎麼登入、代理動手前會不會先問你、它改了什麼去哪裡看、規則寫在哪個檔案、用量從哪裡扣。
這些都是官方文件寫死的事實,你自己也查得到。誰寫的程式比較好則要用你自己的專案去測,最後一節會給方法。想先弄清楚「跑分」與「評測」分別指什麼,站上另有兩篇名詞解釋。
基準測試(Benchmark)是什麼基準測試(Benchmark)是什麼基準測試用共同題目、執行設定與評分方法比較系統,是理解 AI 能力的一種參考,不能直接當成所有用途的排名。本文以圖書館資料整理需求為例,說明題型、指標、提示詞、工具與測試汙染如何影響分數,解釋平均值與排名變動的限制。讀完能閱讀基準的適用範圍,判斷不同報告是否真的可比,並把公開成績接到自己的實際任務驗證。閱讀全文
模型與代理評測(Evals)是什麼模型與代理評測(Evals)是什麼模型與代理評測把任務、輸入、執行條件和成功標準固定下來,觀察 AI 是否真的符合需求。本文用志工排班助理為例,說明案例、重複嘗試、評分器與外部結果的差別,比較程式、人類與模型評分,解釋為何單次答對和平均高分都不足以證明可靠。讀完能建立一組小而實用的評測,讓提示詞或模型更新有可比較的證據,也能保留尚未驗證的限制。閱讀全文
同一個需求:一個匯率換算的單頁小工具
要讓三邊條件一致,需求必須先固定。我們挑一個小到能一次做完、又要動到好幾個檔案的題目:一個匯率換算的單頁小工具。匯率寫在本機設定檔裡,不連外部服務,測試才不會受網路品質影響。
需求:做一個匯率換算的單頁小工具。
1. 只用一個 HTML 檔、一個 CSS 檔、一個 JavaScript 檔,不要使用任何外部套件或 CDN。
2. 匯率放在 rates.json,至少包含 TWD、USD、JPY、EUR 四種幣別。
3. 使用者輸入金額、選來源幣別與目標幣別,畫面即時顯示換算結果,四捨五入到小數點後兩位。
4. 金額空白或不是數字時,在欄位下方顯示提示文字,不要跳出警告視窗。
5. 寫一份 README.md,說明怎麼在本機打開這個頁面。
完成後列出你新增或修改的每一個檔案,並說明你用什麼方法確認第三點與第四點真的成立。把這段提示詞原封不動貼給三個代理,是比較能成立的前提。它把要做什麼、不做什麼、怎樣算完成都寫清楚,最後一句還要求代理自己說明怎麼驗證。怎麼寫代理接得住的提示詞,站上另有一篇專門談。
給程式代理的提示模式:先規劃、再實作、最後驗證給程式代理的提示模式:先規劃、再實作、最後驗證和程式代理合作,關鍵不是把需求丟出去,而是把一次任務拆成規劃、實作、驗證三段。這篇依 Anthropic、OpenAI 與 Google 三家官方文件,說明一則好提示詞的四個要素(目標、背景、限制、完成條件)、規劃階段的 Plan Mode 與 /plan、實作階段怎麼限制範圍並要它自己跑測試、驗證階段怎麼看 diff 與逐條核對,附五則可直接複製的範本、常見失敗的追問方式與一張三段式流程圖。閱讀全文
安裝與登入:三個工具的第一步不一樣
三家都提供終端機一行指令的安裝方式。Claude Code 在 macOS、Linux 與 WSL 用官方安裝指令,Windows 用 PowerShell 版本,另支援 Homebrew 與 WinGet;Codex CLI 另有 npm 與 Homebrew;Gemini CLI 標準做法是 npm 全域安裝。
# Claude Code:macOS、Linux 與 WSL 的官方安裝指令
curl -fsSL https://claude.ai/install.sh | bash
claude --version
# Codex CLI:macOS 與 Linux 的官方安裝指令
curl -fsSL https://chatgpt.com/codex/install.sh | sh
# Gemini CLI:用 npm 全域安裝
npm install -g @google/gemini-cli登入這一步的差別比安裝大,因為它直接決定你用不用得起。
- Claude Code:執行 claude 就會提示登入。可用 Claude Pro、Max、Team 或 Enterprise 訂閱,也可用 Claude Console 的預付額度帳號或企業雲端供應商。
- Codex CLI:執行 codex 後選「Sign in with ChatGPT」,或直接執行 codex login。也可用 API 金鑰,但官方文件寫明那會改走標準 API 計價,不動用 ChatGPT 方案的額度。
- Gemini CLI:執行 gemini 後在認證選單選「Login with Google」,用現有的 Google 帳號登入;另兩種方式是 Gemini API 金鑰與 Vertex AI。
三個工具的入門步驟,站上各有一篇從頭帶一次。
Claude Code 入門:認識工具與第一條學習路線Claude Code 入門:認識工具與第一條學習路線認識讀檔、修改與執行工作的方式,選擇學習起點。Claude Code 可以在指定專案裡讀檔案、修改程式、執行工具並檢查結果。你交代「讓待辦清單可以篩選未完成項目」,它會需要先找出畫面、資料與事件處理的位置,再提出或實作變更。學會使用它的第一步,是把一個模糊願望縮成看得見、能檢查的小任務,而不是先背完所有指令。閱讀全文
Codex CLI 入門:在終端機裡讓 OpenAI 幫你改程式Codex CLI 安裝與入門選擇自己的安裝平台,完成 CLI 登入、唯讀檢查、單行修改、獨立驗證與工作階段接續。包含可重做的兩檔練習與缺檔測試。閱讀全文
Gemini CLI 安裝:第一次在終端機對話Gemini CLI 安裝:第一次在終端機對話Gemini CLI 是在終端機使用的 AI 工具,可以讀取專案檔案、協助修改程式與執行工作流程。本篇帶你在 Windows、macOS 或 Linux 完成安裝,確認版本,建立獨立練習資料夾並完成第一次對話。它與 Gemini 網頁、手機 App 的入口不同,適合需要處理本機檔案與程式的人。閱讀全文
動手前怎麼確認權限,動完怎麼看產出
代理要改你的檔案、在你的電腦上跑指令,所以三家都有一組「它可以自己做到哪裡」的設定,名字各不相同,交需求前先看一眼在哪個模式。
- Claude Code 叫權限模式,六個值:default(介面上叫 Manual,多數動作都問你)、acceptEdits、plan、auto、dontAsk、bypassPermissions。官方文件寫明終端機上的 Pro、Max 與 Team 方案起始模式是 auto,由另一個模型代你審查;按 Shift+Tab 切換。
- Codex CLI 分核准政策與沙箱兩層:政策有 on-request、never、granular,沙箱有 workspace-write、read-only 與 danger-full-access。官方把組合包成預設,Auto 等於 workspace-write 加 on-request;輸入 /permissions 直接挑 Auto 或 Read Only。
- Gemini CLI 用旗標 approval-mode,三個值:default 每次工具呼叫都問、auto_edit 自動核准 replace 與 write_file 這類編輯工具、yolo 全部自動核准。沙箱預設關閉,官方寫明用 yolo 時會預設開啟。
# Claude Code:Manual 模式,多數動作都先問你
claude --permission-mode default
# Codex CLI:唯讀沙箱,需要時才要求核准
codex --sandbox read-only --ask-for-approval on-request
# Gemini CLI:自動核准編輯工具,其他工具仍然詢問
gemini --approval-mode auto_edit代理停下來之後,要看的是它到底改了什麼。Claude Code 與 Codex CLI 都有 /diff 列出工作目錄的變更,Codex 還會連 Git 沒追蹤的新檔案一起顯示。要退回去,Claude Code 用 /rewind,Codex 用 /review 複查,Gemini CLI 得先開啟 checkpointing 再用 /restore 還原。真正的驗收仍在你自己:照那五點在瀏覽器裡點過去。
閱讀完整文字說明
三欄對照圖。左欄依序列出五個步驟:安裝、登入、權限確認、脈絡檔案、看產出。Claude Code 用官方安裝指令或 Homebrew、WinGet 安裝,執行 claude 以訂閱或 Console 帳號登入,權限模式有 default、plan、acceptEdits、auto 等六個值,脈絡檔案是 CLAUDE.md,用 /diff 看變更、/rewind 回到檢查點。Codex CLI 用官方安裝指令或 npm、Homebrew 安裝,執行 codex login 以 ChatGPT 帳號或 API 金鑰登入,用 /permissions 選 Auto 或 Read Only 預設,脈絡檔案是 AGENTS.md,用 /diff 看變更、/review 再複查一次。Gemini CLI 用 npm 全域安裝,執行 gemini 後選 Login with Google,旗標 approval-mode 有 default、auto_edit、yolo 三個值,脈絡檔案是 GEMINI.md,先開 checkpointing 再用 /restore 還原。三者的脈絡檔案都用 /init 產生初稿。圖的最下方是三邊共用的驗收條件:同一份提示詞、同一個起點、同一張核對清單,每一輪都記下花了多少時間、用掉多少額度、你自己動手改了幾處。
脈絡檔案、非互動模式與費用怎麼算
三家都讓你把專案規則寫成一個檔案,每次開始自動讀進去:Claude Code 讀 CLAUDE.md,Codex 讀 AGENTS.md,Gemini CLI 預設讀 GEMINI.md,三者都用 /init 產生初稿。要注意官方文件明講 Claude Code 不讀 AGENTS.md,專案已經有 AGENTS.md 的話,在 CLAUDE.md 用一行匯入語法引進來即可。
Claude Code|CLAUDE.md 完整教學Claude Code|CLAUDE.md 完整教學建立專案規範並確認 Claude 有載入。CLAUDE.md 是讓 Claude Code 了解專案長期規矩的文件,適合保存啟動方式、測試要求與重要架構邊界。本篇會用 /init 建立起點,再把自動整理出的內容改成短而可驗證的規範,最後從新工作階段確認載入。讀完後,你能分清楚專案指引與真正控制權限的設定。閱讀全文
GEMINI.md 入門:建立規則與 /initGEMINI.md 入門:建立規則與 /initGEMINI.md 是 Gemini CLI 用來取得專案指示的檔案。把專案目的、語言、測試方式與修改界線寫在這裡,就不必每次重新貼同一段背景。本篇用獨立練習資料夾建立最小規則,並檢查載入結果;這套操作適用 CLI,不會讓 Gemini 網頁版自動讀取電腦中的檔案。閱讀全文
要把代理接進腳本或持續整合流程,三家也都有不進入互動介面、跑完就結束的模式。
# Claude Code:非互動執行,並先指定可用的工具
claude -p "把 rates.json 補上 KRW 幣別" --allowedTools "Read,Edit"
# Codex CLI:非互動執行,輸出 JSON Lines 事件
codex exec "把 rates.json 補上 KRW 幣別" --json
# Gemini CLI:非互動執行,輸出機器可讀的 JSON
gemini -p "把 rates.json 補上 KRW 幣別" --output-format json費用差在「額度從哪裡扣」。Claude Code 走 Claude 訂閱,官網列出 Free 每月 0 美元不含 Claude Code,Pro 每月 20 美元與 Max 每月 100 美元起都寫明包含;也可改用 Claude Console 預付額度,照 API 計價。Codex 走 ChatGPT 訂閱,官網列出 Free 每月 0 美元、Go 每月 8 美元、Plus 每月 20 美元、Pro 每月 100 美元起,超過內含額度後用 credits 續用。Gemini CLI 用 Google 帳號登入有免費層,官方額度頁寫每人每天 1,000 次、每分鐘 60 次請求;Gemini API 金鑰的免費層是每天 250 次、每分鐘 10 次,只到 Flash 模型。
三家都沒把「一天能跑幾個任務」寫成絕對數字:Claude 的 Pro 與 Max 只寫包含 Claude Code,Codex 的 Pro 只寫「比 Plus 多 5 倍或 20 倍的用量」,Google AI Pro 與 AI Ultra 只寫「依固定價訂閱計算」。這三項與台灣實際付款金額都以官網為準。
| 工具 | 安裝與登入 | 權限確認 | 脈絡檔案 | 非互動模式 | 費用方式 |
|---|---|---|---|---|---|
| Claude Code | 官方安裝指令、Homebrew 或 WinGet;執行 claude 後用訂閱或 Console 帳號登入 | 權限模式 default、acceptEdits、plan、auto、dontAsk、bypassPermissions;Shift+Tab 切換 | CLAUDE.md(/init 產生;不讀 AGENTS.md,需自行匯入) | claude -p,可加 --output-format json | Claude 訂閱 Pro 或 Max,或 Claude Console 預付額度照 API 計價 |
| Codex CLI | 官方安裝指令、npm 或 Homebrew;執行 codex 或 codex login,用 ChatGPT 帳號登入 | 核准政策 on-request、never、granular 搭配沙箱 workspace-write、read-only;/permissions 挑預設 | AGENTS.md(/init 產生;全域放在使用者目錄,專案從 Git 根往下逐層疊加) | codex exec,可加 --json | ChatGPT 訂閱 Go、Plus 或 Pro,超過額度用 credits;改用 API 金鑰則照 API 計價 |
| Gemini CLI | npm 全域安裝、npx 或 Homebrew;執行 gemini 後選 Login with Google | approval-mode 三個值:default、auto_edit、yolo;另有工具白名單與沙箱 | GEMINI.md(/init 產生;檔名可設定,/memory 檢視) | gemini -p,可加 --output-format json | Google 帳號免費層每天 1,000 次請求;或用 Gemini API 金鑰、Vertex AI 依用量計費 |
自己在家測:相同提示、相同驗收條件、記三件事
步驟比較只能告訴你流程長什麼樣,不能告訴你哪個工具在你的專案上好不好用。這件事只能自己測,測得有沒有意義取決於條件有沒有固定。
- 同一份提示詞:用上面那段,一字不改。中途想補充的話三邊都要補一樣的內容,不然這一輪作廢。
- 同一個起點:三次都從同一個空資料夾或 Git 提交開始,測完就還原,不要讓下一個工具接手前一個留下的程式碼。
- 同一組驗收條件:把提示詞那五點抄成核對清單,在瀏覽器裡一條條點過去。能跑不等於做對,換算算錯或空白欄位沒提示都算沒過。
- 記時間:從貼上提示詞到驗收通過的分鐘數,包含你自己補提示、重跑與手動修正。
- 記額度:跑完看用量,Claude Code 用 /usage,Codex 用 /status,Gemini CLI 用 /stats。
- 記你改了幾處:代理交件後你動手改了幾個檔案、幾行,這數字比任何跑分都誠實。
同一題至少跑兩輪再下結論,同一個模型跑兩次結果本來就會有差。幾輪之後你多半會發現,差別不在誰比較聰明,而在哪個工具的權限模式跟你比較合拍。想看還有哪些同類工具,站上有一篇總覽。
AI 寫程式工具總覽:Claude Code、Codex、Gemini CLI、Cursor、CopilotAI 寫程式工具總覽:Claude Code、Codex、Gemini CLI、Cursor、Copilot五個常一起出現的寫程式 AI 工具,差別在跑在哪裡:終端機代理、編輯器內建、雲端代理。依 2026 年 9 月官網資料,整理 Claude Code、OpenAI Codex、Gemini CLI、Cursor 與 GitHub Copilot 各自要什麼帳號、有沒有免費額度、入門要多少錢、適合誰,最後給一個「你是哪種人就先裝哪個」的決策,並回答信用卡、中文與 Windows 三個常見問題。閱讀全文
CLI 寫程式:理解、規劃、修改與測試CLI 寫程式:理解、規劃、修改與測試用 Gemini CLI 寫程式,可靠的流程是先理解專案與重現問題,再規劃小範圍修改、檢查差異並執行相關測試。本篇用一個簡單的活動人數函式示範完整工作順序。你不需要一開始就交出整個應用程式,也能學會如何給資料、判斷修改是否對題,以及儲存驗證結果。閱讀全文
同主題延伸閱讀
生活分享
Claude Code、Codex 搭本機模型:兩種接法怎麼選
Claude Code 與 Codex 搭配本機模型有兩種接法:代理照常連雲端、把大量雜務交給腳本或 MCP 工具去問本機模型,或是把代理的模型整個換成本機模型。這篇用資料能不能出門、上下文開得夠不夠長、工作的類型三個問題幫你選,並對照 Ollama、LM Studio、Anthropic 與 OpenAI 的官方文件,分清楚本機權重、Ollama 的 cloud 標籤與供應商端點是三種不同的東西。
生活分享
把本機模型包成 MCP 工具,Claude Code 與 Codex 共用一支伺服器
用官方 Python SDK 寫一支 stdio 的 MCP 伺服器,把本機的 Ollama 模型包成工具,Claude Code 與 Codex 就能共用:工具只收 inbox 底下的路徑,只回分類結果與結果檔路徑,不回信件原文。文中列出兩邊的登記指令、逾時與輸出上限的官方預設值,以及換成別家本機模型只改環境變數 LOCAL_MODEL 的做法,步驟都來自官方文件。
生活分享
把 Claude Code、Codex 整個換成本機模型:Ollama 與 LM Studio 設定與還原
Ollama、LM Studio 與 Codex 的文件寫了把 Claude Code、Codex 整個換成本機模型的接法:Ollama 用 ollama launch 一行指令或手動設定,LM Studio 先開本機伺服器再設環境變數或加 --oss。這篇把四種組合的指令、兩家文件建議的上下文長度、Claude Code 用 /status 確認連到誰的方法,以及用完怎麼還原整理在一起;需要先裝好 Ollama 或 LM Studio,並且已有 Claude Code 或 Codex。
生活分享
Claude Code、Codex 搭本機模型的注意事項:開工前的檢查清單
Claude Code 或 Codex 搭本機模型之前,先照一張表逐項核對:代理讀不讀得到原始檔、現在連的是誰、標籤是不是 :cloud、上下文實際開多長、逾時與輸出量、怎麼驗收。每一項寫怎麼檢查,並指出詳見同組哪一篇,另外收進供應商端點、條款與授權、繁體中文用字檢查;檢查方法取自 Anthropic、OpenAI、Ollama 與 DeepSeek 的官方文件。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算
資料來源
- Claude Code 快速上手(Anthropic 官方文件) · 查證日期:
- Claude Code 權限模式(Anthropic 官方文件) · 查證日期:
- Claude Code CLAUDE.md 與記憶(Anthropic 官方文件) · 查證日期:
- Claude Code 非互動執行(Anthropic 官方文件) · 查證日期:
- Claude Code 指令總表(Anthropic 官方文件) · 查證日期:
- Claude 方案與價格(Anthropic 官網) · 查證日期:
- Codex CLI 安裝與開始(OpenAI 官方文件) · 查證日期:
- Codex 認證方式(OpenAI 官方文件) · 查證日期:
- Codex 核准與沙箱設定(OpenAI 官方文件) · 查證日期:
- Codex AGENTS.md 自訂指令(OpenAI 官方文件) · 查證日期:
- Codex 非互動模式 codex exec(OpenAI 官方文件) · 查證日期:
- Codex 指令總表(OpenAI 官方文件) · 查證日期:
- Codex 方案與價格(OpenAI 官方文件) · 查證日期:
- Gemini CLI 快速上手(Google 官方文件) · 查證日期:
- Gemini CLI 認證設定(Google 官方文件) · 查證日期:
- Gemini CLI 設定與命令列參數(Google 官方文件) · 查證日期:
- Gemini CLI 指令總表(Google 官方文件) · 查證日期:
- Gemini CLI 檢查點與 /restore(Google 官方文件) · 查證日期:
- Gemini CLI 額度與費用(Google 官方文件) · 查證日期: