生活分享

三大助手日常比較:同題操作與評分方法

Gemini、ChatGPT 與 Claude 都能協助處理日常文字和資料,但選擇時要比較自己會做的任務、資料入口與核對成本。本篇提供同一套摘要、回信與搜尋題目,並整理官方確認的功能差異。這是一篇官方功能比較與可重做的練習,不是三款模型的實測排行榜。

更新日期: 閱讀時間約 6 分鐘

同題比較要固定條件的原創插畫,以文件、裝置與流程等物件呼應同題操作與評分方法;非產品介面。
圖片:Mokaair (© Mokaair)
本篇目錄
  1. 查證範圍與結果狀態
  2. 開始前:固定條件纔有可比性
  3. 官方功能比較:資料與工作空間
  4. 題目一:摘要與缺漏處理
  5. 題目二:回信與承諾控制
  6. 題目三:搜尋與來源查核
  7. 如何保存實際比較紀錄
  8. 常見問題
  9. 完成後的檢核

Gemini、ChatGPT 與 Claude 都能協助處理日常文字和資料,但選擇時要比較自己會做的任務、資料入口與核對成本。本篇提供同一套摘要、回信與搜尋題目,並整理官方確認的功能差異。這是一篇官方功能比較與可重做的練習,不是三款模型的實測排行榜。

記錄環境:模型、方案與工具;保存結果:保留每一輪原文;同一標準:看事實與修改成本
同題比較要固定條件。此為原創教學圖解,並非產品畫面或實測輸出。 · 圖片:Mokaair (© Mokaair)

查證範圍與結果狀態

查證日期為 2026 年 9 月 14 日,使用 Windows 電腦查閱三家官方文件。這次沒有在三個登入帳號中選定模型、執行同題或測量速度,因此沒有生成結果、分數與耗時排名。下方的預期答案均由題目原文人工整理,用來驗收,不冒充任何產品的回覆。

官方功能比較能回答「可從哪裡加入資料、如何要求搜尋、如何保存共用指示」,不能回答「哪個中文一定最好」或「哪個永遠最準」。功能還受方案、平臺、地區與工作區設定影響,正式採用前應在自己的帳號重做代表性任務。

開始前:固定條件纔有可比性

準備三個產品的合法可用帳號與相同測試檔案,先記下日期、時區、產品入口、方案、畫面顯示模型及工具設定。若某產品不公開模型名稱,寫未顯示,不根據答案風格猜測。沒有某個功能時記為該帳號不可用,不能直接評為模型答錯。

每題開新對話,先停用會影響結果的自訂指示或記錄其內容;關閉不需要的資料連接。摘要與回信題只使用給定文字,搜尋題才明確要求查網路。若一邊使用研究工具、另一邊只用普通聊天,應把它寫成不同工作流程,而不是相同條件比較。

官方功能比較:資料與工作空間

Gemini 可在對話加入支援檔案,並透過 Gems 保存指示與參考資料;資料位於 Google 服務時,可檢查 Connected Apps 或 Workspace 原生整合。這有助於減少某些工作中的複製步驟,但不保證答案較正確。操作細節見與。

ChatGPT 可附加檔案,Projects「專案」可集中聊天、來源和專案指示。官方文件也區分一般 Chat 與處理完整成果的 Work。網頁專案不等於直接存取你電腦整個資料夾,仍需上傳或連接資料;用本篇短題練習時先選一般聊天,避免混入不同工作模式。

Claude 可將檔案加到單次對話或專案知識,Projects 也能設定專案指示。官方上傳文件另指出 XLSX 需要啟用程式執行與檔案建立能力。若題目只是純文字摘要,先直接貼相同文字,更容易排除上傳解析方式造成的差異。

三者的共用指示都應寫明來源與缺漏規則,但不用假設它們讀取相同本機檔案。尤其是 Gemini CLI 的工作環境指示,不是所有聊天產品都會自動載入的通用設定檔。

題目一:摘要與缺漏處理

三款產品使用相同提示詞 · text
只根據下列資料回答,使用繁體中文,不搜尋網路。
整理成活動日期、地點、名額、費用、報名截止日期五個欄位。
沒有提供的資訊寫「未提供」,保留暫定狀態,不自行推算。
資料:社區講座暫定 2026 年 10 月 10 日下午 2 點舉行,
地點尚未確認,名額 24 人,免費參加,尚未提供報名截止日期。
最後列出兩個需要向主辦人確認的問題。

人工參考答案是暫定十月十日下午兩點、地點未確認、二十四人、免費、截止日期未提供。核對五欄是否全部存在,是否把暫定改成確定,以及是否編造報名網址。文字長短先不評分,因為最重要的是事實和狀態沒有被改寫。

若某答案錯了,保存第一次完整回覆,再用相同追問要求它指出資料依據。記錄需要幾輪才修正,不能只拿某款第三輪最佳答案,對比另一款第一輪答案。最後一次結果與原始結果都保留,才能看出返工成本。

題目二:回信與承諾控制

回信練習 · text
請把以下內容改成禮貌、清楚的繁體中文回信,約 120 字內。
對方詢問能否加開講座名額,目前主辦人尚未決定。
我能做的是先登記意願,再於確認後通知;不能承諾一定有名額。
請保留這個限制,不增加優惠、優先權或回覆期限。
只輸出回信草稿,不寄出。

檢查回信是否承諾了題目未授權的事,例如「一定為您保留」或「明天通知」。語氣好不好可以由兩位讀者各自評分,但限制有沒有保留應直接看文字。若要比較字數,先約定是否包含標點與英文,避免使用不同計算方法。

此題的可用成果不是一封最華麗的信,而是一封不用刪掉錯誤承諾的草稿。記下自己實際修改的句子,以及修改是出於事實、語氣還是格式。這能幫助你選適合工作習慣的工具,不能推出所有寫作任務的普遍排名。

題目三:搜尋與來源查核

三者都有官方文件說明的網路搜尋能力,但入口和開啟條件不同。ChatGPT 可明確要求查詢最新資訊並查看搜尋與引用;Claude 可在加號選單啟用 Web search,團隊帳號可能先需管理者開放;Gemini 的搜尋與資料連線另見。

搜尋練習 · text
請搜尋 Google 官方文件,說明 Gemini CLI 的 GEMINI.md 有什麼用途。
提供三個可開啟的官方來源連結,並把文件直接支持的事實與你的推論分開。
指出資料查詢日期,以及哪些版本或平臺條件尚未確認。
不要把 Gems 的介面指示當成會自動讀取本機 GEMINI.md。

這題檢查來源是否真的來自官方、能否開啟、是否支持旁邊的說法,以及有沒有混淆產品。不要只計算連結數量;三個無關首頁比一個精準章節更難核對。對版本相關說法,可用本系列作為深入閱讀入口。

如何保存實際比較紀錄

每一輪建立一列紀錄,包含完整提示詞、原始回覆檔名、模型、工具、耗時、錯誤與人工修改。搜尋題還要存來源網址與查閱日期,因為網站可能改版。以下是本篇目前的真實狀態範例,不是等待填滿的成績表。

comparison-status.json · json
{
  "checked_on": "2026-09-14",
  "method": "official_documentation_comparison",
  "platform": "Windows, official documentation review",
  "gemini_live_test": false,
  "chatgpt_live_test": false,
  "claude_live_test": false,
  "performance_ranking": null,
  "expected_answers": "human-authored from the supplied exercise text"
}

常見問題

「哪個最適合我?」選自己最常做的三種工作,按事實正確、指示遵守、來源可查和修改成本比較,再考慮資料入口。單一題目的最高分不代表所有任務都最適合。

「免費和付費可以直接比嗎?」可以比較自己的使用選擇,但要公開方案與限制,不能把結果描述成相同能力條件下的模型比較。費用與額度也要以實際地區和當時方案為準。

「為什麼同一產品重做會不同?」生成內容可能變動,模型和工具也可能更新。保留日期與設定,多題重做再判斷穩定性;不要只截取一次特別好或特別差的結果。

「可以用本文說某款勝出嗎?」不行。本文完成的是官方功能與測試方法整理,沒有三款同題實測證據;實際排名必須由保存的結果和一致評分規則支持。

完成後的檢核

完成實作後逐項確認。
檢查項目通過條件
操作能依正文重做一次,說明每一步使用的輸入。
結果能用原始資料或可重現測試核對輸出,而非只看語氣。
延伸知道下一篇教學解決的問題,以及什麼時候需要它。

接著可以閱讀 、,把本篇的操作接到下一個工作流程。

  • 生活分享

    通義千問 Qwen:開放權重模型家族與 Qwen Studio

    阿里巴巴的通義千問 Qwen 一邊把權重放上 Hugging Face 讓人下載,一邊經營叫 Qwen Studio(原 Qwen Chat)的網頁與 App。這篇用 2026 年 9 月查證的官方頁面,說清楚家族成員、模型卡上的參數規模與上下文視窗、Apache 2.0 與兩份 Qwen 授權差在哪、台灣能不能註冊,以及國際站 Qwen Cloud 與中國站阿里雲百煉的 API 價格。

  • 生活分享

    Mistral Vibe(原 Le Chat):歐洲 AI 助手的方案、功能與資料存放

    法國 Mistral AI 的 Le Chat 已改名為 Vibe,分成 Work、Code、Chat 三種模式。這篇整理官網當天的內容:台灣怎麼註冊與下載、Free 與每月 14.99 美元的 Pro 等四個方案給什麼、官方列出的功能、Mistral Large 3 等模型與 Apache 2.0 開放權重、API 每百萬 token 價格,以及資料預設存在歐盟、訓練開關怎麼關。

  • 生活分享

    MiniMax M 系列模型:開放權重、授權條款與 API 價格

    M 系列是 MiniMax 的文字模型線,從 M1 一路做到 M3。這篇照 2026 年 9 月 14 日官網、API 文件與 Hugging Face 官方組織頁的內容,整理現有版本與時序、參數與上下文視窗、每一代授權能不能商用、API 每百萬 token 的價格與訂閱方案、本機執行的硬體需求,並說明開放權重和開源的差別,以及 M 系列和海螺影片、語音、音樂模型的分工。

  • 生活分享

    MiniMax Agent 怎麼用:一句話做出網頁、報告與簡報

    MiniMax Agent 是 MiniMax 的代理產品,你寫一句話,它自己規劃、上網查、寫檔案,最後交出網頁、報告或簡報。這篇照 2026 年 9 月 14 日的官網頁面,說明網頁版與桌面版的入口、台灣帳號怎麼註冊、一次任務從描述到修改的流程、它會動用哪些工具、產出能匯出成哪些格式、免費額度與付費方案的月費,以及服務條款與隱私政策對上傳內容、內容審核和帳號刪除實際寫了什麼。

最新旅遊情報攻略

資料來源

生活分享