生活分享

Anthropic 九月威脅情報報告:七類 AI 濫用與被盯上的 API 金鑰

Anthropic 於 2026 年 9 月 10 日發布威脅情報報告,整理 2025 年 12 月至 2026 年 8 月間阻斷的七類 AI 濫用。本文說明報告寫了什麼、沒寫什麼,以及一般人防範 AI 詐騙、保護帳號與 API 金鑰、限縮 AI 代理權限與回報可疑用途的做法。

更新日期: 閱讀時間約 8 分鐘

AI 濫用報告與帳號、金鑰防護的原創插圖
圖片:Mokaair (© Mokaair)

2026 年 9 月 10 日,Anthropic 發布威脅情報報告〈Detecting and countering misuse of : September 2026〉,整理 2025 年 12 月至 2026 年 8 月間偵測並阻斷的 Claude 濫用,分為網路攻擊、影響力操作、監控、詐騙、生物濫用、常規武器開發與非法蒸餾七類。網路攻擊部分指出,多數行動已不只是一問一答的聊天,而是由 AI 直接執行或統籌;API 金鑰也成了被偷、被轉賣的目標。

本文於 2026 年 9 月 15 日查核,依據官方網頁、報告 PDF 與 Claude 說明中心整理。報告的案例、數字與歸因都是 Anthropic 的調查結論,本站無法獨立驗證,也未實測;本文不介紹攻擊手法細節,文中生活情境是編輯設計的例子。

這份報告涵蓋什麼,又不代表什麼

報告說明這是繼 2025 年 3 月、8 月與 11 月之後的新一期。被濫用的是 Claude Haiku、Sonnet 與 Opus 系列;Anthropic 表示,除一起非法蒸餾案外,沒有案例涉及 Fable 或 Mythos 等級模型。各案處置大致是阻斷活動或將帳號停權、強化防護,並視情況與政府機關和業界夥伴分享情報。

讀這份報告最該記住的,是 Anthropic 自己的說法:這些案例不是典型的濫用,而是它至今發現最值得注意、手法最新的活動。這是一家廠商從自家平台挑選揭露的個案,不是全產業統計,也不能拿來比較哪家 AI 比較安全。

報告點名不少公司與疑似國家背景的團體,這些歸因同樣是 Anthropic 的評估,報告沒有收錄被點名對象的回應。官方頁另附給資安人員的入侵指標檔案。

七類濫用:報告裡的重點案例

網路攻擊一節的行動者包括疑似國家支持的團體、金錢動機的犯罪集團與駭客行動主義者,一個人或小組就能靠 同時對多個受害者下手。影響力操作一節收錄 9 個案例,來源涵蓋俄羅斯、伊朗、土耳其、波斯灣、南亞、非洲與歐洲,手法包括假帳號、假新聞網站與虛構人設,但多數內容很少或沒有真實互動。

監控一節整理 2026 年 1 月至 7 月間的案例,涉及中國、伊朗、西非與商業監控業者。與台灣讀者相關的是,Anthropic 認為一個與中國政府立場一致的情報行動用 Claude 替宗教人士建立檔案,對象包括台灣基督長老教會的領導層;另一案則被用來監看台灣政治人物等對象。常規武器一節有 6 個案例,3 個在中國、2 個在俄羅斯、1 個在葉門。生物濫用一節 5 個案例刻意不公開機構、國家與病原,Anthropic 也未斷定研究者有意造成傷害。

詐騙一節只有一案:一家中國的 App 工作室用 Claude 打造超過 20 款交友 App,讓 AI 人設冒充真人聊天;Anthropic 在 2026 年 4 月的兩週內,發現超過 4,700 個 AI 人設與至少 25,000 名使用者對話。非法蒸餾一節是 Anthropic 單方的指控:它表示自 2026 年 2 月首次揭露以來,又阻斷 7 家中國實驗室以假帳號大量擷取 Claude 回答、訓練自家模型的攻擊,其中幾家還把自家使用者的對話送進 Claude,使用者很可能不知情。

2026 年 9 月 15 日查核;數字皆為 Anthropic 報告所述,本站未獨立驗證。
類別報告描述官方數字或範圍
網路攻擊AI 代理分工偵察與入侵一案約 4 天攻擊約 30 家 AI 公司
影響力操作假帳號、假新聞站、虛構人設9 個案例,多數少有真實互動
監控以 AI 代替工程與分析人力2026 年 1 至 7 月間案例
詐騙交友 App 以 AI 人設冒充真人兩週內逾 4,700 個人設
生物與常規武器兩用生物研究、武器軟體生物 5 案、武器 6 案
非法蒸餾假帳號大量擷取回答指控 7 家中國實驗室

從聊天到代理:API 金鑰為何成了戰利品

Anthropic 歸納,本期多數網路行動由 AI 直接執行或統籌,不再只是向聊天機器人發問,而是用框架分頭偵察、入侵與竊取資料,人類主要負責選定目標和檢視成果。報告同時提醒兩點:人類仍握有最關鍵的決定;自動化程度和造成的傷害也是兩回事,幾起最嚴重的入侵反而每一步都由人指揮。

報告也說,這些行動都沒有依賴防守方從未見過的新技術,用的仍是被盜的登入憑證、未修補的邊界設備、暴露在網路上的服務與網路釣魚等。改變的是成本:過去要一整個團隊做的偵察、工具開發與資料整理,現在交給 AI 代理平行處理。

報告說,拿到 AI 金鑰的人一次得到三樣東西:可以轉賣的贓物、由原主付費的運算資源,以及把活動記在原主名下的掩護。報告提到,這些金鑰常是合法客戶不小心放進公開程式碼、手機 App 安裝檔、容器、網站與聊天機器人;有一場駭客行動主義者的攻擊,整整一個月都靠偷來的金鑰運作。Anthropic 說明,有兩案的金鑰都是從客戶環境偷走,自家系統未被入侵。

報告另記錄一名俄語犯罪者,從一家 AI 廠商的自動沙盒騙出正式環境金鑰,後續又在約 4 天內攻擊約 30 家 AI 公司;目標是取得尚未發布的 Claude 模型,但每條途徑都失敗。也有集團低價兜售 Claude,實際把流量轉給其他模型並偷走買家憑證。Anthropic 建議 AI 服務只從授權管道購買,並把 AI 金鑰與代理整合當成正式環境憑證來保護。

API 金鑰為何成了戰利品:報告歸納的三種用途與自保原則
報告歸納攻擊者拿到 AI 金鑰的三種好處,以及把金鑰當正式環境憑證保護的原則。 · 圖片:Mokaair (© Mokaair)

一般人與小型團隊可以做的事

先從詐騙說起。以下是編輯設計的例子:小芸在交友 App 認識的對象回覆體貼又快,卻總找理由不視訊,App 則不斷提示購買點數才能繼續聊。報告的案例中,AI 人設被設定為迴避視訊與照片要求,但業者也招募真人負責視訊和追蹤社群帳號。所以文字流暢、甚至視訊過,都不足以證明對方可信;話題一旦轉到付款、投資或索取帳號資料,就該暫停,改用自己查到的官方管道確認。

帳號方面,替常用的 AI 服務、電子郵件與雲端硬碟開啟兩步驟驗證是基本功,但不是萬能。報告提到,攻擊者也會竊取登入後的工作階段憑證,還有網站以便宜 AI 服務為餌,誘人安裝假冒熱門 AI 工具、會竊取登入資訊的程式。因此 AI 工具只從官方網站或官方公布的管道安裝;看到非官方中介兜售便宜的 AI 服務,直接略過。

串接 API 的小團隊可對照 Claude 說明中心的金鑰守則:不分享金鑰,也不貼在公開論壇、電子郵件或客服工單,對象是 Anthropic 也一樣;用環境變數或加密機密存放,別寫進程式碼;開發、測試與正式環境分用不同金鑰;定期輪替,例如每 90 天一次;並在程式碼儲存庫開啟機密掃描。報告就舉了開發者把服務權杖貼進某中國實驗室的程式助手、內容被轉送給 Claude 的例子。

給 AI 代理權限時,原則是最小化。報告列出攻擊者搜尋外洩權杖的地方,就包括受害者自己部署的 AI 代理。以編輯設計的情境來說,三人工作室讓 AI 代理整理客戶來信,就只開放讀取指定信箱,不放入付款或雲端管理的金鑰;說明中心也建議定期檢查 Console 的金鑰用量紀錄,及早發現異常。

發現可疑用途怎麼回報,以及怎麼看待這類報告

如果懷疑自己的 Claude API 金鑰外洩,說明中心建議立即撤銷:登入 Claude Console,到 API 金鑰頁面刪除該金鑰。說明中心也表示,Anthropic 參與 GitHub 的機密掃描合作夥伴計畫,公開儲存庫中被偵測到的 Claude API 金鑰會自動停用,並寄信通知使用者。

若 Claude 產出或他人分享的 Claude 對話疑似違反使用政策或當地法律,可以透過說明中心列出的內容檢舉表單回報,分享的對話頁面上也有檢舉按鈕;模型安全性的問題,說明中心請使用者寄信到 usersafety@anthropic.com,並附上足以重現問題的細節。回報時不要附上自己的密碼或金鑰。

這類報告讓人看見 AI 被濫用的實際樣貌,但不必恐慌:影響力操作的內容多數少有真實互動,Anthropic 也明說生物案例不代表 Claude 已帶來迫在眉睫的生物威脅。比較實際的做法,是藉機檢查自己的帳號、金鑰與 AI 工具權限。

最新旅遊情報攻略

資料來源

生活分享