라이프스타일

Anthropic 9월 위협 인텔리전스 보고서: 일곱 가지 AI 악용과 표적이 된 API 키

Anthropic은 2026년 9월 10일 위협 인텔리전스 보고서를 발표하고 2025년 12월부터 2026년 8월까지 차단한 일곱 가지 유형의 AI 악용을 정리했습니다. 이 글은 보고서가 말하는 것과 말하지 않는 것을 짚고, 일반인이 AI 사기를 막고 계정과 API 키를 보호하며 AI 에이전트 권한을 줄이고 의심스러운 이용을 신고하는 방법을 설명합니다.

수정일: 읽는 데 약 11분

AI 악용 보고서와 계정·키 보호를 표현한 오리지널 일러스트
사진: Mokaair (© Mokaair)

2026년 9월 10일, Anthropic은 위협 인텔리전스 보고서 〈Detecting and countering misuse of AI: September 2026〉을 발표했습니다. 2025년 12월부터 2026년 8월까지 탐지하고 차단한 Claude 악용을 사이버 공격, 영향력 공작, 감시, 사기, 생물학적 악용, 재래식 무기 개발, 불법 증류의 일곱 가지로 나눠 정리했습니다. 사이버 공격 부분에서는 대부분의 활동이 더 이상 묻고 답하는 채팅에 그치지 않고 AI가 직접 실행하거나 총괄하는 형태가 됐으며, API 키도 도난과 재판매의 표적이 됐다고 지적합니다.

이 글은 2026년 9월 15일 공식 웹페이지, 보고서 PDF, Claude 도움말 센터를 바탕으로 확인했습니다. 보고서의 사례, 수치, 배후 지목은 모두 Anthropic의 조사 결론으로, 본 사이트는 이를 독립적으로 검증할 수 없으며 직접 테스트하지도 않았습니다. 이 글은 공격 기법의 세부 내용을 다루지 않으며, 본문의 생활 속 상황은 편집부가 설계한 예시입니다.

이 보고서가 다루는 것과 의미하지 않는 것

보고서는 이번 호가 2025년 3월, 8월, 11월에 이은 새 호라고 설명합니다. 악용된 모델은 Claude Haiku, Sonnet, Opus 계열이며, Anthropic은 불법 증류 사건 한 건을 제외하면 Fable이나 Mythos급 모델이 관련된 사례는 없다고 밝혔습니다. 사례별 조치는 대체로 활동 차단이나 계정 정지, 보호 장치 강화였고, 상황에 따라 정부 기관 및 업계 파트너와 정보를 공유했습니다.

이 보고서를 읽을 때 가장 기억해야 할 것은 Anthropic 스스로의 설명입니다. 이 사례들은 전형적인 악용이 아니라, 회사가 지금까지 발견한 것 중 가장 주목할 만하고 수법이 가장 새로운 활동이라는 것입니다. 한 업체가 자사 플랫폼에서 골라 공개한 개별 사례일 뿐 업계 전체 통계가 아니며, 어느 AI가 더 안전한지 비교하는 근거로 삼을 수도 없습니다.

보고서는 여러 기업과 국가 배후가 의심되는 집단을 지목했는데, 이러한 배후 지목 역시 Anthropic의 평가이며 보고서에는 지목된 당사자들의 입장이 실려 있지 않습니다. 공식 페이지에는 보안 담당자를 위한 침해 지표 파일도 첨부돼 있습니다.

일곱 가지 악용: 보고서의 주요 사례

사이버 공격 부분에 등장하는 행위자에는 국가 지원이 의심되는 집단, 금전 목적의 범죄 조직, 핵티비스트가 포함되며, 한 사람이나 소규모 팀도 AI 에이전트로 여러 피해자를 동시에 노릴 수 있습니다. 영향력 공작 부분에는 9개 사례가 실렸고, 출처는 러시아, 이란, 튀르키예, 걸프 지역, 남아시아, 아프리카, 유럽에 걸쳐 있습니다. 수법에는 가짜 계정, 가짜 뉴스 사이트, 가상 페르소나 등이 있지만, 대부분의 콘텐츠는 실제 반응이 거의 또는 전혀 없었습니다.

감시 부분은 2026년 1월부터 7월까지의 사례를 정리했으며 중국, 이란, 서아프리카, 상업 감시 업체가 관련돼 있습니다. 대만 독자와 관련된 부분은, 중국 정부와 입장을 같이하는 한 정보 활동이 Claude로 종교인 신상 자료를 만들었고 그 대상에 대만기독장로교회 지도부가 포함됐다고 Anthropic이 본다는 점입니다. 다른 한 사례에서는 대만 정치인 등을 감시하는 데 쓰였습니다. 재래식 무기 부분은 6개 사례로 중국 3건, 러시아 2건, 예멘 1건입니다. 생물학적 악용 부분의 5개 사례는 기관, 국가, 병원체를 의도적으로 공개하지 않았으며, Anthropic은 연구자들이 해를 끼칠 의도가 있었다고 단정하지도 않았습니다.

사기 부분은 단 한 건입니다. 중국의 한 앱 스튜디오가 Claude로 20개가 넘는 데이팅 앱을 만들고 AI 페르소나가 실제 사람인 척 채팅하게 했습니다. Anthropic은 2026년 4월 중 2주 동안 4,700개가 넘는 AI 페르소나가 최소 25,000명의 사용자와 대화한 것을 발견했습니다. 불법 증류 부분은 Anthropic의 일방적인 주장입니다. Anthropic은 2026년 2월 처음 공개한 이후 중국 연구소 7곳이 가짜 계정으로 Claude의 답변을 대량 추출해 자사 모델 학습에 쓰던 공격을 추가로 차단했으며, 그중 몇 곳은 자사 사용자의 대화까지 Claude에 보냈고 사용자들은 이를 몰랐을 가능성이 크다고 밝혔습니다.

2026년 9월 15일 확인 기준. 수치는 모두 Anthropic 보고서에 따른 것으로, 본 사이트가 독립적으로 검증하지 않았습니다.
유형보고서 설명공식 수치 또는 범위
사이버 공격AI 에이전트가 정찰·침투 분담한 사례에서 약 4일간 AI 기업 약 30곳 공격
영향력 공작가짜 계정, 가짜 뉴스 사이트, 가상 페르소나9개 사례, 대부분 실제 반응 적음
감시엔지니어링·분석 인력을 AI로 대체2026년 1~7월 사례
사기데이팅 앱에서 AI 페르소나가 사람 행세2주 동안 페르소나 4,700개 이상
생물·재래식 무기이중 용도 생물 연구, 무기 소프트웨어생물 5건, 무기 6건
불법 증류가짜 계정으로 답변 대량 추출중국 연구소 7곳에 대한 주장

채팅에서 에이전트로: API 키가 전리품이 된 이유

Anthropic은 이번 기간 대부분의 사이버 활동이 AI의 직접 실행이나 총괄로 이뤄졌다고 정리합니다. 챗봇에 질문하는 데 그치지 않고 멀티 에이전트 프레임워크로 정찰, 침투, 데이터 탈취를 나눠 맡겼으며, 사람은 주로 표적을 고르고 결과를 검토했습니다. 보고서는 동시에 두 가지를 짚습니다. 가장 중요한 결정은 여전히 사람이 내린다는 점, 그리고 자동화 수준과 초래된 피해는 별개의 문제여서 가장 심각했던 침입 몇 건은 오히려 모든 단계를 사람이 지휘했다는 점입니다.

보고서는 또 이 활동들 가운데 방어자가 한 번도 보지 못한 신기술에 의존한 것은 없었다고 말합니다. 여전히 도난당한 로그인 자격 증명, 패치되지 않은 경계 장비, 인터넷에 노출된 서비스, 피싱 등을 이용했습니다. 달라진 것은 비용입니다. 예전에는 팀 전체가 해야 했던 정찰, 도구 개발, 데이터 정리를 이제 AI 에이전트에 맡겨 병렬로 처리합니다.

보고서에 따르면 AI 키를 손에 넣은 사람은 한 번에 세 가지를 얻습니다. 되팔 수 있는 장물, 원래 주인이 비용을 내는 연산 자원, 그리고 활동이 원래 주인 명의로 기록되는 위장막입니다. 보고서는 이런 키가 정상 고객이 실수로 공개 코드, 모바일 앱 설치 파일, 컨테이너, 웹사이트, 챗봇에 넣어 둔 경우가 많다고 설명합니다. 한 핵티비스트 공격은 꼬박 한 달 동안 훔친 키에 의존해 운영됐습니다. Anthropic은 두 사례에서 키가 모두 고객 환경에서 도난당했으며 자사 시스템은 침해되지 않았다고 밝혔습니다.

보고서는 또 러시아어를 쓰는 한 범죄자가 어느 AI 업체의 자동 평가 샌드박스를 속여 프로덕션 환경 키를 빼낸 뒤, 약 4일 동안 AI 기업 약 30곳을 공격한 사례도 기록했습니다. 목표는 아직 공개되지 않은 Claude 모델을 손에 넣는 것이었지만 모든 경로가 실패했습니다. Claude를 싼값에 판다며 실제로는 트래픽을 다른 모델로 넘기고 구매자의 자격 증명을 훔친 조직도 있었습니다. Anthropic은 AI 서비스는 공인된 경로로만 구매하고, AI 키와 에이전트 연동을 프로덕션 환경 자격 증명처럼 보호하라고 권고합니다.

API 키가 전리품이 된 이유: 보고서가 정리한 세 가지 용도와 자기 보호 원칙
보고서가 정리한, 공격자가 AI 키를 얻었을 때의 세 가지 이점과 키를 프로덕션 환경 자격 증명처럼 보호하는 원칙입니다. · 사진: Mokaair (© Mokaair)

개인과 소규모 팀이 할 수 있는 일

먼저 사기부터 살펴봅니다. 다음은 편집부가 설계한 예시입니다. 지은 씨가 데이팅 앱에서 알게 된 상대는 답장이 빠르고 다정하지만 늘 핑계를 대며 영상 통화를 피하고, 앱은 대화를 이어가려면 포인트를 구매하라고 계속 안내합니다. 보고서 사례에서 AI 페르소나는 영상 통화와 사진 요청을 피하도록 설정돼 있었지만, 운영자는 영상 통화와 SNS 계정 팔로우를 맡을 실제 사람도 모집했습니다. 따라서 글이 자연스럽거나 영상 통화를 해 봤더라도 상대를 믿을 근거가 되지 않습니다. 대화가 결제, 투자, 계정 정보 요구로 넘어가면 일단 멈추고, 직접 찾아본 공식 경로로 확인해야 합니다.

계정의 경우 자주 쓰는 AI 서비스, 이메일, 클라우드 드라이브에 2단계 인증을 켜는 것이 기본이지만 만능은 아닙니다. 보고서에 따르면 공격자는 로그인 후의 세션 자격 증명도 훔치며, 저렴한 AI 서비스를 미끼로 인기 AI 도구를 사칭해 로그인 정보를 훔치는 프로그램을 설치하도록 유도하는 사이트도 있습니다. 따라서 AI 도구는 공식 웹사이트나 공식적으로 안내된 경로로만 설치하고, 비공식 중개업체가 저렴한 AI 서비스를 판매하면 그냥 지나쳐야 합니다.

API를 연동하는 소규모 팀은 Claude 도움말 센터의 API Key Best Practices와 대조해 볼 수 있습니다. 키를 공유하지 말고 공개 포럼, 이메일, 지원 티켓에도 올리지 말 것(상대가 Anthropic이어도 마찬가지), 코드에 적지 말고 환경 변수나 암호화된 시크릿으로 보관할 것, 개발·테스트·프로덕션 환경마다 다른 키를 쓸 것, 정기적으로(예: 90일마다 한 번) 교체할 것, 그리고 코드 저장소에서 secret scanning을 켤 것입니다. 보고서에도 개발자가 서비스 토큰을 한 중국 연구소의 코딩 어시스턴트에 붙여 넣었고 그 내용이 Claude로 전달된 예가 나옵니다.

AI 에이전트에 권한을 줄 때는 최소화가 원칙입니다. 보고서가 꼽은, 공격자가 유출된 토큰을 찾는 곳에는 피해자가 직접 배포한 AI 에이전트도 포함됩니다. 편집부가 설계한 상황으로 보면, 3인 스튜디오가 AI 에이전트에게 고객 메일 정리를 맡긴다면 지정한 메일함의 읽기 권한만 열어 주고 결제나 클라우드 관리용 키는 넣지 않습니다. 도움말 센터도 Console에서 키 사용 기록을 정기적으로 확인해 이상 징후를 일찍 발견하라고 권장합니다.

의심스러운 이용을 신고하는 방법과 이런 보고서를 보는 법

자신의 Claude API 키가 유출됐다고 의심되면 도움말 센터는 즉시 폐기하라고 권장합니다. Claude Console에 로그인해 API keys 페이지에서 해당 키를 삭제하면 됩니다. 도움말 센터는 또 Anthropic이 GitHub의 Secret scanning partner program에 참여하고 있어, 공개 저장소에서 탐지된 Claude API 키는 자동으로 비활성화되고 사용자에게 이메일로 알림이 간다고 설명합니다.

Claude가 생성한 내용이나 다른 사람이 공유한 Claude 대화가 이용 정책이나 현지 법률을 위반한 것으로 의심되면, 도움말 센터에 안내된 콘텐츠 신고 양식으로 신고할 수 있으며 공유된 대화 페이지에도 신고 버튼이 있습니다. 모델 안전성 문제는 도움말 센터가 문제를 재현할 수 있을 만큼의 세부 정보를 담아 usersafety@anthropic.com으로 메일을 보내 달라고 요청합니다. 신고할 때 자신의 비밀번호나 키는 첨부하지 마세요.

이런 보고서는 AI가 악용되는 실제 모습을 보여 주지만 불안해할 필요는 없습니다. 영향력 공작 콘텐츠는 대부분 실제 반응이 적었고, Anthropic도 생물학적 사례가 Claude로 인해 임박한 생물학적 위협이 이미 생겼다는 뜻은 아니라고 분명히 밝혔습니다. 더 현실적인 대응은 이를 계기로 자신의 계정, 키, AI 도구 권한을 점검하는 것입니다.

최신 여행 소식·가이드

출처

라이프스타일