라이프스타일

xAI Grok 4.7, Amazon Bedrock 출시: 500K 컨텍스트·4단계 추론 강도, AWS가 밝힌 핵심

AWS는 2026년 9월 28일 xAI의 AI 모델 Grok 4.7을 자사 클라우드 AI 플랫폼 Amazon Bedrock에 추가했다고 발표했습니다. 이 글은 AWS가 밝힌 모델 성능, 제3자 평가 수치와 비용 부담, 안전 조치, 리전과 서비스 계층을 정리하고, AWS에서 AI를 도입하는 기업과 개발자에게 어떤 의미가 있는지 설명합니다.

읽는 데 약 9분

xAI Grok 4.7, Amazon Bedrock 출시: 500K 컨텍스트·4단계 추론 강도, AWS가 밝힌 핵심
사진: Mokaair (Original editorial artwork)

무슨 일이 있었나

AWS는 2026년 9월 28일 공식 블로그를 통해 xAI가 개발한 Grok 4.7이 클라우드 AI 플랫폼 Amazon Bedrock에 출시되어 Bedrock 모델 카탈로그에 추가됐다고 발표했습니다. Amazon Bedrock은 기업과 개발자가 여러 AI 모델을 카탈로그에서 골라 AWS 안에서 쓸 수 있게 하는 서비스입니다. AWS는 이 모델을 코딩, 장시간 실행되는 AI 에이전트(여러 단계를 스스로 이어 가며 일을 처리하는 AI), 지식 업무를 위해 만들어진 프런티어 모델(최신 최상위급 모델)이라고 소개했습니다. AWS 글에 따르면 xAI는 2026년 9월 21일 Grok 4.7 발표 글을 공개했습니다.

AWS 글에 따르면 Grok 4.7은 500K 토큰 컨텍스트 윈도를 제공합니다. 토큰은 AI가 글을 처리하는 작은 단위이고, 컨텍스트 윈도는 모델이 한 번에 읽고 참고할 수 있는 분량을 뜻합니다. 모델은 텍스트와 이미지를 입력받아 텍스트를 출력하며, 답을 내기 전에 얼마나 깊이 생각할지 정하는 추론 강도를 low, medium, high, xhigh의 4단계로 설정할 수 있습니다. AWS는 xAI의 설명을 인용해 이 모델이 코딩과 지식 업무에서 xAI의 가장 강력한 모델이며, 어려운 작업에 더 오래 매달리고 다음 단계로 넘어가기 전에 자신의 출력을 더 꼼꼼히 점검하는 것이 특징이라고 전했습니다.

xAI Grok 4.7, Amazon Bedrock 출시: 500K 컨텍스트·4단계 추론 강도, AWS가 밝힌 핵심
Mokaair 편집 검증 절차 · 사진: Mokaair (Original editorial artwork)
자세한 설명 보기

출처를 수집하고 독립적으로 검증한 뒤 Jev가 판단합니다.

xAI가 주장하는 성능과 학습 방식

AWS 글은 xAI의 설명을 다음과 같이 전합니다. Grok 4.7은 더 새롭고 큰 기반 모델을 사용합니다. 또 더 길고 난도 높은 작업으로 강화학습(시행착오와 보상을 통해 모델을 훈련하는 방법)을 거쳤고, 해결에 몇 시간이 걸리는 문제에 의도적으로 무게를 뒀습니다. xAI는 이를 통해 모델이 자신의 작업을 더 잘 검증하고 500K 컨텍스트를 더 효과적으로 활용하게 됐다고 밝혔습니다. 또한 모델은 xAI의 Grok Bot 실행 환경(harness)을 기본적으로 이해하도록 학습됐습니다.

  • 문서 및 프레젠테이션 생성 능력이 강화됐습니다(xAI 주장).
  • 변호사, 간호사, 금융 애널리스트 등 전문 지식 업무에서 향상됐습니다(xAI 주장).
  • xAI의 평가에는 CursorBench, DeepSWE, Terminal-Bench, AA Briefcase, EEBench, Harvey Legal Agent Benchmark, HealthBench Professional이 포함됩니다. 구체적 점수는 AWS 글에 없으며, AWS는 xAI 발표 글을 참조하도록 안내합니다.

제3자 평가 데이터: 향상과 대가

AWS 글은 개발사가 발표한 수치 대신 자체 평가를 실행하는 평가 기관 Artificial Analysis의 데이터를 인용해 Grok 4.7과 Grok 4.6을 비교합니다. AWS는 Grok 4.7이 xhigh 추론 강도에서 측정됐다고 명시했습니다. 표의 Elo는 결과물끼리 비교해 매기는 상대 점수이고, 환각률은 모델이 사실이 아닌 내용을 그럴듯하게 지어내는 비율을 뜻합니다.

출처: AWS 블로그가 인용한 Artificial Analysis 데이터
지표(Artificial Analysis)Grok 4.7Grok 4.6
Intelligence Index4644
Coding Agent Index5647
AA-Briefcase 장기 지식 업무(Elo)1,6571,546
GDPval-AA 전문 업무 성과(Elo)1,6951,605
AA-Omniscience Index3230
AA-Omniscience 환각률29%34%
Intelligence Index 작업당 출력 토큰약 81k약 38k

AWS는 마지막 행의 트레이드오프를 특별히 짚었습니다. 성능 향상에는 작업당 약 2배의 출력 토큰이 따릅니다. 사용자 입장에서는 같은 작업에 더 많은 연산량과 비용이 들 수 있다는 뜻입니다. 그래서 AWS는 기본값을 그대로 쓰기보다 추론 강도를 의도적으로 설정할 것을 권장합니다.

안전 및 보안 조치

AWS 글은 xAI의 설명을 다음과 같이 전합니다. Grok 4.7은 완전히 새로운 안전 보호 아키텍처를 채택했습니다. 또 xAI가 테스트한 모델 중 위험한 요청에 대한 응답 거부와 탈옥(jailbreak, 안전 장치를 우회하도록 유도하는 시도) 저항 측면에서 가장 강력합니다. 보안처럼 방어와 공격 양쪽에 쓰일 수 있는 이중 용도 분야에서, xAI는 모델이 고위험 프롬프트는 극히 일부만 허용하면서도 정당한 보안 업무는 거의 차단하지 않는다고 밝혔습니다. xAI는 또한 초대제로 일부 보안 파트너에게 방어 연구 목적으로 Grok 4.7의 레드팀(공격자 입장에서 약점을 찾는 활동) 기능을 제공하기 시작했습니다.

AWS는 Bedrock 플랫폼에서 Amazon Bedrock Guardrails를 함께 사용해 프롬프트와 응답에 콘텐츠 필터, 금지 주제, 개인 식별 정보 마스킹, 단어 정책을 적용할 수 있다고 설명합니다. 호출 로그는 Amazon CloudWatch에 기록할 수 있습니다. 로그에는 요청, 응답, 추론 토큰 수가 포함되어 장시간 에이전트 실행의 감사 기록으로 활용할 수 있습니다.

Bedrock에서의 제공 방식: 리전과 서비스 계층

AWS 글에 따르면 Grok 4.7은 단일 리전(AWS 데이터센터가 있는 지역)에 고정되지 않고, 교차 리전 추론 프로파일을 통해 제공됩니다. 교차 리전 추론 프로파일은 요청을 여러 리전 중 한 곳으로 보내 처리하는 방식입니다. 모델은 Responses, Chat Completions, InvokeModel, Converse API(프로그램이 모델을 호출하는 방식)를 지원합니다. OpenAI SDK와 호환되어 Amazon Bedrock API 키나 IAM 자격 증명으로 만든 단기 토큰으로 인증할 수 있고, AWS SDK의 Converse 인터페이스로도 사용할 수 있습니다. 반복해서 보내는 프롬프트 앞부분에 캐시 요금이 자동 적용되는 암시적 프롬프트 캐싱도 지원됩니다. 응답 형식을 JSON Schema로 제약해 다른 프로그램이 바로 읽을 수 있게 하는 구조화된 출력도 쓸 수 있습니다. 아래 표의 데이터 레지던시는 데이터를 특정 국가나 지역 안에서 처리해야 하는 요건을 말합니다.

출처: AWS 블로그
프로파일모델 IDAWS가 설명한 특징
Global 교차 리전global.xai.grok-4.7지원되는 모든 상용 AWS 리전으로 라우팅되며, 지리 프로파일보다 저렴하지만 지연 시간이 덜 안정적일 수 있음
US 지리 교차 리전us.xai.grok-4.7처리가 미국 지리 범위 내에 유지되어 미국 데이터 레지던시 요건에 대응

서비스 계층으로 AWS는 세 가지를 제시했습니다. Standard는 토큰 단위 과금이며 약정이 없습니다. Priority는 추가 비용으로 더 빠른 우선 처리를 제공합니다. Flex는 비용이 낮아 실시간이 아닌 작업에 적합합니다. AWS 글에는 구체적 가격이 없으며, AWS는 Amazon Bedrock 요금 페이지를 참조하도록 안내합니다.

일반 독자에게 주는 실질적 영향

  • 대부분의 일반 사용자는 Bedrock을 직접 접하지 않으며, 영향은 주로 기업이나 개발자가 Grok 4.7을 자사 제품과 내부 도구에 통합하는 데서 나옵니다.
  • 이미 AWS를 쓰는 기업에는 같은 플랫폼 안에서 선택할 수 있는 모델이 하나 늘어난 것이며, Guardrails와 로그 등 기존 관리 체계를 그대로 활용할 수 있습니다.
  • 데이터 저장 위치 요건이 있는 기업의 경우, AWS는 US 프로파일이 처리를 미국 범위 내에 유지한다고 밝혔습니다. 다른 지역의 데이터 레지던시 요건은 직접 확인해야 합니다.
  • AWS는 출력 토큰이 이전 세대의 약 2배라고 언급했으므로, 높은 추론 강도를 쓰면 비용과 응답 시간이 늘 수 있습니다. 도입 전에 정말 필요한지 검토하는 것이 좋습니다.

자주 묻는 질문

Grok 4.7은 언제 Amazon Bedrock에 출시됐나요?

AWS는 2026년 9월 28일 공식 블로그에서 출시를 발표했습니다. AWS 글에 따르면 xAI는 2026년 9월 21일 Grok 4.7 발표 글을 공개했습니다.

Grok 4.7의 컨텍스트 윈도는 얼마나 큰가요?

AWS 글에 따르면 Grok 4.7은 500K 토큰 컨텍스트 윈도를 제공하며, low, medium, high, xhigh의 4단계 추론 강도를 지원합니다.

Grok 4.7이 정말 이전 세대보다 나은가요?

AWS가 인용한 Artificial Analysis 데이터에 따르면 Grok 4.7은 여러 지표에서 Grok 4.6보다 높고, 환각률은 34%에서 29%로 낮아졌습니다. 다만 이 수치는 xhigh 추론 강도에서 측정됐으며, 작업당 출력 토큰은 약 2배입니다.

데이터가 처리되는 위치를 선택할 수 있나요?

AWS에 따르면 US 프로파일(us.xai.grok-4.7)은 처리를 미국 지리 범위 내에 유지합니다. Global 프로파일은 지원되는 모든 상용 AWS 리전으로 라우팅될 수 있습니다.

사용 전에 무엇을 확인해야 하나요?

AWS는 첫 호출 전에 Bedrock 콘솔에서 사용하려는 AWS 리전에서 해당 모델을 쓸 수 있는지 확인할 것을 권장합니다. 요금은 Amazon Bedrock 요금 페이지를 참고하세요.

이 주제의 최신 뉴스 보기

최신 여행 소식·가이드

출처

라이프스타일