生活分享

xAI Grok 4.7 登陆 Amazon Bedrock:500K 上下文、四档推理强度,AWS 说明要点

AWS 于 2026 年 9 月 28 日宣布,xAI 的 Grok 4.7 已在其云端 AI 平台 Amazon Bedrock 上线。这主要影响在 AWS 上开发 AI 产品的企业与开发者。本文说明 AWS 公布的模型能力、评测数据、安全措施、区域与服务层级,以及性能提升伴随的成本取舍。

阅读时间约 7 分钟

xAI Grok 4.7 登陆 Amazon Bedrock:500K 上下文、四档推理强度,AWS 说明要点
图片:Mokaair (Original editorial artwork)

发生了什么

AWS 于 2026 年 9 月 28 日在其官方博客宣布,xAI 开发的 Grok 4.7 已在云端 AI 平台 Amazon Bedrock 上线,并加入 Bedrock 的模型目录。AWS 称这是一款为编程开发、长时间运行的 AI 代理与知识工作打造的前沿模型。AI 代理指能自行分多个步骤完成任务的 AI 程序。据 AWS 文章,xAI 已于 2026 年 9 月 21 日发表 Grok 4.7 的官方介绍文章。

据 AWS 文章,Grok 4.7 提供 500K token 的上下文窗口。token 是模型处理文字的基本单位;上下文窗口指模型一次能读取和参考的内容量。模型接受文本与图片输入并输出文本,并支持 low、medium、high、xhigh 四个可配置的推理强度等级。推理强度越高,模型在作答前“思考”得越多。AWS 援引 xAI 的说法,称这是 xAI 在编程开发与知识工作上最强的模型,特点是在困难任务上工作更久,并在进入下一步前更仔细地检查自己的输出。

xAI Grok 4.7 登陆 Amazon Bedrock:500K 上下文、四档推理强度,AWS 说明要点
Mokaair 编辑核查流程 · 图片:Mokaair (Original editorial artwork)
阅读完整文字说明

消息会先收集来源、独立核查,再交由 Jev 判断。

xAI 宣称的能力与训练方式

AWS 文章转述 xAI 的说法:Grok 4.7 使用更新、更大的基础模型,并经过更长、任务难度更高的强化学习训练,刻意偏重需要耗时数小时才能完成的问题。xAI 表示,这让模型更擅长验证自己的工作,也更能有效利用 500K 上下文。此外,模型经过训练,可原生理解 Grok Bot harness。harness 指模型运行时所在的工具框架。

  • 文档与演示文稿生成能力更强(据 xAI)。
  • 在律师、护士、金融分析师等专业知识工作上有所提升(据 xAI)。
  • xAI 的评测涵盖 CursorBench、DeepSWE、Terminal-Bench、AA Briefcase、EEBench、Harvey Legal Agent Benchmark 与 HealthBench Professional。AWS 文章未列出具体成绩,请读者参阅 xAI 的介绍文章。

第三方评测数据:进步与代价

AWS 文章援引评测机构 Artificial Analysis 的数据,比较 Grok 4.7 与上一代 Grok 4.6。AWS 注明 Grok 4.7 是在 xhigh 推理强度下测得。表中的 Elo 是一种通过两两比较得出的相对评分,数值越高表现越好。幻觉率指模型给出不实信息的比例,越低越好。以下数字均引自 AWS 文章。

数据来源:AWS 博客援引 Artificial Analysis 数据
指标(Artificial Analysis)Grok 4.7Grok 4.6
Intelligence Index4644
Coding Agent Index5647
AA-Briefcase 长时程知识工作(Elo)1,6571,546
GDPval-AA 专业工作成果(Elo)1,6951,605
AA-Omniscience Index3230
AA-Omniscience 幻觉率29%34%
每个 Intelligence Index 任务的输出 token约 81k约 38k

AWS 特别指出最后一行的取舍:性能提升伴随每项任务约两倍的输出 token。对用户而言,这意味着同样的任务可能消耗更多算力与费用。因此 AWS 建议有意识地设置推理强度,而不是直接沿用默认值。

安全与网络安全措施

AWS 文章转述 xAI 的说法:Grok 4.7 采用全新的安全防护架构。在拒答危险请求与抵抗越狱方面,它是 xAI 测试过最强的模型。越狱(jailbreak)指用特殊提示诱使模型绕过安全限制。在网络安全等双重用途领域,即同一知识既可用于防御也可能被滥用的领域,xAI 表示模型只会放行一小部分高风险提示,同时很少阻拦合法的安全工作。xAI 也已开始以邀请制,让部分安全合作伙伴使用 Grok 4.7 的红队能力开展防御研究。红队指模拟攻击者来发现安全弱点。

在 Bedrock 平台上,AWS 表示可搭配 Amazon Bedrock Guardrails,对提示与响应应用内容过滤、禁止主题、个人身份信息遮蔽与词语策略。调用日志可记录到 Amazon CloudWatch,包含请求、响应与推理 token 数,作为长时间代理运行的审计记录。

在 Bedrock 上如何提供:区域与服务层级

据 AWS 文章,Grok 4.7 通过跨区域推理配置文件提供,而非固定于单一区域。也就是说,请求会按配置分派到多个 AWS 数据中心区域处理。模型兼容 OpenAI SDK,可使用 Amazon Bedrock API 密钥或由 IAM 凭证生成的短期令牌进行身份验证,也可通过 AWS SDK 的 Converse 接口使用。平台功能还包括隐式提示缓存,以及以 JSON Schema 约束输出的结构化输出。

数据来源:AWS 博客
配置文件模型 IDAWS 说明的特点
Global 跨区域global.xai.grok-4.7路由至任何受支持的商用 AWS 区域,价格低于地理配置文件,但延迟可能不够稳定
US 地理跨区域us.xai.grok-4.7处理保留在美国地理范围内,满足美国数据驻留需求

表中的数据驻留,指数据必须在特定国家或地区内处理的要求。服务层级方面,AWS 列出三种:Standard 按 token 计费、无需承诺;Priority 提供更快的优先处理,需额外付费;Flex 成本较低,适合非实时任务。AWS 文章未列出具体价格,而是请读者查看 Amazon Bedrock 定价页。

对普通读者的实际影响

  • 多数普通用户不会直接接触 Bedrock;影响主要来自企业或开发者将 Grok 4.7 集成到自家产品与内部工具中。
  • 对已在使用 AWS 的企业,这意味着在同一平台内多了一个可选模型,并可沿用 Guardrails、日志等现有管理机制。
  • 若企业对数据存放地点有要求,AWS 表示 US 配置文件可将处理保留在美国范围内;其他地区的数据驻留需求需自行确认。
  • AWS 提到输出 token 约为上一代的两倍,使用高推理强度时成本与响应时间可能增加,引入前宜评估是否确有必要。

常见问题

Grok 4.7 是什么时候在 Amazon Bedrock 上线的?

AWS 于 2026 年 9 月 28 日在官方博客宣布上线。据 AWS 文章,xAI 已于 2026 年 9 月 21 日发表 Grok 4.7 的官方介绍文章。

Grok 4.7 的上下文窗口有多大?

据 AWS 文章,Grok 4.7 提供 500K token 的上下文窗口,并支持 low、medium、high、xhigh 四档推理强度。

Grok 4.7 真的比上一代好吗?

AWS 援引 Artificial Analysis 的数据称,Grok 4.7 在多项指标上高于 Grok 4.6,幻觉率由 34% 降至 29%。但这些数字是在 xhigh 推理强度下测得,且每项任务的输出 token 约为上一代的两倍。

可以选择数据在哪里处理吗?

据 AWS,US 配置文件(us.xai.grok-4.7)会将处理保留在美国地理范围内;Global 配置文件则可能路由至任何受支持的商用 AWS 区域。

使用前需要确认什么?

AWS 建议首次调用前,先在 Bedrock 控制台确认该模型在你计划使用的 AWS 区域可用;费用请参考 Amazon Bedrock 定价页。

查看同分类最新消息

最新旅游情报攻略

资料来源

生活分享