生活分享
xAI Grok 4.7 登陆 Amazon Bedrock:500K 上下文、四档推理强度,AWS 说明要点
AWS 于 2026 年 9 月 28 日宣布,xAI 的 Grok 4.7 已在其云端 AI 平台 Amazon Bedrock 上线。这主要影响在 AWS 上开发 AI 产品的企业与开发者。本文说明 AWS 公布的模型能力、评测数据、安全措施、区域与服务层级,以及性能提升伴随的成本取舍。
阅读时间约 7 分钟

发生了什么
AWS 于 2026 年 9 月 28 日在其官方博客宣布,xAI 开发的 Grok 4.7 已在云端 AI 平台 Amazon Bedrock 上线,并加入 Bedrock 的模型目录。AWS 称这是一款为编程开发、长时间运行的 AI 代理与知识工作打造的前沿模型。AI 代理指能自行分多个步骤完成任务的 AI 程序。据 AWS 文章,xAI 已于 2026 年 9 月 21 日发表 Grok 4.7 的官方介绍文章。
据 AWS 文章,Grok 4.7 提供 500K token 的上下文窗口。token 是模型处理文字的基本单位;上下文窗口指模型一次能读取和参考的内容量。模型接受文本与图片输入并输出文本,并支持 low、medium、high、xhigh 四个可配置的推理强度等级。推理强度越高,模型在作答前“思考”得越多。AWS 援引 xAI 的说法,称这是 xAI 在编程开发与知识工作上最强的模型,特点是在困难任务上工作更久,并在进入下一步前更仔细地检查自己的输出。
阅读完整文字说明
消息会先收集来源、独立核查,再交由 Jev 判断。
xAI 宣称的能力与训练方式
AWS 文章转述 xAI 的说法:Grok 4.7 使用更新、更大的基础模型,并经过更长、任务难度更高的强化学习训练,刻意偏重需要耗时数小时才能完成的问题。xAI 表示,这让模型更擅长验证自己的工作,也更能有效利用 500K 上下文。此外,模型经过训练,可原生理解 Grok Bot harness。harness 指模型运行时所在的工具框架。
- 文档与演示文稿生成能力更强(据 xAI)。
- 在律师、护士、金融分析师等专业知识工作上有所提升(据 xAI)。
- xAI 的评测涵盖 CursorBench、DeepSWE、Terminal-Bench、AA Briefcase、EEBench、Harvey Legal Agent Benchmark 与 HealthBench Professional。AWS 文章未列出具体成绩,请读者参阅 xAI 的介绍文章。
第三方评测数据:进步与代价
AWS 文章援引评测机构 Artificial Analysis 的数据,比较 Grok 4.7 与上一代 Grok 4.6。AWS 注明 Grok 4.7 是在 xhigh 推理强度下测得。表中的 Elo 是一种通过两两比较得出的相对评分,数值越高表现越好。幻觉率指模型给出不实信息的比例,越低越好。以下数字均引自 AWS 文章。
| 指标(Artificial Analysis) | Grok 4.7 | Grok 4.6 |
|---|---|---|
| Intelligence Index | 46 | 44 |
| Coding Agent Index | 56 | 47 |
| AA-Briefcase 长时程知识工作(Elo) | 1,657 | 1,546 |
| GDPval-AA 专业工作成果(Elo) | 1,695 | 1,605 |
| AA-Omniscience Index | 32 | 30 |
| AA-Omniscience 幻觉率 | 29% | 34% |
| 每个 Intelligence Index 任务的输出 token | 约 81k | 约 38k |
AWS 特别指出最后一行的取舍:性能提升伴随每项任务约两倍的输出 token。对用户而言,这意味着同样的任务可能消耗更多算力与费用。因此 AWS 建议有意识地设置推理强度,而不是直接沿用默认值。
安全与网络安全措施
AWS 文章转述 xAI 的说法:Grok 4.7 采用全新的安全防护架构。在拒答危险请求与抵抗越狱方面,它是 xAI 测试过最强的模型。越狱(jailbreak)指用特殊提示诱使模型绕过安全限制。在网络安全等双重用途领域,即同一知识既可用于防御也可能被滥用的领域,xAI 表示模型只会放行一小部分高风险提示,同时很少阻拦合法的安全工作。xAI 也已开始以邀请制,让部分安全合作伙伴使用 Grok 4.7 的红队能力开展防御研究。红队指模拟攻击者来发现安全弱点。
在 Bedrock 平台上,AWS 表示可搭配 Amazon Bedrock Guardrails,对提示与响应应用内容过滤、禁止主题、个人身份信息遮蔽与词语策略。调用日志可记录到 Amazon CloudWatch,包含请求、响应与推理 token 数,作为长时间代理运行的审计记录。
在 Bedrock 上如何提供:区域与服务层级
据 AWS 文章,Grok 4.7 通过跨区域推理配置文件提供,而非固定于单一区域。也就是说,请求会按配置分派到多个 AWS 数据中心区域处理。模型兼容 OpenAI SDK,可使用 Amazon Bedrock API 密钥或由 IAM 凭证生成的短期令牌进行身份验证,也可通过 AWS SDK 的 Converse 接口使用。平台功能还包括隐式提示缓存,以及以 JSON Schema 约束输出的结构化输出。
| 配置文件 | 模型 ID | AWS 说明的特点 |
|---|---|---|
| Global 跨区域 | global.xai.grok-4.7 | 路由至任何受支持的商用 AWS 区域,价格低于地理配置文件,但延迟可能不够稳定 |
| US 地理跨区域 | us.xai.grok-4.7 | 处理保留在美国地理范围内,满足美国数据驻留需求 |
表中的数据驻留,指数据必须在特定国家或地区内处理的要求。服务层级方面,AWS 列出三种:Standard 按 token 计费、无需承诺;Priority 提供更快的优先处理,需额外付费;Flex 成本较低,适合非实时任务。AWS 文章未列出具体价格,而是请读者查看 Amazon Bedrock 定价页。
对普通读者的实际影响
- 多数普通用户不会直接接触 Bedrock;影响主要来自企业或开发者将 Grok 4.7 集成到自家产品与内部工具中。
- 对已在使用 AWS 的企业,这意味着在同一平台内多了一个可选模型,并可沿用 Guardrails、日志等现有管理机制。
- 若企业对数据存放地点有要求,AWS 表示 US 配置文件可将处理保留在美国范围内;其他地区的数据驻留需求需自行确认。
- AWS 提到输出 token 约为上一代的两倍,使用高推理强度时成本与响应时间可能增加,引入前宜评估是否确有必要。
常见问题
Grok 4.7 是什么时候在 Amazon Bedrock 上线的?
AWS 于 2026 年 9 月 28 日在官方博客宣布上线。据 AWS 文章,xAI 已于 2026 年 9 月 21 日发表 Grok 4.7 的官方介绍文章。
Grok 4.7 的上下文窗口有多大?
据 AWS 文章,Grok 4.7 提供 500K token 的上下文窗口,并支持 low、medium、high、xhigh 四档推理强度。
Grok 4.7 真的比上一代好吗?
AWS 援引 Artificial Analysis 的数据称,Grok 4.7 在多项指标上高于 Grok 4.6,幻觉率由 34% 降至 29%。但这些数字是在 xhigh 推理强度下测得,且每项任务的输出 token 约为上一代的两倍。
可以选择数据在哪里处理吗?
据 AWS,US 配置文件(us.xai.grok-4.7)会将处理保留在美国地理范围内;Global 配置文件则可能路由至任何受支持的商用 AWS 区域。
使用前需要确认什么?
AWS 建议首次调用前,先在 Bedrock 控制台确认该模型在你计划使用的 AWS 区域可用;费用请参考 Amazon Bedrock 定价页。
同主题延伸阅读
生活分享
NVIDIA 推出 DGX Spark 64GB 版:10 月 23 日上市、起价 4,999 美元,两台可串接成 128GB
NVIDIA 于 2026 年 10 月 2 日宣布,个人 AI 电脑 DGX Spark 新增较平价的 64GB 内存版本,10 月 23 日起由 Acer、ASUS 等六家厂商供应,主要面向希望在自己机器上运行 AI 模型的开发者与研究人员。以下整理 NVIDIA 公布的规格、双机串接说法,以及对普通读者的意义。
生活分享
Google Cloud 宣布 Spanner queues 正式推出:把消息队列放进数据库事务,瞄准 AI 智能体可靠性
Google Cloud 宣布 Spanner queues 正式推出,让消息创建成为数据库事务的一部分,目标是解决 AI 智能体“状态”与“动作”不同步的问题。本文整理官方说法、主要功能以及对普通读者的意义。
生活分享
GPT-6.1 Sol 推出:新一版 Sol 上 API、Codex 与 ChatGPT Work,Chat 里没有
OpenAI 在 2026 年 9 月 29 日推出 GPT-6.1 Sol,API 名称是 gpt-6.1-sol:Plus、Pro、Business、Enterprise、Edu 方案的 Codex 与 ChatGPT Work 在首发推出范围内,Enterprise 与 Edu 要管理员启用,Free 与 Go 首发不含,Chat 里没有(2026 年 9 月查证)。
生活分享
Claude Sonnet 5.5 推出:标价与 Sonnet 5 相同,API、云平台与 Claude.ai 都能用
Anthropic 在 2026 年 9 月 28 日推出 Claude Sonnet 5.5,API 标价与 Sonnet 5 相同(每百万 tokens 输入 2 美元、输出 10 美元);Claude.ai、API 与多个云平台可用,较高风险的网络安全请求会退回 Sonnet 5 处理(2026 年 9 月查证)。
最新旅游情报攻略

攻略东京
东京住哪一区:新宿、上野、东京站、涩谷、浅草、池袋、银座七区比较,机场交通、住宿税、行李寄送一次看
东京住哪一区?用同一套标准比较新宿、上野、东京站、涩谷、浅草、池袋、银座七个区域:从成田、羽田机场怎么过来、有哪些线路、周边有什么、街区氛围、适合谁。附比较表与山手线示意图,以及 2026 年 9 月核实的东京都住宿税(2027 年 4 月改为 3%)和机场宅急便寄送行李的规则。
- 预算
- 酒店

攻略东京
东京交通票券怎么选:Suica/Welcome Suica、Tokyo Subway Ticket、JR Pass 值不值得买
第一次去东京,每人先用一张 IC 卡按次付费(Welcome Suica 免押金、有效期 28 天)。一天搭四趟以上地铁,再加买 2,000 日元的 Tokyo Subway Ticket 72 小时券;只玩东京、不去关西,买 JR Pass 一定不划算。用决策图比较 TOURIST PASMO、iPhone 里的 Suica、东京 Metro 一日券能搭什么、不能搭什么;价格于 2026 年 9 月核实。
- 交通
- 预算

攻略东京
东京迪士尼乐园、海洋攻略:票价、梦幻泉乡 Fantasy Springs、尊享卡 DPA 与预约等候卡怎么用,第一次去选哪个园区
东京迪士尼一日护照采用浮动票价,2026 年 9 月平日大多为 9,900 日元、周末为 10,900 日元,官网每天 14:00 开售两个月后同一天的门票;免费的优先通行卡已不在官网服务清单,缩短排队时间只剩付费的迪士尼尊享卡(每人每次 1,000 至 3,500 日元)。另有运营时间与 25 周年活动、预约等候卡与报名体验、梦幻泉乡如何进入,以及第一次去选乐园还是海洋;2026 年 9 月通过东京迪士尼度假区官网核实。
- 行程范例
- 亲子