生活分享

xAI 的 Grok 4.7 登上 Amazon Bedrock:企業可在 AWS 上使用,表現提升但每項任務輸出量約增一倍

AWS 於 2026 年 9 月 28 日宣布,xAI 的 AI 模型 Grok 4.7 已可在 AWS 的雲端 AI 平台 Amazon Bedrock 上使用。這主要影響在 AWS 上開發產品的企業與開發者。AWS 引述的評測顯示,模型多項表現提升、幻覺率下降,但每項任務產生的輸出量約為前代兩倍,可能推高使用成本。

閱讀時間約 7 分鐘

xAI 的 Grok 4.7 登上 Amazon Bedrock:企業可在 AWS 上使用,表現提升但每項任務輸出量約增一倍
圖片:Mokaair (Original editorial artwork)

發生了什麼事

AWS 於 2026 年 9 月 28 日在官方部落格宣布,xAI 開發的 Grok 4.7 已在 Amazon Bedrock 上線,並加入 Bedrock 的模型目錄。Amazon Bedrock 是 AWS 的雲端 AI 平台,企業可以在上面呼叫不同公司的 AI 模型。AWS 稱 Grok 4.7 是一款為程式開發、長時間執行的 AI 代理與知識工作打造的前沿模型;AI 代理指能自行分步驟完成任務的 AI。據 AWS 文章,xAI 已在 2026 年 9 月 21 日發表 Grok 4.7。

據 AWS 文章,Grok 4.7 提供 500K token 的上下文視窗,也就是模型一次能讀取並參考的內容量。它接受文字與圖片輸入,輸出文字。使用者可以在 low、medium、high、xhigh 四個推理強度等級之間設定,決定模型回答前要投入多少思考。AWS 引述 xAI 的說法,稱這是 xAI 在程式開發與知識工作上最強的模型:它在困難任務上會工作得更久,並在進入下一步前更仔細地檢查自己的輸出。

xAI 的 Grok 4.7 登上 Amazon Bedrock:企業可在 AWS 上使用,表現提升但每項任務輸出量約增一倍
Mokaair 編輯查核流程 · 圖片:Mokaair (Original editorial artwork)
閱讀完整文字說明

消息會先蒐集來源、獨立查核,再交由 Jev 判斷。

xAI 宣稱的能力與訓練方式

AWS 文章轉述 xAI 的說法:Grok 4.7 使用更新、更大的基礎模型。它經過更長的強化學習訓練,訓練任務也更難,並刻意偏重需要耗時數小時才能完成的問題;強化學習是讓模型從反覆嘗試與回饋中改進的訓練方式。xAI 表示,這讓模型更擅長驗證自己的工作,也更能有效運用 500K 上下文。此外,xAI 把模型訓練成能原生理解 xAI 的 Grok Bot harness,也就是 Grok Bot 的執行框架,並稱這改善了模型在對話任務與一般知識工作上的表現。

  • 文件與簡報生成能力更強(據 xAI)。
  • 在律師、護理師、金融分析師等專業知識工作上有所提升(據 xAI)。
  • xAI 的評測涵蓋 CursorBench、DeepSWE、Terminal-Bench、AA Briefcase、EEBench、Harvey Legal Agent Benchmark 與 HealthBench Professional。AWS 文章沒有列出具體成績,而是請讀者參考 xAI 的發表文章。

第三方評測數據:進步與代價

AWS 文章引述評測機構 Artificial Analysis 的數據,比較 Grok 4.7 與前一代 Grok 4.6。AWS 註明 Grok 4.7 是在最高的 xhigh 推理強度下測得。表中的 Elo 是透過相互比較算出的相對評分,數字越高代表表現越好。幻覺率指模型給出看似合理、實際上卻錯誤的內容的比例,越低越好。

資料來源:AWS 部落格引述 Artificial Analysis 數據
指標(Artificial Analysis)Grok 4.7Grok 4.6
Intelligence Index4644
Coding Agent Index5647
AA-Briefcase 長時程知識工作(Elo)1,6571,546
GDPval-AA 專業工作成果(Elo)1,6951,605
AA-Omniscience Index3230
AA-Omniscience 幻覺率29%34%
每個 Intelligence Index 任務的輸出 token約 81k約 38k

AWS 特別指出最後一列代表的取捨:效能提升的同時,每項任務的輸出 token 約增為兩倍。對使用者而言,同樣的任務可能耗用更多運算量與費用。因此 AWS 建議刻意設定推理強度,而不是直接沿用預設值。

安全與資安措施

AWS 文章轉述 xAI 的說法:Grok 4.7 採用全新的安全防護架構,是 xAI 測試過的模型中,在拒答危險請求與抗越獄(jailbreak,指用話術誘導 AI 繞過安全限制)方面最強的一款。資安屬於雙重用途領域,同樣的知識可用於防禦,也可能被濫用。xAI 表示,在這類領域,模型只會放行一小部分高風險提示,同時很少阻擋合法的資安工作。xAI 也已開始以邀請制,讓部分資安合作夥伴使用 Grok 4.7 的紅隊能力進行防禦研究;紅隊指模擬攻擊者來找出防禦弱點。

在 Bedrock 平台上,AWS 表示可以搭配 Amazon Bedrock Guardrails(AWS 的內容防護功能)使用。它會對提示與回應套用內容過濾、禁止主題、個人可識別資訊遮蔽與字詞政策。呼叫日誌則可以記錄在 Amazon CloudWatch,內容包括請求、回應以及 token 數(含推理 token),讓長時間執行的代理留下可供事後稽核的紀錄。

在 Bedrock 上怎麼提供:區域與服務層級

據 AWS 文章,Grok 4.7 透過跨區域推論設定檔提供,不固定在單一區域的資料中心。請求會依設定檔被分配到多個 AWS 區域處理。模型相容 OpenAI SDK,驗證方式可以是 Amazon Bedrock API 金鑰,或由 IAM(AWS 的帳號與權限管理服務)憑證產生的短期權杖。模型也可以透過 AWS SDK 的 Converse 介面使用。平台還提供隱式提示快取:重複送出的相同開頭內容會自動以快取費率計算。另一項功能是結構化輸出,可用 JSON Schema 限定回應格式,方便程式直接讀取。

資料來源:AWS 部落格
設定檔模型 IDAWS 說明的特點
Global 跨區域global.xai.grok-4.7路由至任何支援的商用 AWS 區域,價格低於地理設定檔,但延遲可能較不穩定
US 地理跨區域us.xai.grok-4.7處理保留在美國地理範圍內,因應美國資料駐留(規定資料須在特定地區處理)需求

服務層級方面,AWS 列出三種。Standard 按 token 計費,不需事先承諾用量。Priority 提供較快的優先處理,需要額外費用。Flex 成本較低,適合不急著要結果的工作。AWS 文章沒有列出具體價格,而是請讀者參考 Amazon Bedrock 定價頁。

對一般讀者的實際影響

  • 多數一般使用者不會直接接觸 Bedrock;影響主要來自企業或開發者把 Grok 4.7 整合進自家產品與內部工具。
  • 對已在使用 AWS 的企業,這代表同一平台內多了一個可選用的模型,並可沿用 Guardrails、日誌等既有管理機制。
  • 若企業對資料存放地點有要求,AWS 表示 US 設定檔可將處理保留在美國範圍內;其他地區的資料駐留需求需要自行確認。
  • AWS 提到每項任務的輸出 token 約為前代兩倍,使用高推理強度時成本可能增加,導入前宜評估是否真的需要這麼高的強度。

常見問題

Grok 4.7 是什麼時候在 Amazon Bedrock 上線的?

AWS 於 2026 年 9 月 28 日在官方部落格宣布上線。據 AWS 文章,xAI 已在 2026 年 9 月 21 日發表 Grok 4.7。

Grok 4.7 的上下文視窗有多大?

據 AWS 文章,Grok 4.7 提供 500K token 的上下文視窗,也就是一次能讀取並參考的內容量。它也支援 low、medium、high、xhigh 四段推理強度。

Grok 4.7 真的比前一代好嗎?

AWS 引述 Artificial Analysis 的數據,Grok 4.7 在多項指標上高於 Grok 4.6,幻覺率由 34% 降至 29%。不過這些數字是在 xhigh 推理強度下測得,而且每項任務的輸出 token 約為前代兩倍。

可以選擇資料在哪裡處理嗎?

據 AWS,US 設定檔(us.xai.grok-4.7)會將處理保留在美國地理範圍內;Global 設定檔則可能路由至任何支援的商用 AWS 區域。

使用前需要確認什麼?

AWS 建議首次呼叫前,先在 Bedrock 主控台確認該模型在你預計使用的 AWS 區域可用;費用請參考 Amazon Bedrock 定價頁。

查看同分類最新消息

最新旅遊情報攻略

資料來源

生活分享