← All posts / Models

Grok 4.6 登上 Amazon Bedrock:xAI 前沿模型正式進軍主流雲端

xAI 的 Grok 4.6 現已在 Amazon Bedrock 全面開放,提供 50 萬 token 上下文視窗、可調式推理強度,並橫跨 29 個 AWS 區域的跨區推論,每百萬輸入 token 低至 2 美元。

Grok 4.6 登上 Amazon Bedrock:xAI 前沿模型正式進軍主流雲端

xAI 的旗艦模型朝企業主流採用邁出了重要一步。2026 年 8 月 19 日,Amazon Web Services 宣布 Grok 4.6——馬斯克旗下 AI 實驗室的最新前沿模型——正式在 Amazon Bedrock 全面開放(Generally Available),並支援橫跨全球 29 個 AWS 區域的跨區推論(Cross-Region Inference)。

這項消息之所以重要,在於這是 Grok 模型首次透過大型雲端業者的託管 AI 平台廣泛提供,讓 xAI 的技術進入企業早已用於 Anthropic 的 Claude、OpenAI 的 GPT 系列以及 Amazon 自家 Nova 系列的同一套採購、治理與合規框架。

Grok 4.6 為 Bedrock 帶來什麼

根據 AWS 官方模型卡(model card),Grok 4.6 是 xAI「為程式設計、代理任務(agentic tasks)與知識工作而打造」的前沿模型,特別強調長時間運行的代理程式與更具企圖心的互動式工作。該模型於 2026 年 8 月 18 日上線,僅隔一天就登上 Bedrock——如此快的上架速度,凸顯 AWS 擴充第三方模型目錄的積極程度。

核心規格包括:

  • 50 萬 token 上下文視窗——足以在單一請求中處理整個程式碼庫、冗長的法律文件或數小時的對話歷史
  • 四段可調式推理強度:low、medium、high 與 xhigh,讓開發者在延遲、成本與思考深度之間自行取捨
  • 多 API 支援——相容 Responses API、Chat Completions API 與 AWS 原生的 Converse API,並可透過 bedrock-runtime 與 bedrock-mantle 兩種端點存取
  • 文字、影像、音訊、語音與視訊輸入等多模態能力,輸出則為文字

可調式推理尤其值得注意。xAI 不再強迫開發者接受單一智慧等級,而是讓 Bedrock 用戶按請求調整推理強度——隨著企業將大量低價位分類任務與偶發的深度分析工作負載混合部署,這種模式已成為前沿模型部署的基本門檻。

定價:瞄準前沿陣營的破壞者

Bedrock 上的 Grok 4.6 定價,在同級對手中顯得相當有攻擊性。標準層(Standard tier)價格如下:

推論選項輸入(每百萬 token)輸出(每百萬 token)快取讀取
區域內(In-Region)$2.20$6.60$0.55
美國地理跨區(US Geo)$2.20$6.60$0.55
全球跨區(Global CRIS)$2.00$6.00$0.50

全球跨區推論設定檔(global.xai.grok-4.6)是最划算的選擇:允許 AWS 將請求路由到任何提供商模型的商業區域,客戶不僅能在需求高峰時獲得最充足的容量池,每個 token 還有約 9% 的折扣。美國地理設定檔(us.xai.grok-4.6)則將所有處理限制在美國境內以滿足資料駐留(data residency)合規需求。

作為對比,Anthropic 的 Claude Opus 級模型價格明顯更高——每 token 成本常常高出一個數量級。這框定了 Grok 4.6 的市場定位:以中階價格提供接近前沿的能力。xAI 自家的公告引用直接 API 價格為每百萬 token 輸入 2 美元、輸出 6 美元,也就是說 Bedrock 全球設定檔完全比照 xAI 第一方定價,區域內的溢價買的是嚴格的駐留保證。

每百萬 token 0.50 至 0.55 美元的提示快取(prompt caching)價格,對需要反覆重送大型系統提示與工具定義的代理工作負載更是利多——而這正是 xAI 宣稱此模型鎖定的長時間運行代理應用場景。

跨區推論:企業的入場通道

這次的技術公告核心是跨區推論——AWS 自動將推論請求路由到多個區域的機制。對企業而言,這一次解決兩個問題:需求高峰時的吞吐量餘裕,以及無需手動容量管理的成本最佳化。

Grok 4.6 在 Bedrock 上的區域覆蓋廣得罕見。bedrock-runtime 端點列出 29 個區域,橫跨北美(us-east-1/2、us-west-1/2、加拿大兩區)、歐洲(法蘭克福、蘇黎世、斯德哥爾摩、米蘭、西班牙、愛爾蘭、倫敦、巴黎),以及密集的亞太集群——東京、首爾、大阪、孟買、海德拉巴、新加坡、雪梨、雅加達、墨爾本、馬來西亞、紐西蘭與泰國——外加台北、特拉維夫、阿聯、巴林、開普敦與聖保羅。

值得注意的是,AWS 相容 OpenAI 的 bedrock-mantle 端點目前只在 us-west-2(奧勒岡)提供此模型,而 bedrock-runtime 承擔完整的全球足跡。使用 OpenAI SDK 的開發者只要把 OPENAI_BASE_URL 指向任一端點,幾分鐘內就能開始使用。

模型也直接繼承 Bedrock 的標準企業控制功能:模型叫用日誌可交付至 S3 或 CloudWatch、CloudWatch 指標,以及 AWS Cost Explorer 中的成本細項化——這些不起眼但決定性的功能,正是合規團隊在任何模型碰觸生產資料前的必要條件。

為什麼重要:多模型時代已然成形

Grok 與 Bedrock 的結合,是產業明確趨勢的最新例證:超大規模雲端業者正在成為中立的模型市集,而前沿實驗室也愈來愈願意透過雲端對手的通路散布自家模型。

對 xAI 而言,Bedrock 通路解決了實際的分散式難題。儘管 Grok 聲量极高——受惠於 X 平台整合與 Grok 消費級應用——企業買家始終猶豫是否要將關鍵工作負載接在一家相對年輕的基礎設施營運商的第一方 API 上。Bedrock 的 SLA、私有網路、IAM 整合與既有企業合約,徹底移除了這層摩擦。每年已在 AWS 投入七位數美元的 CIO,現在只需一行採購項目變更,就能加入 Grok 4.6,而不必啟動完整的供應商評估流程。

對 AWS 而言,這項新增讓 Bedrock 的模型目錄持續與 Google Cloud 的 Vertex AI 和微軟 Azure 的 OpenAI Service 抗衡。Bedrock 現已提供來自 Anthropic、Meta、Mistral、Cohere、AI21、Amazon 自家 Nova 系列與 xAI 的模型——無論哪個模型在任何一波基準測試週期勝出,AWS 都希望成為預設目的地。

對開發者而言,實際後果是模型可移植性。基於 Converse API 建置的應用程式,只需極少的程式碼變更就能將 Grok 4.6 換入取代 Claude 或 Nova,而四段推理控制加上 50 萬 token 上下文,使其成為代理框架、程式碼生成管線與文件密集分析任務的有力候選。

幾點保留

有幾項限制值得留意。此模型登上 Bedrock 的時間還很短——模型卡登載的上線日期為 8 月 18 日——平台上獨立的基準驗證仍然稀少。功能支援依端點而異:bedrock-runtime 支援提示快取、智慧提示路由與應用程式推論設定檔,而 bedrock-mantle 支援客戶端工具呼叫與濫用偵測,但不含完整的 runtime 功能集。有嚴格駐留需求的企業買家應注意,只有美國地理與區域內選項保證地理圍籬。

而且前沿競賽從不停歇:Grok 4.6 登場的這一週,Anthropic 發布了經實驗室驗證的蛋白質設計成果,Cerebras 以 CS-4 機架宣稱 30 倍 GPU 推論速度,OpenAI 則揭露其 Astra 推論堆疊內建了 20% 的監控運算開銷。Grok 4.6 的優勢——如果成立——在於 50 萬 token 上下文下的性價比,而非絕對能力王座。

儘管如此,登上全球最大雲端平台對 xAI 而言仍是一個里程碑。這個起初作為 X 內建逆向思維聊天機器人的模型,如今距離地球上每一個 AWS 帳戶,只差一次 API 呼叫。