摘要

Amazon Bedrock 上架 xAI 的 Grok 4.6:500K token 上下文的前沿模型,主打编码、agent 任务和知识工作,强调长时间运行的 agent。模型提供四档推理强度(默认 low,可选 medium、high、xhigh),接受文本和图像输入、输出文本,可通过 Responses、Chat Completions 和 Converse 三个 API 访问,支持前缀缓存(prompt caching)与推理。同步上线两个跨区域推理 profile:us.xai.grok-4.6 用于美国数据驻留;global.xai.grok-4.6 在无驻留约束时全球路由。定价方面,区域内与美国 profile 输入 $2.20/M、输出 $6.60/M、缓存读 $0.55/M;全球跨区域 profile 输入 $2.00/M、输出 $6.00/M、缓存读 $0.50/M。不支持服务端工具调用、结构化输出、智能提示路由和 application inference profiles。更新(8/21):xAI 又把 Grok 4.6 带上 Google Enterprise Agent Platform(经 Model Garden 提供)——同样 500K 上下文、四档推理强度,定价输入 $2.00、缓存 $0.50、输出 $6.00 每百万 token,与 Bedrock 全球跨区域 profile 持平。

为什么重要
对以 AWS 为主的企业来说,xAI 的前沿模型现在可以通过 Bedrock 承诺用量、私有网络和 IAM 采购,多模型路由策略也多了一个选项;500K 上下文加上长时 agent 的定位,让它成为长上下文 agent 负载的候选。工程上的限制和上架本身同样重要:Bedrock 上不支持服务端工具调用和结构化输出,agent 栈必须把工具执行留在客户端、自己解析文本输出。相比在服务端提供这些能力的 API,这是实实在在的集成约束。三天内美系两大云双双上架,多云路由采购 xAI 旗舰已经没有障碍;真正要评估的仍是集成面(Bedrock 侧无服务端工具调用与结构化输出)。
技术细节
上下文窗口 500K tokens
推理强度 low(默认)/ medium / high / xhigh
模态 文本 + 图像输入;文本输出
API Responses、Chat Completions、Converse;支持前缀缓存(prompt caching)与推理
推理 Profile us.xai.grok-4.6(美国数据驻留) · global.xai.grok-4.6(无驻留约束时全球路由)
定价 in-region / US geo:输入 $2.20/M、输出 $6.60/M、缓存读 $0.55/M · global 跨区域:输入 $2.00/M、输出 $6.00/M、缓存读 $0.50/M
不支持 server-side tool use、structured outputs、intelligent prompt routing、application inference profiles
背景 Grok 4.6 于 2026-08-12 发布(覆盖前背景);本事件只覆盖 Bedrock 可用性这一层
与知识库的关系 与 DeepSeek V4-Pro GA 定价(ev-20260813-02)同属模型获取/定价线;长上下文 agent 负载候选
Google 平台上架(8/21 更新) 2026-08-21:Google Enterprise Agent Platform,经 Model Garden 提供;500K 上下文;推理强度 low/medium/high/xhigh;输入 $2.00/M、缓存 $0.50/M、输出 $6.00/M(与 Bedrock 全球 profile 持平);模型卡 hosted 在 Google 文档站 + Cloud console 上架
后续更新
2026-08-21 Coverage-gap recovery (2026-08-24 run): xAI officially announced on 2026-08-21 that Grok 4.6 is also available on Google Enterprise Agent Platform via Model Garden - 500K context, reasoning effort low/medium/high/xhigh, pricing $2.00/M input, $0.50/M cached input, $6.00/M output, matching the Bedrock global cross-region profile (primary: x.ai/news/grok-4-6-vertex-ai). Second hyperscaler marketplace within three days (Bedrock 8/19, Google 8/21); surfaced via 8/23 aggregator digest, missed by the 8/22 run. Event scope extended from Bedrock-only to multi-cloud availability; recommendation stays TRIAL.
标签
grok-4-6xaiamazon-bedrockawsmodel-availabilitylong-contextcross-region-inferencepricinggoogle-cloudmodel-garden