9月22日、AWSが「xAI's Grok 4.6 is now available in Amazon Bedrock」と題した記事を公開した。2026年8月18日にBedrock上での提供が開始されたxAIのGrok 4.6は、500Kトークンのコンテキストウィンドウ、新たに追加された最上位の推論レベル「xhigh」を含む4段階の推論努力設定、そして2種類のエンドポイント構成を特徴とする。エージェント開発における長文脈処理・コスト制御・ポリシー管理の要件を一定程度カバーする選択肢として注目される。
GrokシリーズとBedrock上での位置づけ
xAIのGrokシリーズは、Grok 1・Grok 2・Grok 3と世代を重ねており、Grok 4はその最新世代にあたる。Grok 4.6はGrok 4系列のマイナーバージョンであり、Bedrock上ではGrok 4.3がxAIにとって初の参入モデルだった。今回のGrok 4.6はその後継として提供され、エンドポイント対応の幅やツール連携が強化されている。シリーズの変遷を把握しておくことで、今後のモデル更新の方向性も読み取りやすくなるだろう。
500Kトークンコンテキストと4段階推論レベル
技術的な核心は2点だ。
コンテキストウィンドウが500Kトークンと広く、長期間にわたるエージェント処理に向いている。複数ステップにまたがるコードベースの解析、調査、ドキュメント生成といった用途を想定した設計だとxAIは説明している。
もう1点が推論努力レベルの4段階設定(low / medium / high / xhigh)だ。xhighはGrok 4.6で新たに追加された最上位レベルで、より深い推論が必要な問題に対してトークンを追加消費して精度を上げる。lowやmediumは応答速度を優先したい場面や、推論コストを抑えたい反復処理向けに適しており、タスクの複雑さに応じてレベルを使い分けることでコストと精度のバランスを取れる。Converse APIでは以下のように指定する。
additionalModelRequestFields={"reasoning_effort": "xhigh"}
Bedrock上での2エンドポイント構成
Grok 4.3はBedrock初参入のモデルとしてbedrock-mantleエンドポイントのみに対応していたが、Grok 4.6は**bedrock-runtimeにも対応した**。この違いが実装上の選択肢を大きく広げる。
ここで用語を補足しておく。bedrock-runtimeはAmazon Bedrockの標準エンドポイントであり、Converse APIや呼び出しログ、クロスリージョン推論といったBedrockネイティブ機能と統合されている。一方、bedrock-mantleはxAIモデル向けに設けられた独自エンドポイントで、JSONスキーマによる構造化出力やツール呼び出し、プロンプトキャッシュといった機能を提供するが、Converse APIには非対応となっている。初見の開発者は「なぜエンドポイントが2つ存在するのか」と戸惑いやすいが、機能要件に応じて明示的に選択する設計だと理解するとよい。
| エンドポイント | モデルID | 主な対応機能 |
|---|---|---|
| bedrock-mantle | xai.grok-4.6 |
ツール呼び出し、構造化出力、プロンプトキャッシュ |
| bedrock-runtime | us.xai.grok-4.6 / global.xai.grok-4.6 |
Converse API、呼び出しログ、クロスリージョン推論 |
JSONスキーマによる構造化出力が必要ならbedrock-mantle、Converse APIや呼び出しログ(CloudWatch連携)が必要ならbedrock-runtimeという選択になる。
クロスリージョン推論とコスト構造
bedrock-runtimeでは、単一リージョンへの固定ではなくクロスリージョン推論プロファイルを通じて呼び出す。
us.xai.grok-4.6:米国内でルーティング(データ所在地要件がある場合向け)global.xai.grok-4.6:全世界でルーティング(キャパシティ優先)
Globalの方が価格が安く、入力トークンあたり**$2.00/百万トークン**(Geo版は$2.20)。
サービス層は3種類で、コスト差が大きい:
- Standard(デフォルト):$2.20/百万入力トークン
- Priority(1.75倍):$3.85/百万入力トークン
- Flex(0.5倍):$1.10/百万入力トークン
プロンプトキャッシュも利用可能で、同一の大きなシステムプロンプトやドキュメントを繰り返し送信するエージェントでは、通常の入力レートの約25%に削減される。安定したコンテンツはリクエストの先頭に配置することが推奨されている。
Guardrailsと呼び出しログ対応
今回の追加で特にエージェント開発者に影響するのが**Amazon Bedrock Guardrails**への対応だ。bedrock-runtime上で、コンテンツフィルタ、拒否トピック、PII(個人識別情報)の編集、ワードポリシーを設定できる。無人で多ステップ動作するエージェントに対して一貫したポリシー境界を設けられる。
呼び出しログはCloudWatchに完全なレコードとして記録される。リクエスト本文、レスポンス本文、推論トークンを含むトークン数、使用した推論プロファイルがすべて残るため、エージェント実行の監査に使える。
クイックスタート
OpenAI SDKがそのまま使える。まず依存関係をインストールする。
pip install openai
pip install boto3
bedrock-mantle経由のChat Completions APIのサンプルコードは以下のとおりだ。なお、baseURLやAPIキーなどの接続設定は元記事を参照していただきたい。
from openai import OpenAI
client = OpenAI()
response = client.chat.completions.create(
model="xai.grok-4.6",
messages=[
{"role": "user", "content": "Can you explain the features of Amazon Bedrock?"}
],
)
print(response)
bedrock-runtime経由でConverse APIを使う場合(推論が有効なため、content[0]ではなくブロックを検索する点に注意):
import boto3
client = boto3.client("bedrock-runtime", region_name="us-east-1")
response = client.converse(
modelId="us.xai.grok-4.6",
messages=[
{"role": "user", "content": [{"text": "Can you explain the features of Amazon Bedrock?"}]}
],
inferenceConfig={"maxTokens": 2048},
)
blocks = response["output"]["message"]["content"]
text = next(b["text"] for b in blocks if "text" in b)
print(text)
ベンチマーク数値
xAIが公表しているGrok 4.6 High(2026年8月12日時点)の主要ベンチマーク:
| 評価 | Grok 4.6 High |
|---|---|
| AA Intelligence Index | 61 |
| CursorBench v3.2 | 69.9% |
| DeepSWE v1.1 | 65.9% |
| FrontierCode v1.1 (Extended) | 61.3% |
| APEX-Agents | 57.5% |
| APEX-SWE | 56.4% |
AA Intelligence IndexはArtificial Analysisが公開している複合指標で、GDPval、Terminal-Bench、SciCode、Humanity's Last Exam、GPQA Diamondなど9つの評価を統合したものだ。
なお、Invoke APIは非対応。音声・動画・埋め込みのモダリティも未サポートで、画像入力と出力(テキスト)のみとなる。
詳細はxAI's Grok 4.6 is now available in Amazon Bedrockを参照していただきたい。