10月6日、Ryan Merketが「OpenAI says GPT-6 Astra and Sol now stream 50% faster」と題した記事を公開した。OpenAIがGPT-6 AstraおよびGPT-6.1 Solのデフォルトストリーミング速度を約50%向上させたと公式が発表したもので、エンジニアとして正確に把握しておきたい改善範囲と留意点がいくつかある。
トークン出力速度が30→50 tokens/秒へ
OpenAIのコアプロダクト責任者であるThibault Sottiaux(@thsottiaux)が2026年10月5日にXへ投稿したスレッドによれば、GPT-6 AstraとGPT-6.1 Solのデフォルト応答速度が、サブスクライバー向けに約50%改善された。
具体的な数字として、Sottiaux は改善前が約30 tokens/秒、改善後が約50 tokens/秒と示している。30→50は正確には約67%増であり、「50%向上」という表現とは厳密には一致しないが、Sottiaux自身もこれらの数値は概算だと述べており、計測方法や適用条件(プラン・タスク種別・製品ごとの差異)についての詳細は発表内容からは確認できない。ロールアウトは投稿から2時間以内に反映されるとされた。
ユーザー側での設定変更は不要だ。
「50%速く」が意味することと、意味しないこと
エンジニアとして押さえておきたいのは、この数値がテキストのストリーミング速度の話であって、タスク全体の完了時間ではないという点だ。
コーディングエージェントの実際の動作は、計画立案・ツール呼び出し・コード実行・検証といった複数のステップで構成される。トークン出力速度はそのうちの一部でしかなく、エンドツーエンドのレイテンシや最終的なタスク完了速度は、今回の発表では対象外だ。Sottiaux はモデルが「高度に最適化されたトークナイザーを使用しており、タスクあたりのトークン消費が少ない」とも述べているが、その根拠となるトークン消費量の数値やベンチマークは示されていない。
影響範囲は「Sign in with ChatGPT」経由の外部ツールにも
この速度改善が特に注目される理由のひとつが、適用範囲の広さだ。改善は ChatGPT や Codex にとどまらず、Sign in with ChatGPT(ChatGPTアカウントで外部アプリにサインインし、ChatGPTプランのクォータを外部アプリのリクエストに充当できる仕組み)を利用しているパートナーアプリにも波及する。
Sottiaux が名指しした対象アプリは以下の通りだ。
- OpenCode
- Pi
- Amp
- Devin
これらのツールを日常的に使用している開発者は、OpenAI側で設定変更をしなくても自動的に恩恵を受ける。一方で、利用量はChatGPTプランの週次上限に対してカウントされる構造は変わらない。OpenAIは各アプリごとに週次上限を設定できるとしているが、この上限はアプリ別の独立したプールではなく、プラン全体の消費枠から引かれる。つまり、生成が速くなっても、プランの「使える量」そのものは変わらない。

モデルのポジショニング
OpenAIは両モデルを以下のように位置づけている。
- GPT-6 Astra:高負荷な推論・コーディングタスク向けのフラッグシップモデル
- GPT-6.1 Sol:コーディング、コンピュータ操作、プロフェッショナル用途向けの低コストオプション
ストリーミングの高速化は、特にエージェントの動作をリアルタイムで眺めているインタラクティブな場面での体感に直結しやすい。ただし、モデルの回答品質や複雑タスクの完了速度が改善したかどうかは、今回の発表内容からは確認できない。
注意点まとめ
今回の発表に基づいて整理すると、以下の通りだ。
- ✅ デフォルトで適用、ユーザー設定変更不要
- ✅ ChatGPTプラン経由の外部アプリにも適用
- ❌ エンドツーエンドのタスク完了速度の改善は未確認
- ❌ プランの使用量上限の変更はなし
- ❌ モデル自体の変更・計算リソース配分の変更については言及なし
独立した第三者による測定値は現時点では提供されていない。
詳細はOpenAI says GPT-6 Astra and Sol now stream 50% fasterを参照していただきたい。