AWSでGPT-5.6が使えるように — キャッシュ読み取りトークンが90%引きになる「明示的キャッシュ」でコストを大幅削減
DRANK

7月31日、AWSが「Introducing explicit prompt caching for OpenAI GPT-5.6 models on Amazon Bedrock」と題した記事を公開した。Amazon BedrockにOpenAI GPT-5.6モデルファミリーが正式提供開始され、キャッシュ読み取りトークンを通常の90%引きで処理できる明示的プロンプトキャッシュ機能が新たに追加された。エージェント型ワークフローのように同一のシステムプロンプトやツール定義を繰り返し送信するユースケースでは、コスト構造が根本から変わりうる内容だ。

by @tf_official
Related Topics: Amazon Web Services AI Machine Learning