メインコンテンツまでスキップ

GPT-5.6 2026年8月アップデート:エフォート・スライダー、無料版のThinkボタン、そして272Kの価格クリフ

中級

2026年8月6日、OpenAIはGPT-5.6のミッドサイクル・リフレッシュを出荷した。多くの報道は「Solが賢くなり、無料ユーザーはチャット無制限になった」の一文にまとめてしまったが、実際のアップデートはもっと興味深く、OpenAIスタックにたまに手を伸ばすClaudeユーザーにとってはより重い意味を持つ。同時に3つの部品が動いた。エフォート制御がChatGPT UI(スライダー)とAPI(6段階のパラメータ)の両方で有効になり、翌週には無料版のThinkボタンとLunaの無制限チャットが登場し、272K入力トークンの長文脈価格クリフがSol専用のFastモードとぎこちなく相互作用する。それぞれが実際の意思決定を動かす。

このページは、リリースノートの霧の中から意思決定を引き出し、Claude的な思考で作るビルダーにとって何が実際に変わるのかを示す。

What you'll learn
  • 2026年8月6日にGPT-5.6で何が出荷され、8月10日の週に無料ユーザー向けに何が追加されたのかを正確に把握する
  • 6段階のエフォート・パラメータ(`none, low, medium, high, xhigh, max`)を理解し、Claudeのthinking-effortモデルにマッピングする
  • 272K入力トークンの価格クリフを学び、予算立てしたはずのジョブがどう静かに倍額になり得るかを知る
  • Fastモードが効くとき、何もしないとき、そして静かに拒否されるリクエストを見分ける
  • このアップデートが本当にClaudeからSolへワークロードを移す理由になるとき、そしてならないときを判断する

2026年8月6日に実際に出荷されたもの

具体的なものは3つ。残りは磨き上げだ。

Guided walkthrough1 of 3
  1. PlusおよびProユーザーは、Web・モバイル・デスクトップに新しいスライダーが表示され、ChatGPTがレスポンスあたりにどれだけの推論を使うかを設定する。内部では、APIが同じつまみを`reasoning.effort`として公開し、`none`、`low`、`medium`、`high`、`xhigh`、`max`の6段階を持ち、省略時のデフォルトは`medium`となる。これは以前の『モデルが決める』挙動を置き換える:これからはあなたがティアを選び、その分を支払う。

エフォート・スライダー——6段階をClaudeのメンタルモデルにマッピングする

7月のOpus 5で導入されたClaudeの5段階エフォート設定で考えていた人には、メンタルモデルは似ているがラベルはきれいには揃わない。GPT-5.6は6段階、Claudeは5段階で、両端の意味論も異なる。

GPT-5.6ティア何をするかClaude Opus 5でだいたい相当するもの
none推論を完全にスキップ、即答直接的な相当はない——Claudeは常に少しは計画する
low短い思考連鎖、安いminimal エフォート
medium(デフォルト)バランス型の計画。出荷時のデフォルトlowmedium
highより深い計画。遅く、高くつくmedium
xhigh長時間の熟慮、複数ステップ推論high
max推論上限フル——高価maximum

実務的な帰結は2つ:

  • デフォルトが動いた。 APIでreasoning.effortを省略するとmediumが返る。以前は多くのラッパーがモデルの自動選択に頼っていたが、その挙動はなくなった。予測可能なコストのためには明示が必須になった。
  • noneは本物のボタンだ。 分類プロンプト、構造化抽出、ツールルーターのコールなど、推論トークンが純粋なオーバーヘッドである場面では実際に有用だ。Claudeにはきれいに同等の『オフ』スイッチはない。

エフォートを明示的に固定する安全なリクエスト・テンプレート

{
"model": "gpt-5.6-sol",
"reasoning": { "effort": "low" },
"messages": [
  { "role": "system", "content": "Extract only. Output JSON." },
  { "role": "user", "content": "..." }
]
}

272Kトークンの価格クリフ——実在するハザード

これは請求書を予想外に焼くことになる可能性が最も高い変更だ。

ルール:リクエストの入力が272,000トークンを越えると、リクエスト全体入力レートの2倍、出力レートの1.5倍で再課金される。線を越えた分だけではない。按分もなし。

このルールで大事なのは2点:

  1. これは斜面ではなくクリフだ。 271,999入力トークンのプロンプトはベースレート。272,001のプロンプトは、コール内のあらゆる入力・出力トークン——モデルが生成する推論トークンも含めて——に2×/1.5×を払う。
  2. 長い会話は静かにこれを越えていく。 マルチターン・チャットとエージェント・ループは履歴を蓄積する。272K未満で始まったセッションが12ターン目で静かに線を越え、以降のすべてのターンを再課金する可能性がある。
Guided walkthrough1 of 3
  1. GPT-5.6 Solのベース価格は100万トークンあたり$5 / $30(入力/出力)、キャッシュ済み入力は$0.50。272K入力トークンを超えると同じコールが$10 / $45になる。4Kの出力を伴う300Kトークンの文書ではベース費用は$1.62。クリフを越えると$3.18——閾値を1トークン超えただけでほぼ2倍。

Fastモード——読むに値する細字

FastモードはSol専用のオプションで、価格と引き換えにレイテンシを買う:最大2.5倍高速、API価格2倍。TerraとLunaでは提供されない。

ローンチのピッチが控えめに扱っている3点:

  • 『最大』は天井であって常態ではない。 実測のスピードアップはワークロード次第——ツールコール、ネットワーク・ホップ、ストリーミング速度がすべて実効ゲインを2.5×よりずっと下に抑える。
  • Fastモードと長文脈はきれいに混ざらない。 OpenAIは相互排他ルールを公表していないが、初期のガイドは272K入力閾値を越えるとFastモードのリクエストが不調(または静かに劣化)することを報告している。OpenAIが別に文書化するまでは非互換として扱え。
  • 推論トークンは依然としてカウントされる。 Fastモードはスループットを速くするが、maxエフォートのコールは依然として同じ量の推論出力を生成する。実際に体感できるレイテンシに金を払っているときにしか経済性は成り立たない。
Pro tip
  • Fastモードの損益分岐は2.5×の天井で1ドルあたりおよそ25%のスループット増——天井に届かないときはさらに悪い。
  • ユーザーが待つインタラクティブ・チャットにはFastモードを優先。バッチ、バックグラウンド・エージェント、長文脈RAGにはスキップ。
  • コスト削減のためにバッチ・パイプラインをClaudeからSolに切り替える予定だったなら、Fastモードは有効化するな——節約が消える。

無料ティア:Luna無制限 + Thinkボタン

Claudeユーザーにとってはこれはこれ以降のAPI変更ほど重要ではないが、友人のスクリーンショットに登場して議論を始めさせる可能性が最も高い変更だ。

  • 2026年8月10日の週から、無料ChatGPTユーザー向けにGPT-5.6 Lunaでのテキストチャット無制限。以前は上限あり。
  • 同じウィンドウで、無料チャット上にThinkボタン。特定のメッセージに対してより深い推論パスを追加、不正利用防止の対象。Plus/Proのエフォート・スライダーと同じUIではない——セッション全体の設定ではなく、メッセージごとのトグルだ。

実務的な読み方:ClaudeとGeminiがどちらも寛大な無料推論オプションを持つ今、OpenAIは無料ティアを積極的に守っている。最初の数週間は不正利用防止の上限がタイトであることを予想せよ。

このアップデートが実際にClaudeユーザーの判断を動かす場所

ほとんどのClaudeワークロードでは答えは同じままだ。3つの具体的なパターンでは動く。

Guided walkthrough1 of 3
  1. Sol Lunaでの`reasoning.effort: none`は、大量のルーティング、タグ抽出、構造化ラベル付けにおいて、最小エフォートのClaude Haikuコールよりももっともらしく安いオプションになった——ただしプロンプトが272Kより十分下に留まる場合に限る。切り替え前に代表的なサンプルでベンチマークせよ。

既存のGPT-5.6 APIコードへの移行メモ

8月6日以前にSolに対して出荷していたなら、変更すべきことが2つある:

  • 全てのコールで**reasoning.effortを明示的に設定**せよ。省略すると今はmediumになる;おそらくほとんどのケースでlowを望んでいたはずだ。
  • パイプラインの境界に272Kガードを追加せよ。入力トークンが閾値を越えるリクエストを拒否またはチャンク化する。近似としてのlen(input) / 4のばかチェックが最初の防衛線として十分だ。

Node.jsラッパー用のガードレール・ワンライナー

if (estimateTokens(input) > 260_000) { chunkOrReject(input); }

このアップデートに含まれていないもの

このアップデート周辺で流れていた噂のうち、含まれていないものが2つ:

  • GPT-6(Astra)。 一部の媒体は8月と噂したが、2026年8月11日現在、OpenAIはローンチ日、モデルカード、価格を確認していない。実際に判明していることと推測されていることについては OpenAI Astraプレビュー ページを参照。
  • Sol値下げ。 ベースの $5 / $30 レートは変わっていない。一部の報道は272Kクリフ(サーチャージ)と価格変更を混同していた。

試してみよう

Check yourself

0/4
  1. GPT-5.6 Solにベース価格で300,000トークンの入力プロンプトを送る。271,000トークンを送った場合と比べて、費用はだいたいどうなるか?
  2. APIで、8月6日のアップデート後にGPT-5.6 Solコールで`reasoning.effort`を省略する。どのエフォート・ティアになるか?
  3. 次のワークロードのうち、Fastモードから最も恩恵を受けるのはどれか?
  4. OpenAIが2026年8月6日にGPT-5.6 Solに対して出荷した挙動変更はどれか?

参考文献とさらに読むもの

AILmanac内のクロスリンク: