GPT-5.6 2026年8月アップデート:エフォート・スライダー、無料版のThinkボタン、そして272Kの価格クリフ
2026年8月6日、OpenAIはGPT-5.6のミッドサイクル・リフレッシュを出荷した。多くの報道は「Solが賢くなり、無料ユーザーはチャット無制限になった」の一文にまとめてしまったが、実際のアップデートはもっと興味深く、OpenAIスタックにたまに手を伸ばすClaudeユーザーにとってはより重い意味を持つ。同時に3つの部品が動いた。エフォート制御がChatGPT UI(スライダー)とAPI(6段階のパラメータ)の両方で有効になり、翌週には無料版のThinkボタンとLunaの無制限チャットが登場し、272K入力トークンの長文脈価格クリフがSol専用のFastモードとぎこちなく相互作用する。それぞれが実際の意思決定を動かす。
このページは、リリースノートの霧の中から意思決定を引き出し、Claude的な思考で作るビルダーにとって何が実際に変わるのかを示す。
- 2026年8月6日にGPT-5.6で何が出荷され、8月10日の週に無料ユーザー向けに何が追加されたのかを正確に把握する
- 6段階のエフォート・パラメータ(`none, low, medium, high, xhigh, max`)を理解し、Claudeのthinking-effortモデルにマッピングする
- 272K入力トークンの価格クリフを学び、予算立てしたはずのジョブがどう静かに倍額になり得るかを知る
- Fastモードが効くとき、何もしないとき、そして静かに拒否されるリクエストを見分ける
- このアップデートが本当にClaudeからSolへワークロードを移す理由になるとき、そしてならないときを判断する
2026年8月6日に実際に出荷されたもの
具体的なものは3つ。残りは磨き上げだ。
- PlusおよびProユーザーは、Web・モバイル・デスクトップに新しいスライダーが表示され、ChatGPTがレスポンスあたりにどれだけの推論を使うかを設定する。内部では、APIが同じつまみを`reasoning.effort`として公開し、`none`、`low`、`medium`、`high`、`xhigh`、`max`の6段階を持ち、省略時のデフォルトは`medium`となる。これは以前の『モデルが決める』挙動を置き換える:これからはあなたがティアを選び、その分を支払う。
- OpenAIはSolを更新し、『より直接的な応答、より引き締まったフォーマット、役立たない場合には余分な詳細を避ける』ようにし、質問ごとに詳細度を調整し、『訂正のほうが有用な場面では同意しにくくなる』ようにした——これはOpenAIが明示的なアンチ迎合パスを出荷した最も近い例だ。金融・医療・法務プロンプトに関する社内評価では、事実誤認が引退したGPT-5.5 Instantに比べて『68%少ない』と報告された。
- 無料ユーザーはGPT-5.6 Lunaでのテキストチャットが無制限(以前は上限あり)になり、より難しい質問に対してより深い推論を行う新しいThinkボタンが『不正利用防止の範囲で』使えるようになる。Thinkボタンは8月6日には有効ではなく、翌週にロールアウトされた。
エフォート・スライダー——6段階をClaudeのメンタルモデルにマッピングする
7月のOpus 5で導入されたClaudeの5段階エフォート設定で考えていた人には、メンタルモデルは似ているがラベルはきれいには揃わない。GPT-5.6は6段階、Claudeは5段階で、両端の意味論も異なる。
| GPT-5.6ティア | 何をするか | Claude Opus 5でだいたい相当するもの |
|---|---|---|
none | 推論を完全にスキップ、即答 | 直接的な相当はない——Claudeは常に少しは計画する |
low | 短い思考連鎖、安い | minimal エフォート |
medium(デフォルト) | バランス型の計画。出荷時のデフォルト | low〜medium |
high | より深い計画。遅く、高くつく | medium |
xhigh | 長時間の熟慮、複数ステップ推論 | high |
max | 推論上限フル——高価 | maximum |
実務的な帰結は2つ:
- デフォルトが動いた。 APIで
reasoning.effortを省略するとmediumが返る。以前は多くのラッパーがモデルの自動選択に頼っていたが、その挙動はなくなった。予測可能なコストのためには明示が必須になった。 noneは本物のボタンだ。 分類プロンプト、構造化抽出、ツールルーターのコールなど、推論トークンが純粋なオーバーヘッドである場面では実際に有用だ。Claudeにはきれいに同等の『オフ』スイッチはない。
エフォートを明示的に固定する安全なリクエスト・テンプレート
{
"model": "gpt-5.6-sol",
"reasoning": { "effort": "low" },
"messages": [
{ "role": "system", "content": "Extract only. Output JSON." },
{ "role": "user", "content": "..." }
]
}272Kトークンの価格クリフ——実在するハザード
これは請求書を予想外に焼くことになる可能性が最も高い変更だ。
ルール:リクエストの入力が272,000トークンを越えると、リクエスト全体が入力レートの2倍、出力レートの1.5倍で再課金される。線を越えた分だけではない。按分もなし。
このルールで大事なのは2点:
- これは斜面ではなくクリフだ。 271,999入力トークンのプロンプトはベースレート。272,001のプロンプトは、コール内のあらゆる入力・出力トークン——モデルが生成する推論トークンも含めて——に2×/1.5×を払う。
- 長い会話は静かにこれを越えていく。 マルチターン・チャットとエージェント・ループは履歴を蓄積する。272K未満で始まったセッションが12ターン目で静かに線を越え、以降のすべてのターンを再課金する可能性がある。
- GPT-5.6 Solのベース価格は100万トークンあたり$5 / $30(入力/出力)、キャッシュ済み入力は$0.50。272K入力トークンを超えると同じコールが$10 / $45になる。4Kの出力を伴う300Kトークンの文書ではベース費用は$1.62。クリフを越えると$3.18——閾値を1トークン超えただけでほぼ2倍。
- 2本の200Kコールは入力$2。1本の400Kコールは$8(リクエスト全体で入力2×)。どちらのチャンクも272K未満に留まるなら、チャンク分割は入力費用で4倍安い。モデルに全てを一度に見せる必要が本当にあるときだけ詰め込め。
- キャッシュ済み入力$0.50は272Kまでは$0.50のまま。クリフを越えると倍率がすべての課金トークンに適用される——キャッシュ済みプレフィックスより上のキャッシュされていない入力にも。安定した250Kのキャッシュ済みプレフィックス + 伸びていくテールで静かに越える可能性がある。
Fastモード——読むに値する細字
FastモードはSol専用のオプションで、価格と引き換えにレイテンシを買う:最大2.5倍高速、API価格2倍。TerraとLunaでは提供されない。
ローンチのピッチが控えめに扱っている3点:
- 『最大』は天井であって常態ではない。 実測のスピードアップはワークロード次第——ツールコール、ネットワーク・ホップ、ストリーミング速度がすべて実効ゲインを2.5×よりずっと下に抑える。
- Fastモードと長文脈はきれいに混ざらない。 OpenAIは相互排他ルールを公表していないが、初期のガイドは272K入力閾値を越えるとFastモードのリクエストが不調(または静かに劣化)することを報告している。OpenAIが別に文書化するまでは非互換として扱え。
- 推論トークンは依然としてカウントされる。 Fastモードはスループットを速くするが、
maxエフォートのコールは依然として同じ量の推論出力を生成する。実際に体感できるレイテンシに金を払っているときにしか経済性は成り立たない。
- Fastモードの損益分岐は2.5×の天井で1ドルあたりおよそ25%のスループット増——天井に届かないときはさらに悪い。
- ユーザーが待つインタラクティブ・チャットにはFastモードを優先。バッチ、バックグラウンド・エージェント、長文脈RAGにはスキップ。
- コスト削減のためにバッチ・パイプラインをClaudeからSolに切り替える予定だったなら、Fastモードは有効化するな——節約が消える。
無料ティア:Luna無制限 + Thinkボタン
Claudeユーザーにとってはこれはこれ以降のAPI変更ほど重要ではないが、友人のスクリーンショットに登場して議論を始めさせる可能性が最も高い変更だ。
- 2026年8月10日の週から、無料ChatGPTユーザー向けにGPT-5.6 Lunaでのテキストチャット無制限。以前は上限あり。
- 同じウィンドウで、無料チャット上にThinkボタン。特定のメッセージに対してより深い推論パスを追加、不正利用防止の対象。Plus/Proのエフォート・スライダーと同じUIではない——セッション全体の設定ではなく、メッセージごとのトグルだ。
実務的な読み方:ClaudeとGeminiがどちらも寛大な無料推論オプションを持つ今、OpenAIは無料ティアを積極的に守っている。最初の数週間は不正利用防止の上限がタイトであることを予想せよ。
このアップデートが実際にClaudeユーザーの判断を動かす場所
ほとんどのClaudeワークロードでは答えは同じままだ。3つの具体的なパターンでは動く。
- Sol Lunaでの`reasoning.effort: none`は、大量のルーティング、タグ抽出、構造化ラベル付けにおいて、最小エフォートのClaude Haikuコールよりももっともらしく安いオプションになった——ただしプロンプトが272Kより十分下に留まる場合に限る。切り替え前に代表的なサンプルでベンチマークせよ。
- Sol + FastモードはOpenAIが出荷する最速の品質ティアになった。ユーザーが各レスポンスを待っていて、プロンプトが272K以下に収まるなら、これがトレードオフを最も動かすアップデートだ。バックグラウンドのエージェント・ランでは無視せよ。
- 272Kクリフはこれを前提に設計せよという意味だ。Claude Opus 5の1Mコンテキストと Solの1.05Mコンテキストはどちらも272Kをはるかに超えるが、Claudeには同じ形のクリフはない——長文脈価格はフラットだ。400K+入力でのリポジトリ全体の操作では、現状Claudeがコスト優位を持つ。
既存のGPT-5.6 APIコードへの移行メモ
8月6日以前にSolに対して出荷していたなら、変更すべきことが2つある:
- 全てのコールで**
reasoning.effortを明示的に設定**せよ。省略すると今はmediumになる;おそらくほとんどのケースでlowを望んでいたはずだ。 - パイプラインの境界に272Kガードを追加せよ。入力トークンが閾値を越えるリクエストを拒否またはチャンク化する。近似としての
len(input) / 4のばかチェックが最初の防衛線として十分だ。
Node.jsラッパー用のガードレール・ワンライナー
if (estimateTokens(input) > 260_000) { chunkOrReject(input); }このアップデートに含まれていないもの
このアップデート周辺で流れていた噂のうち、含まれていないものが2つ:
- GPT-6(Astra)。 一部の媒体は8月と噂したが、2026年8月11日現在、OpenAIはローンチ日、モデルカード、価格を確認していない。実際に判明していることと推測されていることについては OpenAI Astraプレビュー ページを参照。
- Sol値下げ。 ベースの $5 / $30 レートは変わっていない。一部の報道は272Kクリフ(サーチャージ)と価格変更を混同していた。
試してみよう
Check yourself
0/4参考文献とさらに読むもの
- OpenAI: GPT-5.6 August 2026 Updates (PDF) —— 8月6日の挙動パスと無料ティア展開の一次資料
- ChatGPT release notes (OpenAI Help Center) —— 正典のChatGPT側リリースノート
- Model release notes (OpenAI Help Center) —— APIモデル挙動ノート
- 9to5Mac: OpenAI updating ChatGPT with a smarter GPT-5.6 Sol and unlimited free chats (6 Aug 2026)
- Visual Studio Magazine: GPT-5.6 Sol Ascends for Token Efficiency (6 Aug 2026)
- AIToolsReview: GPT-5.6 Review — August 2026 —— エフォート・スライダーと272Kクリフの詳細
- Kingy AI: GPT-5.6 Fast Mode — Speed, Pricing and Tradeoffs —— Fastモード価格倍率と注意点
- Coursiv Blog: GPT-5.6 Sol — Benchmarks, API Pricing & Review —— 6段階の
reasoning.effortAPIパラメータ - BenchLM: GPT-5.6 Sol Benchmarks & Pricing —— ベース価格とベンチマーク比較
AILmanac内のクロスリンク:
- GPT-5.6とChatGPTをClaudeユーザーの視点で —— 2026年7月9日のローンチページ
- 高速推論とトークン速度 —— Fastティア製品がプロバイダー間でどう比較されるか
- Opus 5フィールドガイド —— エフォート・ティア比較のClaude側
- OpenAI Astraプレビュー —— 次のOpenAI世代について噂されていることと、実際に確認されていること