Claude ユーザーのための Gemini 3.6 Flash・Flash-Lite・Flash Cyber
Google は2026年7月に Gemini 3.5 Pro を出荷すると見られていた。ところが2026年7月21日、彼らは 3つの Flash 系モデル — Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber — を出荷し、Pro ティアはパートナーテスト段階に残したままだった。Claude 上で構築し、Gemini をクロスチェックとして使うなら、このリリースの「形」は個別のベンチマーク数値よりも重要だ。Google は市場に対して、真の稼ぎ頭はフラッグシップではなく主力ティアだと伝えている。このページでは、Claude ユーザーの視点で、実際に何が、いくらで登場したのか、そして既存の呼び出しを移植したときに何が壊れるのかを追う。
- 2026年7月21日に何が出荷されたのか — 3つの Flash モデルと、Google が 3.5 Pro をスキップした理由を理解する
- 価格表を正直に読む: 出力料金17%引き下げ + 出力トークン数17%減、複合で実質約30%のコスト減
- Flash-Lite($0.30 入力 / $2.50 出力、350 tok/s、1M コンテキスト)が Claude Haiku に対する適切なクロスチェックになるのはいつか
- V8 バグ発見で Flash Cyber が Claude Opus 4.6 を上回った経緯と、なぜあなたはほぼ確実にそれを使えないのか
- きれいに移行する: 削除されたサンプリングパラメータと、新しい thinking_level enum が受け付ける値
一文でまとめると
Google の2026年7月21日のリリースは、Pro なしの Flash ティア刷新だ — 新しい主力(3.6 Flash、$1.50 入力 / $7.50 出力、1M コンテキスト、Computer Use 内蔵)、より安価な高スループット版(3.5 Flash-Lite、$0.30 入力 / $2.50 出力、350 トークン/秒)、そして セキュリティ専用ファインチューン(3.5 Flash Cyber)。Cyber は CodeMender プログラムを通じて政府機関と信頼される提携先だけにゲートされている。
面白いのはモデルそのものではなく、その選択だ。Google は主力と低価格ティアを推し出す一方で、Pro を明示的に据え置いた。Logan Kilpatrick は Pro について「現在パートナー向けにテスト中」で、社内の性能目標に届かなかったと述べた。これは2週間前の OpenAI GPT-5.6 のローンチ — フラッグシップ(Sol)を先頭に据えた — とは異なる賭けだ。鏡像的な比較は GPT-5.6 Sol/Terra/Luna のページを参照。
このローンチについて人々を驚かせる3つのこと
誰もが「17% 安い」という見出しを書いている。ここでは Claude ユーザーが見逃してはいけない詳細を挙げる。
1. Google は 3.5 Pro を — 公然と — スキップした
これは Google の通常の出荷方法ではない。従来のリフレッシュではフラッグシップがローンチを牽引し、小型の兄弟モデルが後に続いた。2026年7月21日、Google は Flash クラスのモデルだけを出荷し、3.5 Pro は社内の性能目標に届かなかった後もまだパートナーテスト段階にあることを認めた。プロダクトリードの Logan Kilpatrick は「近日中に着地したい」と述べた。文字通り読むべきだ。知性の最高ティアでは、Google はまだ出荷可能なステップ関数を持っていない。強力な主力モデルとゲート付きのバグハンターは持っている。もしあなたのワークフローが「買える中で最も賢い Gemini」に依存しているなら、今日それは 3.5 Pro-Preview か古い 3.5 Ultra ティアであって、2026年7月のモデルではない。
2. 出力価格17%引き下げは、出力トークン数も17%減ったため実質約30%になる
ローンチのチャートは、Gemini 3.6 Flash の 出力価格が 1M トークンあたり $7.50、3.5 Flash の $9 から — 17% の引き下げだと示している。1行下を見よ。Google は同じワークロードで 出力トークン数が17% 減ったとも報告している(Artificial Analysis Index で測定)。これらは複合する。0.83 × 0.83 ≈ 0.69 となり、比較可能なジョブでの実世界の出力コストは17%ではなく、およそ 31% 下がる。DeepSWE では Google は「最大 65%」のトークン削減を主張している。Claude Sonnet 5 のパイプラインを 3.6 Flash とクロスチェックする際は、置き換えを決める前に掛け算をせよ。見出しの数字はデルタを過小評価している。
3. Flash Cyber は V8 バグ発見で Claude Opus 4.6 を上回った — が、あなたはほぼ確実に使えない
Google の報告によれば、Gemini 3.5 Flash Cyber は社内の V8 JavaScript エンジンベンチマークで55件の固有の確認済み脆弱性を発見した。標準の 3.5 Flash は 47 件、Claude Opus 4.6 は 36 件だ。うち10件は他のどのモデルも見つけられなかった。CyberGym ベンチマークでは 83.2% に着地し、Claude Mythos 5(83.8%)や GPT-5.5-Cyber(85.6%)に近い。印象的で、そしてゲートされている。Flash Cyber は Google の CodeMender プログラム経由でのみ、政府機関と信頼される企業パートナーに提供される。公開 API も、価格表も、セルフサーブアクセスもない。「Google のサイバー AI が Claude を破った」という見出しを見て試そうとしたなら、それは無理だ。防御側が抽出すべき教訓は「モデルを乗り換えろ」ではない。中位ティアのモデルを狭いドメインでファインチューンすると、そのドメインではより大きな汎用モデルを上回る、ということだ。このパターンは繰り返される。
ティア表(2026年7月21日時点)
| モデル | 入力 $/1M | 出力 $/1M | キャッシュ入力 $/1M | コンテキスト | 最大出力 | 備考 |
|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | $0.15 | 1,048,576 | 65,536 | 主力モデル。Computer Use 内蔵 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | (未記載) | 1,048,576 | 65,536 | 出力 350 トークン/秒。Google Search でロールアウト中 |
| Gemini 3.5 Flash Cyber | (非公開) | (非公開) | (非公開) | (非公開) | (非公開) | 政府機関と信頼される提携先のみ、CodeMender 経由 |
Google が公開した 3.6 Flash 対 3.5 Flash のベンチマーク差分(数値は高いほど良い):
- DeepSWE: 49% vs 37%(+12 ポイント)
- MLE Bench: 63.9% vs 49.7%(+14.2 ポイント)
- OSWorld-Verified: 83.0% vs 78.4%(+4.6 ポイント)
- GDPval-AA v2: 1421 Elo vs 1349(+72 Elo)
- GPQA Diamond: 92.8%
- MMMU-Pro: 83.2%
- Humanity's Last Exam: 38.3%
- Chatbot Arena Elo (Text Overall): 1485
- Artificial Analysis Coding Index: 69.2%
単一のベンチマーク行よりも役立つノブが2つある。知識カットオフが2025年1月から2026年3月にジャンプした — 14 か月の飛躍だ。「モデル単独で答える」タスク(RAG なし、ブラウジングなし)では、これはベンチマークスコアより大きなことが多い。出力速度は 3.6 Flash が 304 トークン/秒、Flash-Lite が 350 トークン/秒と示されており、UI にどれだけレイテンシ隠しが必要かが変わる。
Flash-Lite こそが大量処理の Claude ワークフローにおける本命
大量処理・レイテンシに敏感な Claude ワークフロー — 分類、抽出、モデレーション、オートコンプリート — では、$0.30/$2.50 で 1M トークンのコンテキストと 350 tok/s を持つ Flash-Lite は、Claude Haiku 4.5 に対する明白なクロスチェックとなる。Sonnet の置き換えではないし、計画重視のエージェントループには使うべきでない。しかし、スタックに「キューの背後の安価モデル」ティアがあるなら、1日を割いて A/B テストする価値がある。
移行: Claude ユーザーが実際に変える必要のあること
Gemini API のサーフェスは 3.6 で変わった。Claude 型の呼び出しをそのまま持ち込むと、4つのことが壊れる。
- 主力には `gemini-3.6-flash`、低価格ティアには `gemini-3.5-flash-lite` を使う。3.5 Flash Cyber の公開モデル ID はない。3.5 Pro はまだ出荷されていない — ピン留めしないこと。
- これらのサンプリングノブは 3.6 Flash と 3.5 Flash-Lite から削除された。Claude 側のコードが shim 経由でこれらを持ち込んでいる場合、Gemini は SDK によって拒否するか無視する。削除せよ — サンプリングはモデル側で内部処理される。
- 整数トークン指定の `thinking_budget` フィールドは `thinking_level` enum に置き換えられた。Flash のデフォルトは medium、Flash-Lite のデフォルトは minimal。予算をチューニングしていたなら明示的に設定せよ — 古い整数値は引き継げない。
- 3.6 Flash は事前充填されたモデルターン(非空の `model` ロールで終わる会話)を拒否する。Anthropic 型の prefill で出力を誘導していたなら再構成せよ — Gemini はリクエストを 400 で返す。
- `candidate_count` は 3.6 Flash では非サポート。1回の呼び出しで複数補完を要求していたなら、API を N 回呼ぶか、そのジョブを別のティアに移す。
- 3.6 Flash では、Computer Use — GUI の操作 — は Gemini API および Gemini Enterprise の *クライアント側の組み込みツール* となり、別個の統合ではない。別 SDK を配線するのではなく、tools ブロックで有効化せよ。Anthropic 側の同等機能は [Claude computer-use セクション](/docs/models/computer-use-agents)にある。
最小限の 3.6 Flash 呼び出し(Python SDK)
from google import genai
client = genai.Client() # picks up GOOGLE_API_KEY
resp = client.models.generate_content(
model="gemini-3.6-flash",
contents="Extract the 3 riskiest lines from this diff and cite line numbers.",
config={
"thinking_level": "medium", # was thinking_budget=<int>
# do NOT pass temperature, top_p, top_k, candidate_count
"tools": [{"computer_use": {}}], # built-in, not a separate SDK
},
)
print(resp.text)Gemini 3.6 Flash に手を伸ばすべきとき — そうでないとき
- 3.6 Flash に手を伸ばす: トークン効率がコストを支配する大量ツールループ、そして2026年3月の知識カットオフから恩恵を受けるワークフロー(古い 3.5 Flash より14か月新しい)。
- Flash-Lite に手を伸ばす: Haiku をベースラインとする、1M トークン入力に対するレイテンシ敏感な分類/抽出。
- Claude に留まる: SWE-Bench-Pro 型の実リポジトリでのバグ修正、拡張推論の規律が効く長いエージェント実行、そして既に Sonnet 5 の計画品質を信頼している領域。
- Flash Cyber を追わない: 政府機関か CodeMender パートナーでない限り、その数値は購買判断ではなく研究シグナルとして扱え。
このリリース以前の Gemini 対 Claude のより広い視点については、Claude ユーザーのための Gemini と、コーディング特化の コーディングのための Claude vs GPT vs Gemini を参照。2週間前の鏡像的な OpenAI のローンチについては GPT-5.6 Sol/Terra/Luna。これらいずれの差し替えも本番投入に耐えるようにするためのクロスモデル移植ルールについては、モデル間のプロンプト移植。
理解度チェック
Check yourself
0/4ソースとさらなる参考資料
- Google DeepMind — Introducing Gemini 3.5 Flash Cyber
- Gemini API pricing (official)
- Google AI Studio
- TechCrunch — Google releases three new Gemini models, but no 3.5 Pro
- SiliconANGLE — Google expands Gemini with cheaper models and a bug-hunter it keeps on a leash
- MarkTechPost — Google releases Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
- The Hacker News — Google Launches Gemini 3.5 Flash Cyber AI to Find and Fix Software Vulnerabilities
- Help Net Security — Google's Gemini 3.5 Flash Cyber becomes a vulnerability hunter