Claude 사용자를 위한 Gemini 3.6 Flash, Flash-Lite 그리고 Flash Cyber
Google은 2026년 7월에 Gemini 3.5 Pro를 출시할 것으로 예상되었습니다. 대신 2026년 7월 21일 그들은 세 개의 Flash-티어 모델 — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber — 을 출시하고 Pro 티어를 파트너 테스트에 남겼습니다. Claude로 빌드하고 Gemini를 크로스 체크로 사용한다면, 그 릴리스의 형태가 어떤 단일 벤치마크보다 중요합니다: Google은 시장에 워크호스 티어가 플래그십이 아니라 실제 돈이 있는 곳이라고 말하고 있습니다. 이 페이지는 Claude 사용자를 실제로 무엇이 상륙했는지, 어떤 가격에, 그리고 기존 호출을 이식할 때 무엇이 깨지는지 안내합니다.
- 2026년 7월 21일에 무엇이 출시되었는지 이해 — 세 개의 Flash 모델과 Google이 3.5 Pro를 건너뛴 이유
- 가격 표를 정직하게 읽기: 17% 저렴한 출력 플러스 17% 적은 출력 토큰은 실제 비용 ~30% 하락으로 복합됨
- Flash-Lite($0.30 in / $2.50 out, 350 tok/s, 1M 컨텍스트)가 Claude Haiku에 대한 올바른 크로스 체크일 때를 알기
- Flash Cyber가 V8 버그 사냥에서 Claude Opus 4.6을 어떻게 이겼는지 — 그리고 여러분이 거의 확실히 사용할 수 없는 이유
- 깔끔하게 마이그레이션: 어떤 샘플링 노브가 제거되었고 새 thinking_level enum이 무엇을 받는지
한 문장 버전
Google의 2026년 7월 21일 릴리스는 Pro가 없는 Flash-티어 리프레시입니다 — 새 워크호스(3.6 Flash, $1.50 in / $7.50 out, 1M 컨텍스트, Computer Use 내장), 더 저렴한 고처리량 자매(3.5 Flash-Lite, $0.30 in / $2.50 out, 초당 350 토큰), 그리고 Google이 CodeMender 프로그램을 통해 정부와 신뢰할 수 있는 파트너에게 게이팅하는 보안 전용 파인튠(3.5 Flash Cyber).
흥미로운 이야기는 모델이 아닙니다. 선택입니다: Google은 Pro를 명시적으로 뒤로 미루면서 워크호스와 저렴한 티어를 밀었고, Logan Kilpatrick은 Pro가 내부 성능 목표를 놓친 후 "현재 파트너와 테스트 중"이라고 말했습니다. 이는 2주 전 GPT-5.6 출시가 플래그십(Sol)으로 이끈 것과 다른 베팅입니다 — 미러 이미지 비교는 GPT-5.6 Sol/Terra/Luna 페이지 참조.
이 출시에서 사람들을 놀라게 하는 세 가지
모두가 "17% 저렴" 헤드라인을 쓰고 있습니다. Claude 사용자가 놓쳐서는 안 될 세부사항이 여기 있습니다.
1. Google은 3.5 Pro를 건너뛰었습니다 — 공개적으로
이는 Google이 보통 배송하는 방식이 아닙니다. 이전 리프레시에서 플래그십이 출시를 이끌고 작은 자매들이 뒤따랐습니다. 2026년 7월 21일 Google은 Flash 클래스 모델만 출시하고 3.5 Pro가 내부 성능 목표를 놓친 후 여전히 파트너 테스트 중임을 확인했습니다. 제품 리드 Logan Kilpatrick은 팀이 "곧 상륙"하기를 바란다고 말했습니다. 문자 그대로 읽으세요: 최고 지능 티어에서 Google은 아직 배송할 수 있는 스텝 함수를 가지고 있지 않습니다. 강력한 워크호스와 게이트할 수 있는 버그 헌터는 가지고 있습니다. 워크플로우가 "살 수 있는 가장 똑똑한 Gemini"에 의존한다면, 오늘 그것은 여전히 3.5 Pro-Preview 또는 이전 3.5 Ultra 티어입니다 — 2026년 7월 모델이 아닙니다.
2. 17% 출력 가격 인하는 실제로 ~30%입니다 왜냐하면 출력 토큰도 17% 떨어졌기 때문
출시 차트는 Gemini 3.6 Flash 출력 가격을 1M 토큰당 $7.50, 3.5 Flash의 $9에서 내려 — 17% 인하로 보여줍니다. 한 줄 아래를 보세요: Google은 또한 동일한 워크로드에서 17% 적은 출력 토큰을 보고합니다(Artificial Analysis Index에서 측정). 이것들은 복합됩니다: 0.83 × 0.83 ≈ 0.69, 따라서 실제 세계 출력 비용은 유사한 작업에서 대략 31% 떨어집니다, 17%가 아닙니다. DeepSWE에서 Google은 토큰 감소가 "최대 65%"라고 주장합니다. Claude Sonnet 5 파이프라인을 3.6 Flash에 대해 크로스 체크할 때, 스왑할지 결정하기 전에 곱셈을 하세요 — 헤드라인이 델타를 축소하고 있습니다.
3. Flash Cyber는 V8 버그 사냥에서 Claude Opus 4.6을 이겼지만 — 여러분은 거의 확실히 사용할 수 없습니다
Google은 Gemini 3.5 Flash Cyber가 내부 V8 JavaScript 엔진 벤치마크에서 55개의 고유 확인 취약점을 발견했다고 보고하며, 표준 3.5 Flash는 47개, Claude Opus 4.6은 36개입니다. 그 버그 중 10개는 다른 모델이 발견하지 못한 것입니다. CyberGym 벤치마크에서 **83.2%**로 착지하며, Claude Mythos 5(83.8%)와 GPT-5.5-Cyber(85.6%)에 가깝습니다. 인상적 — 그리고 게이트됨. Flash Cyber는 정부와 신뢰할 수 있는 엔터프라이즈 파트너에게 Google의 CodeMender 프로그램을 통해서만 배송됩니다. 공개 API도, 가격도, 셀프 서비스 접근도 없습니다. "Google의 사이버 AI가 Claude를 이겼다"는 헤드라인을 보고 시도할 것을 기대했다면: 할 수 없습니다. 방어자가 뽑아내야 할 요점은 "모델 스왑"이 아닙니다; 중간 티어 모델을 좁은 도메인에 파인튠하면 이제 그 도메인에서 더 큰 범용 모델을 이긴다는 것입니다. 그 패턴은 반복될 것입니다.
티어 표 (2026년 7월 21일 기준)
| 모델 | 입력 $/1M | 출력 $/1M | 캐시된 입력 $/1M | 컨텍스트 | 최대 출력 | 참고 |
|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | $0.15 | 1,048,576 | 65,536 | 워크호스; Computer Use 내장 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | (명시되지 않음) | 1,048,576 | 65,536 | 초당 350 토큰 출력; Google Search에서 롤아웃 중 |
| Gemini 3.5 Flash Cyber | (공개되지 않음) | (공개되지 않음) | (공개되지 않음) | (공개되지 않음) | (공개되지 않음) | 정부와 신뢰할 수 있는 파트너만, CodeMender를 통해 |
Google이 3.6 Flash vs 3.5 Flash로 게시한 벤치마크 델타(높을수록 좋음):
- DeepSWE: 49% vs 37% (+12 포인트)
- MLE Bench: 63.9% vs 49.7% (+14.2 포인트)
- OSWorld-Verified: 83.0% vs 78.4% (+4.6 포인트)
- GDPval-AA v2: 1421 Elo vs 1349 (+72 Elo)
- GPQA Diamond: 92.8%
- MMMU-Pro: 83.2%
- Humanity's Last Exam: 38.3%
- Chatbot Arena Elo (Text Overall): 1485
- Artificial Analysis Coding Index: 69.2%
두 개의 노브가 어떤 단일 벤치마크 행보다 유용합니다. 지식 컷오프가 2025년 1월에서 2026년 3월로 뛰었습니다 — 14개월 도약. "모델에서 직접 답하기" 태스크(RAG 없음, 브라우징 없음)에는 이것이 벤치마크 점수보다 종종 더 큽니다. 출력 속도는 3.6 Flash에 대해 초당 304 토큰, Flash-Lite에 대해 초당 350 토큰으로 인용되며, 이는 UI가 얼마나 많은 지연 시간 숨김을 해야 하는지를 바꿉니다.
Flash-Lite가 고볼륨 Claude 워크플로우의 진짜 이야기입니다
고볼륨, 지연 시간 민감 Claude 워크플로우 — 분류, 추출, 조정, 자동 완성 — 를 위해 1M-토큰 컨텍스트와 350 tok/s의 $0.30/$2.50의 Flash-Lite는 이제 Claude Haiku 4.5에 대한 명백한 크로스 체크입니다. Sonnet 대체품이 아니며, 계획 무거운 에이전트 루프에 사용해서는 안 됩니다. 그러나 스택에 "큐 뒤의 저렴한 모델" 티어가 있다면, A/B 테스트에 하루를 예산으로 편성하세요.
마이그레이션: Claude 사용자가 실제로 바꿔야 할 것
Gemini API 표면이 3.6로 바뀌었습니다. Claude 형태의 호출을 이어서 가져오면 네 가지가 깨집니다.
- 워크호스는 `gemini-3.6-flash`, 저렴한 티어는 `gemini-3.5-flash-lite`를 사용하세요. 3.5 Flash Cyber에는 공개 모델 ID가 없습니다. 3.5 Pro는 아직 배송되지 않습니다 — 거기에 고정하지 마세요.
- 이 샘플링 노브들은 3.6 Flash와 3.5 Flash-Lite에서 제거되었습니다. Claude 측 코드가 shim을 통해 그것들을 이어서 가져온다면 Gemini는 SDK에 따라 거부하거나 무시할 것입니다. 삭제하세요; 모델이 이제 내부적으로 샘플링을 처리합니다.
- 정수 토큰 `thinking_budget` 필드가 `thinking_level` enum으로 교체되었습니다. Flash는 medium을 기본으로, Flash-Lite는 minimal을 기본으로 합니다. 예산을 조정하고 있었다면 명시적으로 설정하세요 — 이전 정수를 이어서 가져올 수 없습니다.
- 3.6 Flash는 미리 채워진 모델 턴(비어있지 않은 `model` 역할로 끝나는 대화)을 거부합니다. 출력을 조종하기 위해 Anthropic 스타일 미리 채움을 사용하고 있었다면 재구조화하세요 — Gemini가 요청을 400할 것입니다.
- `candidate_count`는 3.6 Flash에서 지원되지 않습니다. 한 호출에서 여러 완성을 요청하고 있었다면 API를 N번 호출하거나 그 작업을 다른 티어로 옮기세요.
- 3.6 Flash에서 컴퓨터 사용 — GUI 조작 — 은 이제 별도 통합이 아니라 Gemini API와 Gemini Enterprise의 *클라이언트 측 내장 툴*입니다. 별도 SDK를 배관하는 대신 tools 블록에서 활성화하세요. Anthropic의 동등물은 [Claude computer-use 섹션](/docs/models/computer-use-agents)에 있습니다.
Minimal 3.6 Flash call (Python SDK)
from google import genai
client = genai.Client() # picks up GOOGLE_API_KEY
resp = client.models.generate_content(
model="gemini-3.6-flash",
contents="Extract the 3 riskiest lines from this diff and cite line numbers.",
config={
"thinking_level": "medium", # was thinking_budget=<int>
# do NOT pass temperature, top_p, top_k, candidate_count
"tools": [{"computer_use": {}}], # built-in, not a separate SDK
},
)
print(resp.text)Claude 대신 Gemini 3.6 Flash에 손을 뻗을 때 — 그리고 그렇지 않을 때
- 3.6 Flash에 손을 뻗어라: 토큰 효율이 비용을 지배하는 고볼륨 툴 루프, 그리고 2026년 3월 지식 컷오프의 이점을 얻는 워크플로우(이전 3.5 Flash보다 14개월 신선).
- Flash-Lite에 손을 뻗어라: Haiku가 베이스라인인 1M-토큰 입력에서 지연 시간 민감 분류/추출.
- Claude에 머물러라: SWE-Bench-Pro 스타일 실제 리포 버그 수정, 확장 사고 규율이 중요한 긴 에이전트 실행, 그리고 이미 Sonnet 5 계획 품질을 신뢰하는 곳 어디든지.
- Flash Cyber를 쫓지 마세요: 정부나 CodeMender 파트너가 아니라면, 그 숫자를 구매 결정이 아니라 연구 신호로 다루세요.
이 릴리스 이전의 더 넓은 Gemini-vs-Claude 프레이밍은 Claude 사용자를 위한 Gemini와 코딩 중심의 코딩을 위한 Claude vs GPT vs Gemini를 참조하세요. 2주 전 미러 이미지 OpenAI 출시는 GPT-5.6 Sol/Terra/Luna. 이런 스왑이 프로덕션과의 접촉에서 살아남게 하는 크로스-모델 이식 규칙은 모델 간 프롬프트 이식.
빠른 확인
Check yourself
0/4소스 & 추가 자료
- Google DeepMind — Gemini 3.5 Flash Cyber 소개
- Gemini API 가격 (공식)
- Google AI Studio
- TechCrunch — Google이 세 개의 새로운 Gemini 모델을 출시하지만 3.5 Pro는 없음
- SiliconANGLE — Google이 더 저렴한 모델과 목줄에 매인 버그 헌터로 Gemini를 확장
- MarkTechPost — Google이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 출시
- The Hacker News — Google이 소프트웨어 취약점을 찾고 수정하는 Gemini 3.5 Flash Cyber AI 출시
- Help Net Security — Google의 Gemini 3.5 Flash Cyber가 취약점 헌터가 되다