본문으로 건너뛰기

Claude 사용자를 위한 Gemini 3.6 Flash, Flash-Lite 그리고 Flash Cyber

중급

Google은 2026년 7월에 Gemini 3.5 Pro를 출시할 것으로 예상되었습니다. 대신 2026년 7월 21일 그들은 세 개의 Flash-티어 모델Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber — 을 출시하고 Pro 티어를 파트너 테스트에 남겼습니다. Claude로 빌드하고 Gemini를 크로스 체크로 사용한다면, 그 릴리스의 형태가 어떤 단일 벤치마크보다 중요합니다: Google은 시장에 워크호스 티어가 플래그십이 아니라 실제 돈이 있는 곳이라고 말하고 있습니다. 이 페이지는 Claude 사용자를 실제로 무엇이 상륙했는지, 어떤 가격에, 그리고 기존 호출을 이식할 때 무엇이 깨지는지 안내합니다.

What you'll learn
  • 2026년 7월 21일에 무엇이 출시되었는지 이해 — 세 개의 Flash 모델과 Google이 3.5 Pro를 건너뛴 이유
  • 가격 표를 정직하게 읽기: 17% 저렴한 출력 플러스 17% 적은 출력 토큰은 실제 비용 ~30% 하락으로 복합됨
  • Flash-Lite($0.30 in / $2.50 out, 350 tok/s, 1M 컨텍스트)가 Claude Haiku에 대한 올바른 크로스 체크일 때를 알기
  • Flash Cyber가 V8 버그 사냥에서 Claude Opus 4.6을 어떻게 이겼는지 — 그리고 여러분이 거의 확실히 사용할 수 없는 이유
  • 깔끔하게 마이그레이션: 어떤 샘플링 노브가 제거되었고 새 thinking_level enum이 무엇을 받는지

한 문장 버전

Google의 2026년 7월 21일 릴리스는 Pro가 없는 Flash-티어 리프레시입니다 — 새 워크호스(3.6 Flash, $1.50 in / $7.50 out, 1M 컨텍스트, Computer Use 내장), 더 저렴한 고처리량 자매(3.5 Flash-Lite, $0.30 in / $2.50 out, 초당 350 토큰), 그리고 Google이 CodeMender 프로그램을 통해 정부와 신뢰할 수 있는 파트너에게 게이팅하는 보안 전용 파인튠(3.5 Flash Cyber).

흥미로운 이야기는 모델이 아닙니다. 선택입니다: Google은 Pro를 명시적으로 뒤로 미루면서 워크호스와 저렴한 티어를 밀었고, Logan Kilpatrick은 Pro가 내부 성능 목표를 놓친 후 "현재 파트너와 테스트 중"이라고 말했습니다. 이는 2주 전 GPT-5.6 출시가 플래그십(Sol)으로 이끈 것과 다른 베팅입니다 — 미러 이미지 비교는 GPT-5.6 Sol/Terra/Luna 페이지 참조.

이 출시에서 사람들을 놀라게 하는 세 가지

모두가 "17% 저렴" 헤드라인을 쓰고 있습니다. Claude 사용자가 놓쳐서는 안 될 세부사항이 여기 있습니다.

1. Google은 3.5 Pro를 건너뛰었습니다 — 공개적으로

이는 Google이 보통 배송하는 방식이 아닙니다. 이전 리프레시에서 플래그십이 출시를 이끌고 작은 자매들이 뒤따랐습니다. 2026년 7월 21일 Google은 Flash 클래스 모델만 출시하고 3.5 Pro가 내부 성능 목표를 놓친 후 여전히 파트너 테스트 중임을 확인했습니다. 제품 리드 Logan Kilpatrick은 팀이 "곧 상륙"하기를 바란다고 말했습니다. 문자 그대로 읽으세요: 최고 지능 티어에서 Google은 아직 배송할 수 있는 스텝 함수를 가지고 있지 않습니다. 강력한 워크호스와 게이트할 수 있는 버그 헌터는 가지고 있습니다. 워크플로우가 "살 수 있는 가장 똑똑한 Gemini"에 의존한다면, 오늘 그것은 여전히 3.5 Pro-Preview 또는 이전 3.5 Ultra 티어입니다 — 2026년 7월 모델이 아닙니다.

2. 17% 출력 가격 인하는 실제로 ~30%입니다 왜냐하면 출력 토큰도 17% 떨어졌기 때문

출시 차트는 Gemini 3.6 Flash 출력 가격을 1M 토큰당 $7.50, 3.5 Flash의 $9에서 내려 — 17% 인하로 보여줍니다. 한 줄 아래를 보세요: Google은 또한 동일한 워크로드에서 17% 적은 출력 토큰을 보고합니다(Artificial Analysis Index에서 측정). 이것들은 복합됩니다: 0.83 × 0.83 ≈ 0.69, 따라서 실제 세계 출력 비용은 유사한 작업에서 대략 31% 떨어집니다, 17%가 아닙니다. DeepSWE에서 Google은 토큰 감소가 "최대 65%"라고 주장합니다. Claude Sonnet 5 파이프라인을 3.6 Flash에 대해 크로스 체크할 때, 스왑할지 결정하기 전에 곱셈을 하세요 — 헤드라인이 델타를 축소하고 있습니다.

3. Flash Cyber는 V8 버그 사냥에서 Claude Opus 4.6을 이겼지만 — 여러분은 거의 확실히 사용할 수 없습니다

Google은 Gemini 3.5 Flash Cyber가 내부 V8 JavaScript 엔진 벤치마크에서 55개의 고유 확인 취약점을 발견했다고 보고하며, 표준 3.5 Flash는 47개, Claude Opus 4.6은 36개입니다. 그 버그 중 10개는 다른 모델이 발견하지 못한 것입니다. CyberGym 벤치마크에서 **83.2%**로 착지하며, Claude Mythos 5(83.8%)와 GPT-5.5-Cyber(85.6%)에 가깝습니다. 인상적 — 그리고 게이트됨. Flash Cyber는 정부와 신뢰할 수 있는 엔터프라이즈 파트너에게 Google의 CodeMender 프로그램을 통해서만 배송됩니다. 공개 API도, 가격도, 셀프 서비스 접근도 없습니다. "Google의 사이버 AI가 Claude를 이겼다"는 헤드라인을 보고 시도할 것을 기대했다면: 할 수 없습니다. 방어자가 뽑아내야 할 요점은 "모델 스왑"이 아닙니다; 중간 티어 모델을 좁은 도메인에 파인튠하면 이제 그 도메인에서 더 큰 범용 모델을 이긴다는 것입니다. 그 패턴은 반복될 것입니다.

티어 표 (2026년 7월 21일 기준)

모델입력 $/1M출력 $/1M캐시된 입력 $/1M컨텍스트최대 출력참고
Gemini 3.6 Flash$1.50$7.50$0.151,048,57665,536워크호스; Computer Use 내장
Gemini 3.5 Flash-Lite$0.30$2.50(명시되지 않음)1,048,57665,536초당 350 토큰 출력; Google Search에서 롤아웃 중
Gemini 3.5 Flash Cyber(공개되지 않음)(공개되지 않음)(공개되지 않음)(공개되지 않음)(공개되지 않음)정부와 신뢰할 수 있는 파트너만, CodeMender를 통해

Google이 3.6 Flash vs 3.5 Flash로 게시한 벤치마크 델타(높을수록 좋음):

  • DeepSWE: 49% vs 37% (+12 포인트)
  • MLE Bench: 63.9% vs 49.7% (+14.2 포인트)
  • OSWorld-Verified: 83.0% vs 78.4% (+4.6 포인트)
  • GDPval-AA v2: 1421 Elo vs 1349 (+72 Elo)
  • GPQA Diamond: 92.8%
  • MMMU-Pro: 83.2%
  • Humanity's Last Exam: 38.3%
  • Chatbot Arena Elo (Text Overall): 1485
  • Artificial Analysis Coding Index: 69.2%

두 개의 노브가 어떤 단일 벤치마크 행보다 유용합니다. 지식 컷오프가 2025년 1월에서 2026년 3월로 뛰었습니다 — 14개월 도약. "모델에서 직접 답하기" 태스크(RAG 없음, 브라우징 없음)에는 이것이 벤치마크 점수보다 종종 더 큽니다. 출력 속도는 3.6 Flash에 대해 초당 304 토큰, Flash-Lite에 대해 초당 350 토큰으로 인용되며, 이는 UI가 얼마나 많은 지연 시간 숨김을 해야 하는지를 바꿉니다.

Flash-Lite가 고볼륨 Claude 워크플로우의 진짜 이야기입니다

Enter 또는 스페이스 키를 눌러 카드를 뒤집습니다. 좌우 화살표 키로 카드를 이동할 수 있습니다.용어가 표시되었습니다.
1 / 6

고볼륨, 지연 시간 민감 Claude 워크플로우 — 분류, 추출, 조정, 자동 완성 — 를 위해 1M-토큰 컨텍스트350 tok/s$0.30/$2.50의 Flash-Lite는 이제 Claude Haiku 4.5에 대한 명백한 크로스 체크입니다. Sonnet 대체품이 아니며, 계획 무거운 에이전트 루프에 사용해서는 안 됩니다. 그러나 스택에 "큐 뒤의 저렴한 모델" 티어가 있다면, A/B 테스트에 하루를 예산으로 편성하세요.

마이그레이션: Claude 사용자가 실제로 바꿔야 할 것

Gemini API 표면이 3.6로 바뀌었습니다. Claude 형태의 호출을 이어서 가져오면 네 가지가 깨집니다.

Guided walkthrough1 of 6
  1. 워크호스는 `gemini-3.6-flash`, 저렴한 티어는 `gemini-3.5-flash-lite`를 사용하세요. 3.5 Flash Cyber에는 공개 모델 ID가 없습니다. 3.5 Pro는 아직 배송되지 않습니다 — 거기에 고정하지 마세요.

Minimal 3.6 Flash call (Python SDK)

from google import genai

client = genai.Client()  # picks up GOOGLE_API_KEY
resp = client.models.generate_content(
  model="gemini-3.6-flash",
  contents="Extract the 3 riskiest lines from this diff and cite line numbers.",
  config={
      "thinking_level": "medium",   # was thinking_budget=<int>
      # do NOT pass temperature, top_p, top_k, candidate_count
      "tools": [{"computer_use": {}}],  # built-in, not a separate SDK
  },
)
print(resp.text)

Claude 대신 Gemini 3.6 Flash에 손을 뻗을 때 — 그리고 그렇지 않을 때

Pro tip
  • 3.6 Flash에 손을 뻗어라: 토큰 효율이 비용을 지배하는 고볼륨 툴 루프, 그리고 2026년 3월 지식 컷오프의 이점을 얻는 워크플로우(이전 3.5 Flash보다 14개월 신선).
  • Flash-Lite에 손을 뻗어라: Haiku가 베이스라인인 1M-토큰 입력에서 지연 시간 민감 분류/추출.
  • Claude에 머물러라: SWE-Bench-Pro 스타일 실제 리포 버그 수정, 확장 사고 규율이 중요한 긴 에이전트 실행, 그리고 이미 Sonnet 5 계획 품질을 신뢰하는 곳 어디든지.
  • Flash Cyber를 쫓지 마세요: 정부나 CodeMender 파트너가 아니라면, 그 숫자를 구매 결정이 아니라 연구 신호로 다루세요.

이 릴리스 이전의 더 넓은 Gemini-vs-Claude 프레이밍은 Claude 사용자를 위한 Gemini와 코딩 중심의 코딩을 위한 Claude vs GPT vs Gemini를 참조하세요. 2주 전 미러 이미지 OpenAI 출시는 GPT-5.6 Sol/Terra/Luna. 이런 스왑이 프로덕션과의 접촉에서 살아남게 하는 크로스-모델 이식 규칙은 모델 간 프롬프트 이식.

빠른 확인

Check yourself

0/4
  1. Google이 2026년 7월 21일에 **출시하지 않은** 모델은?
  2. '17% 출력 가격 인하'가 3.6 Flash의 실제 비용 하락을 축소하는 이유는?
  3. Gemini 3.6 Flash에서 어떤 샘플링 파라미터가 여전히 유효합니까?
  4. Gemini 3.5 Flash Cyber의 실제 접근 스토리는?

소스 & 추가 자료