GPT-5.6 2026년 8월 업데이트: 노력 슬라이더, 무료 Think 버튼 & 272K 가격 절벽
2026년 8월 6일 OpenAI는 GPT-5.6의 사이클 중간 리프레시를 배포했고, 대부분의 보도는 이를 한 문장으로 축약했다: "Sol이 더 똑똑해졌고, 무료 사용자는 무제한 채팅을 얻었다." 진짜 업데이트는 더 흥미롭고 — Claude 사용자가 가끔 OpenAI 스택에 손을 뻗는다면 더 중대하다. 세 가지 움직이는 부품이 동시에 바뀌었다: 노력 제어가 이제 ChatGPT UI(슬라이더로)와 API(6단계 매개변수로) 모두에서 작동하고; 무료 계층 Think 버튼이 그다음 주에 무제한 Luna 채팅과 함께 배포되었으며; 272K 입력 토큰의 장기 컨텍스트 가격 절벽이 Sol에서만 작동하는 Fast 모드와 어색하게 상호작용한다. 각각이 실제 결정을 바꾼다.
이 페이지는 릴리스 노트의 안개에서 그 결정을 꺼내와 Claude 관점으로 생각하는 빌더에게 실제로 무엇이 바뀌는지 보여준다.
- 2026년 8월 6일 GPT-5.6에 정확히 무엇이 출시됐는지 — 그리고 무료 사용자에게 8월 10일 주에 무엇이 출시됐는지 확인
- 6단계 노력 매개변수(`none, low, medium, high, xhigh, max`)를 이해하고 Claude의 사고 노력 모델에 매핑
- 272K 입력 토큰 가격 절벽 학습 — 예산 잡았다고 생각한 작업을 조용히 두 배로 만들 수 있음
- Fast 모드가 도움되는 시점, 아무것도 하지 않는 시점, 조용히 거부하는 요청 알기
- 업데이트가 워크로드를 Claude에서 Sol로 옮길 진짜 이유인 시점 — 그렇지 않은 시점 결정
2026년 8월 6일 실제로 출시된 것
세 가지 구체적 항목. 나머지는 다듬기.
- Plus와 Pro 사용자는 응답당 ChatGPT가 사용하는 추론량을 설정하는 새 슬라이더를 웹, 모바일, 데스크톱에서 본다. 내부적으로 API는 같은 노브를 `reasoning.effort`로 6개 위치(`none`, `low`, `medium`, `high`, `xhigh`, `max`)로 노출하며 생략 시 `medium`이 기본. 이전 '모델이 결정' 동작을 대체한다: 이제 계층을 선택하고 그에 대해 지불한다.
- OpenAI는 Sol을 업데이트해 '더 직접적인 응답, 더 간결한 서식, 도움 안 될 때 추가 세부사항 회피'를 하고 질문별 세부사항을 적응시키며 '수정이 더 도움될 때 동의할 가능성이 낮음' — OpenAI가 명시적 반아첨 패스 배포에 가장 가까운 것. 금융, 의료, 법률 프롬프트에 대한 내부 평가는 사실 오류가 은퇴한 GPT-5.5 Instant보다 '68% 덜 흔함'을 보고했다.
- 무료 사용자는 GPT-5.6 Luna에서 무제한 텍스트 채팅(이전에는 제한됨)과 더 어려운 질문에 대한 깊은 추론용 새 Think 버튼을 얻으며 '남용 보호에 따라 조정'된다. Think 버튼은 8월 6일에 라이브가 아니었다 — 그다음 주에 배포되었다.
노력 슬라이더 — 6단계를 Claude 정신 모델에 매핑
Claude의 5단계 노력 설정(7월 Opus 5와 함께 도입) 관점으로 생각해왔다면 정신 모델은 유사하지만 라벨이 깔끔하게 맞지 않는다. GPT-5.6은 Claude가 다섯인 곳에서 여섯 단계이고, 양 극단에서 의미론이 다르다.
| GPT-5.6 계층 | 하는 일 | Claude Opus 5와 대략 유사 |
|---|---|---|
none | 추론 완전 건너뛰기; 즉시 답변 | 직접 등가물 없음 — Claude는 항상 조금 계획 |
low | 짧은 사고 체인, 저렴 | minimal 노력 |
medium (기본) | 균형 잡힌 계획; 출시된 기본 | low–medium |
high | 더 깊은 계획; 느리고 비쌈 | medium |
xhigh | 긴 숙고; 다단계 추론 | high |
max | 완전 추론 상한 — 비쌈 | maximum |
두 가지 실용적 결과:
- 기본이 이동했다. API에서
reasoning.effort를 생략하면medium을 얻는다. 이전에 많은 래퍼가 모델의 자동 노력 선택에 의존했다; 그 동작은 사라졌다. 예측 가능한 비용을 위해 이제 명시적이 필수다. none은 실제 버튼이다. 분류기 프롬프트, 구조화 추출, 또는 추론 토큰이 순수 오버헤드인 도구 라우터 호출에 진짜 유용하다. Claude에는 깔끔한 등가 '오프' 스위치가 없다.
노력을 명시적으로 고정하는 안전한 요청 템플릿
{
"model": "gpt-5.6-sol",
"reasoning": { "effort": "low" },
"messages": [
{ "role": "system", "content": "Extract only. Output JSON." },
{ "role": "user", "content": "..." }
]
}272K 토큰 가격 절벽 — 진짜 위험
예상치 못하게 청구서를 태울 가능성이 가장 높은 변경.
규칙: 요청 입력이 272,000 토큰을 넘으면 전체 요청이 입력 비율의 2배, 출력 비율의 1.5배로 다시 가격 매겨진다 — 선 위의 토큰만이 아니다. 안분은 없다.
이 규칙에 대한 두 가지가 중요하다:
- 경사가 아닌 절벽이다. 271,999 입력 토큰 프롬프트는 기본 요금을 지불한다. 272,001 프롬프트는 호출의 모든 입력과 출력 토큰(모델이 생성하는 추론 토큰 포함)에 2×/1.5×를 지불한다.
- 긴 대화가 그 선을 살금살금 넘는다. 다중 턴 채팅과 에이전트 루프가 히스토리를 축적한다. 272K 아래에서 시작한 세션이 12번째 턴에서 조용히 선을 넘어 이후 모든 턴을 다시 가격 매길 수 있다.
- GPT-5.6 Sol 기본 가격은 백만당 $5 / $30 (입력 / 출력)이며 캐시된 입력은 $0.50. 272K 입력 토큰 위에서는 같은 호출이 $10 / $45. 4K 출력의 300K 토큰 문서에서 기본 비용은 $1.62. 절벽을 넘으면 $3.18이 된다 — 임계값을 넘는 한 토큰에 대해 거의 2배.
- 200K 호출 두 개는 입력에서 $2. 400K 호출 하나는 $8 (전체 요청의 입력 2×). 두 청크 중 어느 것도 272K 아래에 머문다면 청킹이 입력에서 4배 저렴. 모델이 한 번에 모든 것을 볼 필요가 진짜 있을 때만 채워라.
- $0.50의 캐시된 입력은 272K까지 여전히 $0.50에 캐시됨. 절벽 위에서는 승수가 모든 가격 매겨진 토큰(캐시된 접두사 위의 캐시되지 않은 입력 포함)에 적용된다. 안정적인 250K 캐시 접두사 + 증가하는 꼬리가 조용히 넘게 밀 수 있다.
Fast 모드 — 읽을 가치가 있는 세부 사항
Fast 모드는 Sol 전용 옵션으로 가격과 지연 시간을 교환한다: 최대 2.5배 빠름, API 가격 2배. Terra와 Luna는 제공하지 않는다.
출시 피치가 축소하는 세 가지:
- '최대'는 천장이지 표준이 아니다. 벽시계 속도 향상은 워크로드에 따라 다르다 — 도구 호출, 네트워크 홉, 스트리밍 속도 모두 실현 이득을 2.5배 훨씬 아래로 상한한다.
- Fast 모드와 장기 컨텍스트는 깔끔하게 섞이지 않는다. OpenAI는 상호 배제 규칙을 게시하지 않았지만, 초기 가이드는 Fast 모드 요청이 272K 입력 임계값을 넘으면 나쁘게 동작한다(또는 조용히 저하)고 보고한다. OpenAI가 달리 문서화할 때까지 호환되지 않는 것으로 취급하라.
- 추론 토큰은 여전히 계산된다. Fast 모드는 처리량을 빠르게 하지만
max노력 호출은 여전히 같은 양의 추론 출력을 생성한다. 실제로 느낄 수 있는 지연 시간에 지불할 때만 경제성이 작동한다.
- Fast 모드의 손익분기는 2.5배 상한에서 달러당 처리량 약 25% 더 — 상한에 도달하지 않으면 더 나쁨.
- 사용자가 기다리는 대화형 채팅에는 Fast 모드 선호. 배치, 백그라운드 에이전트, 장기 컨텍스트 RAG에는 건너뛰기.
- 비용을 위해 배치 파이프라인을 Claude에서 Sol로 전환하려던 경우 Fast 모드를 켜지 마라 — 절약을 지운다.
무료 계층: 무제한 Luna + Think 버튼
Claude 사용자에게는 이것이 API 변경보다 덜 중요하지만, 친구의 스크린샷에 나타나 논쟁을 시작할 가능성이 가장 높은 변경이다.
- 무제한 텍스트 채팅이 2026년 8월 10일 주부터 무료 ChatGPT 사용자에게 GPT-5.6 Luna에서. 이전에는 제한.
- Think 버튼이 무료 채팅에서 같은 창. 특정 메시지에 깊은 추론 패스를 추가, 남용 보호에 따라. Plus/Pro 노력 슬라이더와 같은 UI가 아니다 — 세션 전체 설정이 아닌 메시지별 토글이다.
실용적 해석: OpenAI는 Claude와 Gemini 둘 다 관대한 무료 추론 옵션을 가진 지금 무료 계층을 공격적으로 방어하고 있다. 처음 몇 주간 남용 보호 상한이 빠듯할 것으로 예상하라.
이 업데이트가 실제로 Claude 사용자의 결정을 바꾸는 지점
대부분의 Claude 워크로드에서 답은 같다. 세 가지 특정 패턴에 대해서는 움직인다.
- Sol Luna의 `reasoning.effort: none`은 이제 고볼륨 라우팅, 태그 추출, 구조화 라벨링에 대해 최소 노력 Claude Haiku 호출보다 그럴싸하게 저렴한 옵션 — 프롬프트가 272K 아래에 잘 머무는 경우. 전환 전 대표 샘플로 벤치마크하라.
- Sol + Fast 모드는 이제 OpenAI가 배포하는 가장 빠른 품질 계층. 각 응답에 사용자가 대기 중이고 프롬프트가 272K 아래에 맞으면, 이것이 트레이드오프를 가장 크게 바꾸는 업데이트다. 백그라운드 에이전트 실행에는 무시하라.
- 272K 절벽은 이를 위해 설계해야 함을 의미한다. Claude Opus 5의 1M 컨텍스트와 Sol의 1.05M 컨텍스트 둘 다 272K를 훨씬 넘어 확장되지만, Claude는 같은 모양의 절벽이 없다 — 장기 컨텍스트 가격이 평평하다. 400K+ 입력의 저장소 전체 작업에는 현재 Claude가 비용 이점이 있다.
기존 GPT-5.6 API 코드 마이그레이션 노트
8월 6일 전에 Sol에 대해 배포했다면 두 가지를 바꿔야 한다:
- 모든 호출에
reasoning.effort를 명시적으로 설정. 생략은 이제medium을 부과한다; 아마 대부분에low를 원했을 것이다. - 파이프라인 경계에 272K 가드 추가. 입력 토큰이 임계값을 넘어 밀리는 요청을 거부하거나 청크.
len(input) / 4의 어리석은 근사 검사가 첫 번째 방어선으로 충분하다.
Node.js 래퍼용 가드레일 원라이너
if (estimateTokens(input) > 260_000) { chunkOrReject(input); }이 업데이트에 포함되지 않은 것
이 업데이트 주변에 돌던 두 소문은 일부가 아니다:
- GPT-6 (Astra). 일부 매체에서 8월로 소문났지만, 2026년 8월 11일 기준 OpenAI는 출시일, 모델 카드, 가격을 확정하지 않았다. 실제로 알려진 것 대 추측을 위해 우리의 OpenAI Astra preview 페이지 참조.
- Sol 가격 하락. 기본 $5 / $30 요금은 바뀌지 않았다. 일부 보도가 272K 절벽(할증료)을 가격 변경과 혼동했다.
시도해보기
Check yourself
0/4출처 및 추가 읽기
- OpenAI: GPT-5.6 August 2026 Updates (PDF) — 8월 6일 동작 패스와 무료 계층 배포의 주요 출처
- ChatGPT release notes (OpenAI Help Center) — 정통 ChatGPT 측 릴리스 노트
- Model release notes (OpenAI Help Center) — API 모델 동작 노트
- 9to5Mac: OpenAI updating ChatGPT with a smarter GPT-5.6 Sol and unlimited free chats (6 Aug 2026)
- Visual Studio Magazine: GPT-5.6 Sol Ascends for Token Efficiency (6 Aug 2026)
- AIToolsReview: GPT-5.6 Review — August 2026 — 노력 슬라이더와 272K 절벽 세부사항
- Kingy AI: GPT-5.6 Fast Mode — Speed, Pricing and Tradeoffs — Fast 모드 가격 승수와 주의사항
- Coursiv Blog: GPT-5.6 Sol — Benchmarks, API Pricing & Review — 6단계
reasoning.effortAPI 매개변수 - BenchLM: GPT-5.6 Sol Benchmarks & Pricing — 기본 가격과 벤치마크 비교
AILmanac 내부 크로스 링크:
- GPT-5.6 & ChatGPT Work for Claude Users — 2026년 7월 9일 출시 페이지
- Fast Inference & Token Speed — 제공자 전반의 Fast 계층 제품 비교 방법
- Opus 5 Field Guide — 노력 계층 비교의 Claude 측
- OpenAI Astra Preview — 다음 OpenAI 세대에 대해 소문된 것과 실제 확정된 것