콘텐츠로 이동

GPT-5.6 모델 계열과 크레딧 이해

입력창 아래에는 모델과 추론 강도를 고르는 컨트롤이 있다. 기본값을 그대로 써도 대부분 잘 동작하지만, 두 가지 상황에서는 손을 대는 게 좋다. 첫째는 결과가 기대에 못 미칠 때다. 더 깊은 계획이나 분석이 필요한 작업인데 낮은 설정으로 돌리고 있을 수 있다. 둘째는 사용량이 예상보다 빨리 줄 때다. 단순 반복 작업을 가장 강한 모델로 돌리고 있을 수 있다.

한 가지 먼저 알아 둘 것이 있다. ChatGPT Work와 Codex는 사용량 한도를 공유한다. 공식 가격 문서의 첫 문장이 이 내용이다. ChatGPT 안에서 쓰는 ChatGPT Work 사용량은 Codex와 동일한 가격, 크레딧(credits), 사용량 한도를 쓴다. 그래서 두 곳을 오가며 쓰더라도 사용량은 하나의 계정 예산에서 빠진다.

OpenAI Academy 시작하기 주제의 커버 아트
모델과 설정은 도구를 익히는 첫 단계에서 한 번 정리해 두면 이후 판단이 쉬워진다 · 출처: OpenAI Academy

GPT-5.6 계열에는 권장 모델 세 개가 있다. 공식 문서의 표현을 그대로 옮기면 Sol은 디테일과 완성도, Terra는 일상 업무의 주력, Luna는 명확하고 반복적인 작업을 위한 모델이다. 잘 모르겠으면 Sol로 시작하라고 안내한다.

모델 성격 이럴 때 고른다
GPT-5.6 Sol 계열의 플래그십. 능력이 가장 높고 속도는 상대적으로 느리다 모호하거나 어렵거나 가치가 큰 작업, 깊은 리서치, 완성도 높은 문서
GPT-5.6 Terra 능력과 비용의 균형. 실무형 올라운더 Sol만큼의 깊이가 필요하지 않은 일상 업무. 이전에 GPT-5.5로 하던 작업
GPT-5.6 Luna 계열에서 가장 빠르고 비용이 낮다 결과 형태가 이미 정해진 대량 작업. 추출, 분류, 변환, 정형 요약

세 모델 모두 ChatGPT 데스크톱 앱과 ChatGPT 웹에서 쓸 수 있다. Codex 클라우드에서는 현재 Sol만 쓰이며, 2026년 7월 27~31일 주차부터 대상 고객(eligible customers)에 한해 Sol이 Codex 클라우드의 코드 리뷰와 품질 검증을 담당한다. 현재 클라우드 대화의 기본 모델은 사용자가 바꿀 수 없다.

비개발 업무에서 실제로 쓰는 판단은 대개 이렇게 갈린다. 자료를 읽고 판단해 문서를 만드는 일은 Sol이나 Terra, 정해진 형식으로 수백 건을 정리하는 일은 Luna다.

기본값 Power와 추론 강도, Max와 Ultra

섹션 제목: “기본값 Power와 추론 강도, Max와 Ultra”

기본 설정은 Power 다. 공식 문서에 따르면 Power는 gpt-5.6-sol중간(medium) 추론으로 쓴다. 여기서 더 깊게 가려면 Smarter, 더 빠르고 저렴하게 가려면 Faster 쪽으로 옮긴다. gpt-5.6-luna 를 직접 고르거나 특정 모델·추론 강도·속도를 지정하려면 Advanced 를 연다.

추론 강도는 “필요한 결과가 나오는 가장 낮은 값”을 쓰는 것이 원칙이다.

추론 강도 어디에 맞나
Light (데스크톱 앱·웹 Work·IDE 확장) 또는 Low (CLI) 빠르고 범위가 분명한 작업
Medium 계획이 조금 더 필요한 작업. 속도와 깊이의 균형
High, Extra High 단계·출처·트레이드오프가 많은 어려운 작업

여기에 두 가지 특수 설정이 더 있다.

  • Max 는 선택한 모델에게 한 작업을 두고 더 오래 생각할 시간을 준다. 속도나 사용량보다 깊이가 중요한 가장 어려운 문제에 쓴다. 선택지에 보이지 않으면 앱 설정에서 켜야 한다.
  • Ultra 는 단일 에이전트 실행을 넘어 서브에이전트(subagents)로 복잡한 작업의 서로 다른 부분을 병렬 처리한다. 작업을 의미 있는 조각으로 나눌 수 있을 때 고른다. 데스크톱 앱의 모델 슬라이더에 Ultra가 없으면 설정의 Configuration 항목에서 켠다.

공식 문서는 “대부분의 작업에는 Max나 Ultra가 필요하지 않다”고 못 박는다. GPT-5.5의 추론 강도와 GPT-5.6의 추론 강도 사이에 정확한 대응 관계는 없으므로, 익숙한 작업을 낮은 설정에서 한번 돌려 보고 결과를 보며 조정하는 편이 좋다.

명확한 목표부터 검토 가능한 결과물까지 이어지는 ChatGPT Work의 작업 흐름
AI 생성 교육용 도해. 정확한 기능 조건과 세부 절차는 이 챕터의 본문 및 공식 참고 자료를 함께 확인한다

2026년 7월 말의 변화: 가격 인하와 GPT-5.4 은퇴

섹션 제목: “2026년 7월 말의 변화: 가격 인하와 GPT-5.4 은퇴”

이 사이트의 기준 시점(2026년 8월 초) 바로 앞 주차에 두 가지 변화가 있었다.

첫째, Terra와 Luna의 요율이 내려갔다. 2026년 7월 27~31일 주차 기준으로 GPT-5.6 Terra는 20%, GPT-5.6 Luna는 80% 낮아졌다. 입력, 캐시된 입력, 출력 요율이 모두 같은 비율로 내려갔다. 공식 문서는 이 변화로 Terra가 일상 업무에, Luna가 집중적인 코딩과 대량 작업에 더 적합해졌다고 설명한다. 실무적으로는 반복 작업을 Luna로 옮길 이유가 커졌다는 뜻이다.

둘째, GPT-5.4와 GPT-5.4 mini가 은퇴한다. ChatGPT 계정으로 로그인해 쓰는 경우 8월 31일에 두 모델이 Codex에서 은퇴한다. 대체 매핑은 다음과 같다.

기존 모델 대체 모델
gpt-5.4 gpt-5.6-terra
gpt-5.4-mini gpt-5.6-luna

바꿔야 할 곳은 워크스페이스 기본값, 저장된 모델 설정, 관리형 구성, 커스텀 에이전트, 그리고 예약 작업(scheduled tasks) 이다. 예약 작업을 잊기 쉬운데, 오래된 모델을 지정해 둔 예약 작업은 8월 31일 이후 의도대로 돌지 않을 수 있다. OpenAI API와 자체 API 키로 인증한 Codex 세션은 이 은퇴의 영향을 받지 않는다.

이미 사용 중단된 모델도 있다

gpt-5.2gpt-5.3-codex 는 ChatGPT 로그인 방식의 Codex에서 이미 사용 중단됐다. 저장된 설정이나 스크립트가 이 모델들을 참조하고 있다면 함께 정리한다.

토큰(tokens)은 ChatGPT가 읽고 쓰는 정보의 작은 단위다. 내 프롬프트, 파일, 대화 기록, 도구 실행 결과, ChatGPT의 응답 모두 토큰을 쓴다. 크레딧(credits)은 이 토큰 사용량을 추적하고 관리하기 쉬운 단위로 환산한 값이다. 크레딧 비용은 모델, 컨텍스트, 추론 강도, 사용한 도구에 따라 달라진다.

공식 요율표에서 GPT-5.6 계열 세 모델만 옮기면 다음과 같다. 단위는 100만 토큰당 크레딧이다.

모델 입력 캐시된 입력 출력
GPT-5.6 Sol 125 크레딧 12.5 크레딧 750 크레딧
GPT-5.6 Terra 50 크레딧 5 크레딧 300 크레딧
GPT-5.6 Luna 5 크레딧 0.5 크레딧 30 크레딧

같은 문서는 GPT-5.6 사용량이 메시지당 평균 5~40 크레딧이라고 밝힌다. 표에서 바로 읽히는 사실 하나는 Sol과 Luna의 출력 요율 차이가 25배라는 점이다. 정형화된 대량 작업을 Luna로 옮기는 것이 가장 효과가 큰 조정이다.

이미지 생성은 별도로 알아 둘 만하다. 이미지 생성은 일반 사용량 한도에 함께 계산되지만, 평균적으로 이미지 생성이 없는 비슷한 턴보다 한도를 3~5배 빠르게 소모한다. 화질과 크기에 따라 달라진다.

크레딧 관점에서 가장 중요한 원칙은 공식 문서의 이 문장이다. “프롬프트 개수가 아니라 완성된 결과물의 가치에 초점을 맞추라.” 길고 복잡한 작업이 크레딧을 더 쓰는 것은 ChatGPT가 더 많은 일을 대신하기 때문이다. 대신 작업에 경계를 두어 범위가 무한정 넓어지지 않게 하라고 권한다.

공식 문서가 제시한 절약 방법 중 비개발 업무에 바로 쓸 수 있는 것은 네 가지다.

  • 프롬프트 크기를 관리한다. 지시는 정확하게, 불필요한 맥락은 덜어낸다.
  • 원본 자료를 제한한다. 관련 있는 파일만 주고, 가능하면 출처나 기간을 좁힌다.
  • 산출물을 필요에 맞춘다. 대상, 형식, 길이를 정하고 필수 작업과 선택 개선을 분리한다.
  • 일상 작업은 작은 모델로 바꾼다. Terra나 Luna로 옮기면 한도가 더 오래 간다.

개발 업무에서는 프로젝트 지침 파일의 크기를 줄이고, 쓰지 않는 MCP 서버를 꺼서 매 메시지에 실리는 컨텍스트를 줄이는 방법도 함께 안내한다.

경계를 두지 않은 요청:

우리 제품 카테고리의 시장 상황을 조사해서 정리해 주세요.

경계를 둔 요청:

[제품 카테고리]의 시장 상황을 정리해 주세요.
출처는 첨부한 리포트 2개와 [경쟁사 3곳]의 공식 홈페이지로만 제한해 주세요.
기간은 최근 12개월로 한정하고, 상위 5개 항목만 비교해 주세요.
결과는 1페이지 요약과 표 한 개로 주고, 어떤 것도 발송하지 말고 멈춰 주세요.

두 번째 요청은 출처, 기간, 항목 수, 산출물 형태, 중단 지점을 모두 지정한다. 결과 품질이 올라가는 동시에 크레딧 소모도 예측 가능해진다.

현재 한도는 사용량 대시보드에서 확인할 수 있다. 공식 문서는 1~2주에 한 번 대시보드를 보며 소모 속도와 남은 여유를 파악하라고 권한다. 예상보다 빠르면 더 작은 모델이나 더 좁은 작업 범위로도 쓸 만한 결과가 나올지 검토한다. 한도에 도달했을 때 진행 중인 턴은 공정 사용 한도 안에서 계속 진행되며, Plus와 Pro 사용자는 플랜을 올리지 않고 크레딧을 추가로 구매할 수 있다. Business·Edu·Enterprise는 유연 요금제에서 워크스페이스 크레딧을 추가한다.

모델 목록, 요율, 한도는 플랜, 플랫폼, 지역, 롤아웃, 워크스페이스 설정에 따라 다르게 보일 수 있다. 워크스페이스 관리자가 특정 모델의 사용을 제한해 둘 수도 있다.

  • GPT-5.6 계열은 Sol(판단·완성도), Terra(일상 업무), Luna(정형·대량)로 나뉜다.
  • 기본값 Power는 gpt-5.6-sol 을 중간 추론으로 쓴다. Smarter와 Faster로 조정한다.
  • 추론 강도는 필요한 결과가 나오는 가장 낮은 값을 쓰고, Max와 Ultra는 대부분 불필요하다.
  • 2026년 7월 27~31일 주차에 Terra 20%, Luna 80% 요율이 내려갔다.
  • gpt-5.4gpt-5.4-mini 는 8월 31일 은퇴하며 각각 gpt-5.6-terra, gpt-5.6-luna 로 바꾼다. 예약 작업 설정도 함께 점검한다.
  • 크레딧은 프롬프트 개수가 아니라 완성된 결과물의 가치로 판단하고, 작업에 경계를 둔다.
  • ChatGPT Work와 Codex는 사용량 한도를 공유한다.

다음 섹션에서는 이 모델들이 실제로 만들어 내는 결과물, 즉 문서·발표자료·스프레드시트를 다루는 방법으로 넘어간다.

퀴즈를 불러오는 중…