Velokey
분석 및 리뷰

GPT-5.6 Sol vs Terra vs Luna: 어떤 티어를 써야 할까 (2026)

GPT-5.6은 Sol, Terra, Luna 세 가지 티어로 출시됩니다. 가격, 벤치마크, 사용 사례를 비교하고 API 워크로드에 맞는 티어를 고르는 방법을 정리합니다.

GPT-5.6 Sol vs Terra vs Luna: 어떤 티어를 써야 할까 (2026)

TL;DR

  • GPT-5.6은 2026년 7월 9일 세 가지 티어로 정식 출시: Sol(플래그십), Terra(균형형 기본), Luna(가장 저렴하고 빠름)
  • 1M 토큰 기준: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 — 최상단과 최하단 사이 5배 차이
  • 벤치마크 격차는 가격 격차보다 훨씬 작음: Terra는 대부분의 테스트에서 Sol 대비 약 2점 이내, 비용은 절반이므로 대부분의 작업에는 Terra가 기본
  • 가장 어려운 에이전틱·장기 작업에만 Sol을 쓰고, 고볼륨 단문맥 작업에는 Luna를 사용 — 단 장문맥은 제외(회상 성능이 급락)

OpenAI는 GPT-5.6을 하나만 내놓지 않았습니다. Sol, Terra, Luna 세 가지를 내놓았고, 가격 차이는 최상단과 최하단이 5배에 이릅니다. API를 호출하는 누구나 마주치는 당연한 질문: 정말 플래그십이 필요한가, 아니면 저가 티어로도 충분한가? 솔직한 답은 벤치마크 격차가 가격 격차보다 훨씬 좁아서, 대부분의 워크로드는 Sol을 기본값으로 둘 필요가 없다는 것입니다. 아래는 티어별 가격 대비 성능 분석과, 저가 티어가 실제로 무너지는 한 가지 지점입니다.

GPT-5.6 Sol vs Terra vs Luna comparison
GPT-5.6의 세 티어: Sol, Terra, Luna의 가격·성능 비교

GPT-5.6 Sol, Terra, Luna란?

GPT-5.6 Sol, Terra, Luna는 같은 모델 패밀리의 세 티어로, 2026년 7월 9일 함께 출시되었으며 성능과 비용을 맞바꿉니다. Sol은 플래그십, Terra는 일상용 균형 티어, Luna는 비용·속도 챔피언입니다.

같은 세대를 공유합니다 — Programmatic Tool Calling(모델이 네트워크 접근 없는 격리된 V8 샌드박스에서 실행되는 JavaScript를 작성)과 새로운 예측 가능한 프롬프트 캐싱이 세 티어 모두에 적용됩니다. 티어마다 달라지는 것은 원시 성능, 지연 시간, 가격입니다. 세 티어 모두 OpenAI API, ChatGPT, Codex, GitHub Copilot에서 지금 사용할 수 있습니다.

GPT-5.6 티어 한눈에 보기:

TierAPI model IDPrice /1M (in/out)Best for
Solgpt-5.6-sol$5 / $30가장 어려운 에이전틱 + 장기 작업
Terragpt-5.6-terra$2.50 / $15대부분의 프로덕션 작업 기본값
Lunagpt-5.6-luna$1 / $6고볼륨, 지연 민감, 단문맥

*출처: OpenAI GPT-5.6 런치, 2026년 7월 9일. gpt-5.6은 플래그십을 가리키는 별칭입니다.*

OpenAI가 내세우는 프레이밍 — "ambition에 맞춰 스케일되는 intelligence" — 의 실질적 의미는 이렇습니다. 작업의 기준을 통과하는 가장 작은 티어를 고르고, 필요할 때만 더 비싼 티어로 올리라는 것입니다.

GPT-5.6 각 티어 비용은 얼마인가?

1M 토큰 기준 Sol은 입력 $5 / 출력 $30, Terra는 $2.50 / $15, Luna는 $1 / $6입니다. 티어마다 정확히 2배씩 내려가고, Sol과 Luna 사이 전체 스프레드는 5배입니다.

토큰 가격은 실제 워크로드에 대입하기 전까지는 추상적입니다. 월 입력 10M, 출력 2M 토큰을 처리하는 중간 규모 프로덕션 앱을 예로 들면:

월 10M-in / 2M-out 워크로드 비용:

TierInput costOutput costMonthly total
Sol$50$60$110
Terra$25$30$55
Luna$10$12$22

*공개 토큰 단가 기준 예시 계산. 입력 대비 출력 비율에 따라 합계는 달라집니다.*

GPT-5.6 Sol vs Terra vs Luna pricing
세 GPT-5.6 티어의 1M 토큰당 가격과 샘플 월 청구액

같은 작업인데 청구액은 5배 차이. 그 격차 때문에 어떤 티어로 라우팅하느냐가 중요하고, 모든 호출을 Sol로 기본 설정하는 것이 이 패밀리에서 팀이 과지출하는 가장 흔한 방식입니다.

GPT-5.6 Sol, Terra, Luna 벤치마크 비교는?

대부분의 벤치마크에서 세 티어는 가격이 시사하는 것보다 훨씬 가깝게 뭉칩니다 — Terra는 보통 Sol 대비 약 2점 이내, Luna는 그보다 조금 더 떨어집니다. 예외는 장문맥 회상으로, Luna는 여기서 급락합니다.

패밀리 전체에 걸쳐 공개된 수치입니다:

GPT-5.6 벤치마크 비교:

BenchmarkSolTerraLuna
Terminal-Bench 2.188.8%87.4%84.7%
Agents' Last Exam53.650.450.3
Coding Agent Index (Artificial Analysis)8077.474.6
MRCR long-context recall91.5%89.6%41.3%

*출처: 공개 GPT-5.6 벤치마크 표, 2026 (Vellum, OpenAI). Sol은 BrowseComp에서 92.2%도 기록. Sol Ultra는 Terminal-Bench 2.1에서 91.9%.*

두 가지가 눈에 띕니다. 첫째, 코딩·에이전틱 작업에서 티어 간 차이는 작습니다 — Luna는 Sol 품질의 약 85%를 5분의 1 가격에 유지하므로, 고볼륨 작업에 매우 좋은 트레이드오프입니다. 둘째, MRCR 장문맥 회상이 저가 티어가 무너지는 지점입니다. Luna는 41.3%로 떨어지지만 Sol과 Terra는 90% 근처에 머뭅니다. 긴 문서나 큰 컨텍스트를 넣는 워크로드라면 가격과 무관하게 Luna는 후보에서 제외됩니다.

GPT-5.6 티어는 언제 각각 써야 하나?

기본은 Terra, 가장 어려운 에이전틱 작업에만 Sol로 올리고, 고볼륨 단문맥 작업은 Luna로 내립니다. 티어를 위상으로 고르지 말고, 작업이 실제로 요구하는 것으로 고르세요.

  • Terra — 기본값. 대부분의 벤치마크에서 Sol과 동등하거나 약 2점 이내이며 가격은 절반입니다. 대부분의 프로덕션 앱, 채팅, 코딩 지원, 일반 에이전트 단계에는 Terra가 올바른 출발점입니다. 특정 작업에서 Terra가 부족하다는 것이 증명될 때만 다른 티어로 이동하세요.
  • Sol — 어려운 케이스. 장기 다단계 워크플로, 복잡한 터미널 작업, 사이버보안 리서치, computer use, 최대 reasoning 또는 ultra 모드가 필요한 모든 것. Sol은 프론티어 기능을 완전히 지원하는 유일한 티어이며 모든 벤치마크를 선도합니다 — 다만 모든 곳에 돌릴 만큼 격차가 크지는 않습니다.
  • Luna — 깊이보다 볼륨. 쿼리당 비용이 추론의 마지막 몇 점보다 중요한 고처리량·지연 민감 파이프라인: 분류, 태깅, 라우팅, 짧은 요약, 대량 생성. 장문맥 작업과는 거리를 두세요.

대부분의 팀이 결국 안착하는 실무 패턴은 "하나를 고른다"가 아닙니다. 라우팅입니다. 대부분의 호출은 Luna 또는 Terra, Sol은 정말로 필요한 단계에만 예약. 여기서 혼합 티어 구성이 비용을 회수합니다.

API에서 GPT-5.6 티어를 어떻게 전환하나?

티어 전환은 모델 ID — gpt-5.6-sol, gpt-5.6-terra, 또는 gpt-5.6-luna — 를 바꾸는 것으로 끝납니다. 요청의 나머지는 동일합니다. 티어가 하나의 인터페이스를 공유하므로, 작업별 라우팅은 필드 하나 변경입니다.

from openai import OpenAI

client = OpenAI(api_key="sk-...")  # use an environment variable, never hardcode

def answer(prompt, hard=False, bulk=False):
    # route by task: cheap by default, escalate only when needed
    model = "gpt-5.6-sol" if hard else "gpt-5.6-luna" if bulk else "gpt-5.6-terra"
    return client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
    )

직접 연동의 함정은 이 라우팅이 코드 안에 살고, 한 프로바이더의 티어에 묶인다는 점입니다. 나중에 일부 트래픽을 더 저렴한 비-OpenAI 모델로 보내거나, 티어가 rate-limit에 걸릴 때 폴백하려면 다시 짜야 합니다. Velokey 같은 통합 게이트웨이는 Sol, Terra, Luna 및 다른 벤더 모델을 하나의 OpenAI 호환 엔드포인트 뒤에 두어, 티어 라우팅과 교차 모델 폴백을 재작성이 아닌 설정으로 만듭니다 — 비용을 통제하려고 워크로드를 티어에 나누는 이유 자체가 바로 이것입니다.

런치 맥락과 GPT-5.6이 여기까지 온 경로는 GPT-5.6 릴리스 커버리지를, 다른 프론티어 모델과의 비교는 GLM-5.2 vs GPT-5.5 vs Claude Opus 4.8 분석Claude API 가격 가이드가 다음 읽기로 유용합니다.

Frequently Asked Questions

기본적으로 어떤 GPT-5.6 티어를 써야 하나?

Terra입니다. 대부분의 벤치마크에서 Sol 대비 약 2점 이내 성능에 가격은 절반($2.50/$15 per 1M tokens vs $5/$30)입니다. 프로덕션 워크로드는 Terra로 시작하고, 장기 에이전트, 복잡한 터미널 작업, max-reasoning 모드처럼 더 필요하다는 것이 측정될 때만 Sol로 올리세요.

Sol, Terra, Luna 가격 차이는?

1M 토큰 기준: Sol은 입력 $5 / 출력 $30, Terra는 $2.50 / $15, Luna는 $1 / $6입니다. 티어마다 2배씩 내려가고 Sol에서 Luna까지 5배 스프레드입니다. 월 10M-in/2M-out 워크로드에서는 대략 $110(Sol) 대 $22(Luna)입니다.

GPT-5.6 Luna는 프로덕션에 충분한가?

고볼륨·단문맥 작업이라면 예 — Luna는 Sol 품질의 약 85%를 5분의 1 가격에 유지합니다. 다만 장문맥 회상은 41.3%로 떨어지므로(Sol·Terra는 약 90%), 긴 문서나 큰 컨텍스트 프롬프트에는 Luna를 피하세요. 분류, 태깅, 라우팅, 대량 생성에 쓰세요.

GPT-5.6 API 모델 ID는?

gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna입니다. 단독 gpt-5.6 별칭은 플래그십(Sol)을 가리킵니다. 세 티어가 같은 API 인터페이스를 공유하므로 티어 전환은 요청의 필드 하나 변경입니다.

Sol이 Luna보다 5배 비쌀 가치가 있는 때는?

작업이 정말로 프론티어 추론을 필요로 할 때: 장기 다단계 에이전트, 복잡한 터미널 작업, 사이버보안 리서치, computer use, 또는 Luna의 회상이 실패하는 장문맥 작업. 일상 채팅, 코딩 도움, 일반 에이전트 단계에서는 Terra나 Luna 대비 벤치마크 이득이 Sol 비용을 정당화하는 경우가 드뭅니다.

한 애플리케이션에서 GPT-5.6 티어를 섞을 수 있나?

예, 그리고 비용 효율적인 구성 대부분이 그렇게 합니다. 대부분의 호출은 Luna 또는 Terra로 보내고 Sol은 가장 어려운 단계에 예약하세요. 티어가 하나의 인터페이스를 공유하므로 요청마다 모델을 선택할 수 있습니다. 통합 게이트웨이를 쓰면 이 라우팅(및 다른 모델로의 폴백)이 코드 변경이 아닌 설정 변경이 됩니다.


한 프로바이더를 하드코딩하지 않고 GPT-5.6 티어를 라우팅하고 싶다면? Velokey API 키를 받으세요. Sol, Terra, Luna — 그리고 다른 벤더 모델까지 — 하나의 OpenAI 호환 엔드포인트로 호출하고, 요청별 모델 선택과 자동 폴백을 이용하세요.


*최종 업데이트: 2026년 7월 10일. 가격 및 벤치마크 수치는 OpenAI의 GPT-5.6 런치와 작성 시점의 공개 평가 표를 기준으로 합니다. 수치는 OpenAI가 정하며 변경될 수 있으므로, 프로덕션 예산을 확정하기 전에 최신 요금과 벤치마크를 확인하세요.*