GPT-5.6 정식 출시: Sol·Terra·Luna 완벽 정리

7월 9일 GPT-5.6이 정식 출시됐어요. Sol·Terra·Luna 세 모델이 각각 뭘 잘하는지, 어떤 요금제가 뭘 받는지, ultra 모드와 벤치마크까지 쉽게 정리했습니다.

업데이트 (2026년 7월 10일): 문이 열렸어요. 7월 9일, OpenAI가 GPT-5.6 — Sol, Terra, Luna — 을 일반에 공개했습니다. ChatGPT, Codex, API 모두에서요. 2주간의 정부 검토 대기 상태가 끝난 거죠. 이 글은 이제 실제로 쓸 수 있게 된 내용에 맞춰, 어떤 요금제가 어떤 모델을 받는지까지 다시 정리했어요.

OpenAI가 새로 내놓은 GPT-5.6 모델군을 Sol, Terra, Luna라고 명명했을 때, 국내 인터넷 커뮤니티는 비슷한 반응을 보였죠. “잠깐, 테라랑 루나 아니에요? 2022년에 폭락했던 그 암호화폐 맞나요?”라는 농담이 자연스럽게 나왔습니다.

하지만 이 이름은 금융 시장과 무관합니다. 해, 지구, 달을 의미하는 거죠. OpenAI가 모델의 성능 차이를 한눈에 보여주기 위해 고안한 새로운 표기법입니다. 일단 시스템의 규칙만 알면, 그동안 우리가 익숙해져 버린 “4o, o3, 5.5” 같은 알파벳 수프(Alphabet soup)보다 훨씬 직관적입니다. 각 모델이 정확히 어떤 역할을 하는지, 어떤 요금제에 어떤 모델이 할당되는지, 그리고 새로 추가된 ‘ultra’ 모드는 언제 실제로 쓸 만한지 차근차근 정리해 드립니다.

OpenAI’s GPT-5.6 general availability announcement, dated July 9, 2026 Source: OpenAI

모델을 한눈에 이해하는 핵심 개념

GPT-5.6은 단일 모델이 아닙니다. 세 가지 모델로 구성된 패밀리입니다. 이름 자체가 “빠르고 가벼운” 수준에서 “느리지만 뛰어난” 수준까지 이어지는 사다리 역할을 하죠.

🌙 Luna
빠르고 저렴. 간단한 질문, 짧은 초안, 가벼운 수정, 대량 반복 작업.
🌍 Terra
균형 잡힌 기본값. 지금 ChatGPT만큼 좋으면서 더 저렴. 일상 업무 대부분이 여기서 해결돼요.
☀️ Sol
플래그십. 깊은 추론, 큰 코딩 작업, 리서치, 다단계 프로젝트.
빠르고 일상적 언제 고를까 어렵고 중요한

이게 바로 머릿속에 그려야 할 전체 구조입니다. Sol = 해 = 가장 밝고 강력함, Luna = 달 = 가볍고 빠름, Terra = 땅 = 튼실한 중간 지점. 숫자 ‘5.6’은 세대(generation)를, 이름이 바로 계층(tier)을 나타냅니다.

장기적으로 봤을 때 이 방식이 더 현명한 이유는, OpenAI가 각 계층을 독립적인 일정에 따라 업그레이드할 수 있기 때문입니다. 저렴한 모델이 다음 업데이트에서 성능이 좋아져도 이름은 그대로 ‘Luna’입니다. 매번 새로운 명칭을 외울 필요가 없죠. ‘좋은 / 더 나은 / 최고의’ 구조가 오래 가도록 설계된 셈입니다.

이름 읽는 법
GPT-5.6 세대
+ Sol / Terra / Luna 등급 (강함 → 가벼움)
= 어떤 모델인지, 얼마나 강한지
숫자는 세대, 이름은 성능 등급이에요.

Sol — 무거운 작업의 해결사

Sol은 난이도 높은 문제 해결을 위해 특화된 모델입니다. OpenAI가 목표로 하는 분야는 본격적인 소프트웨어 엔지니어링, 과학 연구, 사이버보안 분석, 그리고 모델이 여러 단계를 계획하며 진행해야 하는 긴 ‘에이전트(agent)’ 작업입니다. 국내 개발자라면 복잡한 백엔드 구조 리팩토링이나 다층 로그 분석을 Sol에 맡기는 식으로 활용할 수 있겠죠.

여기서 새롭게 소개되는 두 가지 ‘ effort(노력)’ 설정을 기억해 두세요.

  • “max” — Sol이 빠른 답변 대신 복잡한 문제를 깊이 있게 사고할 시간을 더 오래 가져가게 합니다. 까다로운 수리 증명이나 버그 추적, 변수가 많은 의사결정에 유용합니다.
  • “ultra” — 한 단계 더 나아갑니다. 기본적으로 네 개의 AI 에이전트를 병렬로 운영해 작업을 분담하고 결과를 합칩니다(개발자는 API를 통해 16개까지 확장 가능). 마치 Sol이 혼자서 관리하는 작은 팀에게 대형 프로젝트의 일부를 위임하는 것과 비슷합니다. OpenAI 발표 수치에 따르면, ultra 모드는 솔리드한 커맨드라인 벤치마크인 Terminal-Bench에서 Sol의 점수를 88.8%에서 91.9%로 끌어올렸습니다. 다만 사용량 크레딧을 급격히 소모합니다. 초창기 사용자 중 한 명은 ultra 모드를 단 몇 분만 써도 5시간 분량 크레딧의 대부분을 써버렸다고 보고했죠. 정말 팀이 필요할 만한 중요한 작업에만 사용하세요.

정규 채팅에서는 가장 높은 품질의 버전인 Sol Pro도 존재합니다. Pro 및 Enterprise 요금제만 이용할 수 있습니다.

리더보드를 꼼꼼히 보는 분들을 위해 OpenAI가 직접 공개한 표의 솔직한 현황을 정리해 드립니다. Sol은 에이전트형 작업과 컴퓨터 제어 분야에서 새로운 기록을 세웠지만, Anthropic의 Claude 모델은 여전히 다른 영역에서 선두를 달립니다. Claude Fable 5는 두 가지 광범위한 지수에서 Sol을 살짝 앞서고 있으며, SWE-Bench Pro 같은 소프트웨어 벤치마크에서는 Claude의 코딩 전문 모델이 확실히 앞섭니다. 어느 한쪽이 모든 것을 장악한 것은 아닙니다. 일반 사용자에게 남는 메시지는 간단합니다. 가장 무거운 작업을 맡길 때는 Sol이 정답입니다.

Terra — 실제로 가장 많이 쓰게 될 모델

Terra는 눈에 띄지 않지만 든든한 조력자입니다. OpenAI는 이를 “일상적인 업무를 위한 균형 잡힌 모델”로 설명하며, 성능은 GPT-5.5와 경쟁하지만 비용은 약 절반 수준이라고 밝혔습니다. 글쓰기, 요약, 일정 계획, 질문 답변 등 대부분의 일상적인 작업에는 Terra가 충분히 제 역할을 하며, 실제로 대부분의 사용자가 가장 많이 정착하게 될 계층입니다.

무료 사용자를 위한 열쇠이기도 합니다. Free 및 Go 요금제 사용자는 ChatGPT Work와 Codex 내에서 Terra를 이용할 수 있습니다. 완전히 새로운 최전선 세대의 모델이 출시 첫 주부터 무료 계정에 적용된 건 처음 있는 일입니다. Sol이 어려운 상황이 불릴 때 부르는 전문가라면, Terra는 매일 마주하게 되는 믿을 만한 만능 해결사입니다.

Luna — 빠르고 가벼운 선택

Luna는 속도와 처리량에 최적화되었습니다. 가장 가볍고 비용이 가장 낮은 옵션으로, 즉각적인 답변이 깊은 분석보다 선호되는 빠른 상호작용이나 대용량 일상 업무에 적합합니다. 짧은 문장 다듬기, 빠른 정보 조회, 간단한 초안 작성 — 이런 작업이 Luna의 주무대입니다. 국내 직장인이라면 출근 후 메일 초안 작성이나 간단한 리포트 문장 교정에 Luna를 지정해두면 시간과 크레딧을 아낄 수 있습니다.

출시 벤치마크 — 그리고 그 수치를 얼마나 믿어야 할까

OpenAI는 출시와 함께 전체 비교표를 공개했습니다. OpenAI가 이기지 못한 항목까지 포함해 객관성을 유지한 주요 행을 정리해 드립니다.

벤치마크 (측정 항목)SolTerraLunaGPT-5.5최고 Claude
Agents’ Last Exam (긴 전문 워크플로)52.7%50.4%50.3%46.9%45.2% (Opus 4.8)
Coding Agent Index (에이전트 코딩, 독립)8077.474.676.477.2 (Fable 5)
Terminal-Bench 2.1 (커맨드라인 작업)88.8% (ultra 91.9%)87.4%84.7%85.6%88% (Mythos 5)
OSWorld 2.0 (컴퓨터 사용)62.6%50.2%45.6%47.5%54.8% (Opus 4.8)
SWE-Bench Pro (실제 소프트웨어 수정)64.6%63.4%62.7%59.4%80.3% (Mythos 5)
GDPval-AA (전문가 평가 작업 품질)1,747.81,5931,591.81,493.71,759.6 (Fable 5)
Artificial Analysis Intelligence Index58.95551.254.859.9 (Fable 5)

표를 한눈에 읽어보면 이렇습니다. Sol은 에이전트형 작업과 컴퓨터 사용 분야에서 앞섰고, Claude는 여전히 심층 소프트웨어 엔지니어링에서 선두이며 두 가지 광범위한 품질 측정 지표에서도 약간 앞서 있습니다. Luna가 이전 세대의 플래그십 모델을 여러 항목에서 앞선 점은 조용하지만 중요한 소식입니다. 그리고 그게 바로 무료 계층 모델인 셈이죠.

여기서 꼭 짚고 넘어가야 할 주의사항이 있습니다. 표보다 이 부분이 더 중요하거든요. 이 수치들은 모두 OpenAI가 직접 발행한 출시 글에서 가져온 것입니다. 벤더는 어떤 벤치마크를 공개할지, 어떤 경쟁사를 포함할지, 어떤 설정으로 실행할지 선택합니다. 위에서 언급한 91.9%는 ultra 모드에서의 Sol 수치로, 한 번에 네 개의 에이전트를 돌리는 설정입니다. 평범한 화요일에 당신이 일상적으로 쓸 Sol과는 다릅니다. 또한 벤치마크는 ‘시험장 조건’입니다. 입력이 깨끗하고 목표가 명확하며, 조직 내 정치적 맥락이나 모호함이 없습니다. 반면 실제 업무는 반쯤 문서화되어 있고 맥락이 복잡하며, 리더보드가 측정하지 못하는 변수로 가득 차 있습니다. 차트상에서 3점 더 높은 모델이 당신에게 더 나쁠 수 있습니다. 속도가 느리거나, 톤이 맞지 않거나, 파일을 다루는 방식이 마음에 들지 않거나, 특정 분야에서 허위 정보를 자주 내뱉을 수 있으니까요.

양날의 검이 될 수 있지만, 한 가지 독립적인 참고 자료는 추가해 둘 만합니다. AI 코드 에디터인 Cursor는 이 싸움과 무관한 제3자입니다. Cursor는 자체 벤치마크인 CursorBench를 운영하며, 이는 실제 사용자 세션을 기반으로 합니다. 모호하고 다중 파일이 포함된 업무로, 시험장 조건의 정반대죠. 현재 버전 기준으로 Claude Fable 5 Max가 70.5%로 가장 높고, GPT-5.6 Sol Max가 67.2%로 그 뒤를 바짝 쫓습니다. 하지만 Sol은 모델 비용 $5.22로 이를 달성한 반면, Fable은 $17.32가 들었습니다. 따라서 현실 감각이 담긴 평가 중 하나에서는 Claude가 미세한 품질 차이를 유지하는 반면, Sol은 가격에서 압도적으로 승리합니다.

결론을 내릴 수 있는 유일한 벤치마크는 바로 ‘당신의 실제 업무 1주일’입니다. Sol과 현재 사용 중인 모델에 똑같은 실제 작업 3가지를 맡겨보고, 덜 일일이 챙겨줘도 잘 해내는 쪽을 최종적으로 선택하세요.

누가 어떤 모델을 쓰나 — 7월 9일 이후 적용 현황

계층 분류는 이제 이론이 아닙니다. OpenAI의 제공 안내문에 직접 명시된 실제 적용 현황을 정리해 드립니다.

위치Free / GoPlusPro / Enterprise
일반 챗GPT-5.5 Instant (5.6 없음)Sol (medium 이상 노력)Sol + Sol Pro
ChatGPT Work & CodexTerraSol·Terra·Luna + 노력 조절Sol·Terra·Luna + 노력 조절
max 설정
ultra 설정Codex만Work·Codex 모두

두 가지 포인트를 주목해 주세요. 무료 사용자의 GPT-5.6 접근 경로는 에이전트 기반 기능인 ChatGPT Work과 Codex뿐이며, 일반 채팅은 당분간 GPT-5.5 Instant를 유지합니다. Plus 요금제는 Pro 요금제보다 한 단계 낮은 위치에 두 번 해당됩니다. 일반 채팅에는 Sol Pro가 없으며, ChatGPT Work 내에서도 ultra 모드를 쓸 수 없습니다(Plus는 Codex에서만 ultra 이용 가능). 출시 주간에는 staged(단계별) 24시간 롤아웃이 완료되는 동안 Plus 사용자 중 일부가 Terra와 Luna만 보이는 현상을 보고하기도 했는데, 해당 현상을 겪고 계시다면 무언가 결론 내리기 전에 하루 정도 기다려 보세요.

API를 활용해 서비스를 구축하신다면, 세 계층은 가격과 품질을 조절하는 다이얼과 같습니다. Sol은 $5 in / $30 out, Terra $2.50 / $15, Luna $1 / $6 per million tokens — 그리고 Sol은 GPT-5.5와 동일한 가격으로 책정됩니다. 플래그십 대비 절반 가격인 Terra가 핵심 화제입니다. Luna는 저렴하게 대용량 호출이 필요할 때 적합하죠.

정부 검토 과정, 간략히

7월 9일 이전의 2주간 대기 기간은 2026년 6월 발표된 행정명령의 첫 실전 테스트였습니다. 이 명령은 AI 기업에 강력한 모델을 공개 30일 전까지 연방 정부에 제출하도록 요청합니다. 상무부는 추가 테스트를 진행했고, OpenAI는 워싱턴 DC에 직원을 파견했으며, 이후 공개가 이루어졌습니다. 보도 과정에서 조금 혼란스러운 점이 있었으니, 일부 매체가 OpenAI가 정부의 “승인”을 받았다고 보도한 것이죠. 하지만 백악관은 이 단어를 공식적으로 거부하며 승인 절차가 필요 없으며, 공개 여부는 전적으로 기업 자체 판단에 달려 있다고 명시했습니다. 제도상으로는 자발적 프레임워크이지만, 실질적인 결과는 변함없습니다. 검토가 진행되었고 모델은 출시되었으며, 다음 최전선 모델도 마찬가지로 30일간의 경로를 밟을 가능성이 큽니다.

이 변화가 나에게 주는 의미

  • 일상적으로 가볍게 사용하는 분: 대부분 이 내용을 직접 고려할 일은 없습니다. 시스템이 알아서 적절한 계층을 선택해 줍니다. 다만 ‘Sol’이 성능이 가장 뛰어난 모델이라는 점만 기억해 두세요. 그리고 무료 계정에서는 GPT-5.6이 일반 채팅이 아닌 ChatGPT Work에 배치됩니다.
  • ChatGPT에서 본격적인 업무(코딩, 분석, 연구 등)를 하는 분: ‘max’ 설정의 Sol이 이제 모든 유료 요금제에서 사용 가능합니다. 어려운 작업의 기본값으로 설정하세요. ‘ultra’는 네 개의 에이전트와 그에 따른 크레딧 소모 가치가 분명히 있는 드문 작업에만 남겨두세요.
  • 앱을 개발하거나 비용을 꼼꼼히 따지는 분: 세 계층은 가격과 품질을 조절하는 다이얼입니다. 플래그십 대비 절반 가격인 Terra가 가장 합리적인 지점(sweet spot)이고, Luna는 저렴하게 대용량 호출이 필요할 때 적합합니다.
  • “어떤 모델을 써야 할지” 여전히 헷갈리는 분: 해, 땅, 달 — 가장 밝은 것부터 가장 가벼운 것까지. 그게 전부입니다. 어떤 ChatGPT 모델을 사용해야 할까 가이드에서 선택기를 완전히 다루고 있으며, 출시 시기가 궁금했던 분도 이제 답을 얻으셨습니다.

계층 분류가 해결해 주지 못하는 것들

  • 약한 프롬프트를 똑똑하게 만들어 주지 않습니다. Sol에게 모호한 질문을 던지면, 여전히 모호하지만 유창한 답변이 돌아옵니다. 모델 계층 선택보다 명확한 지시가 훨씬 중요합니다.
  • 일상적인 채팅에서는 다 다르게 느껴지지 않습니다. 일상적인 질문에는 Terra와 Sol의 차이를 구분하기 어렵습니다. 그 격차는 복잡하고 다단계인 작업에서 비로소 드러납니다.
  • 모두가 무료가 아닙니다. 무료 계정은 ChatGPT Work와 Codex에서만 Terra를 쓸 수 있습니다. Sol은 유료 요금이 필요하며, Sol Pro와 Work 내 ultra 모드는 Pro 또는 Enterprise 요금제에서만 이용 가능합니다.
  • 책상 위의 실제 업무에서 출시 차트만큼의 성능을 내주지 않습니다. 벤치마크 점수는 특정 설정의 시험장 조건입니다. 리더보드가 아닌 당신의 실제 업무로 계층을 평가하세요.
  • 당신의 전문성을 대체하지 않습니다. 성능이 뛰어난 모델이라도 당신의 직업을 모르죠. 모델은 초안을 쓰고, 최종 판단은 당신이 내립니다.

한 줄 요약

솔, 테라, 루나는 암호화폐도, 과장된 마케팅도 아닙니다. 순수한 “좋은 / 더 나은 / 최고의” 사다리이며, 세대 번호(5.6)는 계층 이름과 독립적으로 작동합니다. 무거운 작업에는 Sol, 일상 업무에는 Terra, 빠르고 가벼운 작업에는 Luna를 쓰세요. 7월 9일부로 모두 사용 가능해졌습니다. 위에 정리된 요금제 표에서 내 계정에서 각 모델이 어디에 배치됐는지 확인하고, 출시 벤치마크를 최종 판결이 아닌 메뉴판처럼 대하세요. 그리고 우승자는 당신의 실제 업무가 결정해 줄 것입니다.

이번 출시의 더 큰 이야기는 해당 모델들이 안착한 ‘새로운 에이전트 워크스페이스’입니다. 그 부분에 관심이 있으시다면, 한국어로 직관적으로 정리한 ChatGPT Work 사용 가이드부터 시작해 보세요. 반면 Anthropic의 도구와 비교 중이시라면 ChatGPT Work vs Claude Cowork 비교에서 실제 장단점을 확인하실 수 있습니다. 모델 선택과 프롬프트 작성 실력, 즉 모든 명명법 변경보다 오래가는 핵심 스킬을 기르고 싶다면 AI Fundamentals, ChatGPT for Work, Prompt Engineering 과정이 GPT-5.6에 바로 적용됩니다.

참고 자료

Build Real AI Skills

Step-by-step courses with quizzes and certificates for your resume