GPT-5.6 정부 안전성 게이트와 Luna·Terra·Sol 운영 전략
GPT-5.6의 정부 안전성 게이트, Luna·Terra·Sol 라우팅, 추론 예산과 멀티벤더 운영 전략을 정리한다.
2026-08-14 · 최초 발행 2026-08-02
성능표보다 먼저 봐야 할 배포 게이트
OpenAI는 2026년 7월 9일 GPT-5.6 Luna·Terra·Sol을 ChatGPT·Codex·API에 정식 공개했다. 2026년 6월 26일 미국 정부 요청으로 시작된 제한적 안전성 프리뷰가 12~13일 만에 끝나면서 전면 배포로 전환됐다.
프리뷰는 미 상무부 산하 CAISI(Center for AI Standards and Innovation)의 요청에 따라 약 20개 정부 승인 파트너에게 먼저 열렸다. Preparedness Framework 평가에서 Luna·Terra·Sol 모두 생물·화학과 사이버보안 영역의 High capability 등급을 받은 것이 게이팅 배경이었다. CAISI의 레드팀과 안전 우회 테스트를 마친 뒤 소비자용 ChatGPT, 코딩용 Codex, 빌더용 API가 동시에 개방됐으며 가격은 프리뷰 시점과 같았다.
입력과 출력 1M 토큰당 가격은 Sol $5/$30, Terra $2.50/$15, Luna $1/$6이다. 세 모델은 API 셀프서브로 즉시 이용할 수 있다. Programmatic Tool Calling, 서브에이전트를 생성하는 Ultra 멀티에이전트 모드, 명시적 캐시 브레이크포인트 기반 프롬프트 캐싱도 함께 제공됐다.
이번 공개에서 눈여겨볼 부분은 모델 성능만이 아니다. 외부 정부 기관의 검토가 배포 파이프라인의 필수 게이트로 편입된 최초 사례에 가깝다는 점이다. 내부 레드팀 이후 벤더가 공개 시점을 결정하던 방식에 CAISI라는 제도적 병목이 추가됐다.
이 게이트는 자발적(voluntary) AI 프레임워크의 시범 적용 성격이 강해 법적 강제력은 제한적이다. 다만 사실상 표준 관행으로 자리 잡는 중이며, 다음 세대인 GPT-6 계열도 같은 절차를 거칠 가능성이 높다. 모델 도입 계획에는 프리뷰부터 GA까지 걸린 12~13일을 구조적인 일정 버퍼로 반영할 필요가 있다. 해당 기간에는 승인된 소수 파트너만 접근할 수 있어 벤치마크와 PoC 착수 시점도 늦어진다.
Luna·Terra·Sol을 경로와 예산으로 나누기
각 티어는 단순한 성능 서열보다 워크로드의 진입 경로로 보는 편이 운영에 적합하다. Sol은 복잡한 에이전트, 과학 추론, 보안 특화 작업과 같은 최고 난도 요청을 맡는다. Terra는 GPT-5.5급 성능을 절반 비용으로 제공하는 프로덕션 표준 티어다. Luna는 분류, 라우팅, 대량 처리처럼 처리량과 단가가 우선인 작업에 맞는다.
별도의 추론 노력 단계는 none·low·medium·high·xhigh·max로 구성된다. 티어를 요청의 경로(route), 추론 노력과 멀티에이전트 실행을 예산(budget)으로 분리하면 거버넌스 기준도 선명해진다. 어떤 모델을 통과시킬지와 한 요청에 어느 정도의 계산을 허용할지를 따로 관리할 수 있기 때문이다.
Responses API에서는 model 파라미터만 바꿔 각 티어를 호출할 수 있어 기존 통합 코드의 변경 범위를 줄일 수 있다. Programmatic Tool Calling은 모델이 루프·조건·집계가 포함된 도구 호출을 코드로 구성하고, 이를 네트워크가 차단된 V8 샌드박스에서 실행한다.
캐싱 비용도 라우팅 정책에 포함해야 한다. 캐시 쓰기는 미캐싱 단가의 1.25배이고, 캐시 읽기에는 90% 할인이 유지된다.
워크로드를 어느 티어에 보낼 것인가
오류 비용이 큰 자율 에이전트, 보안 특화 분석, 복잡한 리팩터링은 Sol에 배치한다. 일반적인 RAG와 문서 생성 등 대다수 프로덕션 트래픽은 Terra가 기준점이다. 의도 분류, 프리필터링, 고volume 배치처럼 지연과 단가가 우선인 작업은 Luna에서 처리한다.
| 구분 | 권장 티어 | 추론 노력 | 관측 지표 |
|---|---|---|---|
| 자율 에이전트·보안 분석 | Sol | high~max | 태스크당 비용, 실패율 |
| 프로덕션 API 표준 | Terra | medium | 응답 지연, 품질 점수 |
| 대량 분류·라우팅 | Luna | none~low | 처리량, 캐시 적중률 |
| 프리필터·1차 스크리닝 | Luna | none | 오탐율, 승격 비율 |
운영 정책에는 비용 임계치를 넘었을 때 Sol에서 Terra로 자동 다운시프트하는 규칙을 미리 문서화한다. 반대 방향의 승격도 필요하다. Luna가 먼저 요청을 처리하고 난도가 높은 요청만 Sol로 넘기는 캐스케이딩을 적용하면 플래그십 모델이 필요한 구간에만 비용을 집중할 수 있다.
모든 요청을 플래그십 하나로 처리하는 구조에서는 저난도 작업에도 최고 단가가 적용된다. 티어드 구조는 Luna가 저난도 요청을 흡수하고 Sol을 고난도 요청에 한정해 평균 단가와 총소유비용(TCO)을 낮춘다.
정부 검토가 도입 일정에 남기는 변수
신규 모델이 승인 파트너에게 먼저 공개되는 구조에서는 자사가 해당 파트너가 아닐 경우 GA까지 최소 2주 이상 도입이 지연될 수 있다. 이 시간을 단순한 출시 지연이 아니라 사업 연속성 계획(BCP)의 변수로 다뤄야 한다.
프롬프트와 평가셋은 특정 벤더 API에 직접 묶지 않고 별도 추상화 계층에 둔다. 그래야 Anthropic이나 Google 모델로 전환할 때 변경 비용을 줄일 수 있다. GPT-5.5에서 GPT-5.6으로 옮길 때도 골든셋 기반 회귀 테스트로 품질 저하 여부를 확인한 뒤 트래픽을 단계적으로 이관하는 편이 안전하다.
CAISI 검토 통과 이력과 Preparedness Framework 등급은 내부 AI 거버넌스 문서의 보안 통제 근거로 활용할 수 있다. 정부 게이트 때문에 새 모델의 공개가 늦어질 가능성까지 고려하면, 검증된 이전 세대를 병행하는 하이브리드 TCO 전략도 선택지에 들어간다.
경쟁 모델과 가격·성능을 함께 읽기
| 항목 | GPT-5.6 Sol | Claude Sonnet 5 | Gemini 3.5 Pro(3.1 Pro 기준 참고치) |
|---|---|---|---|
| 입력/출력 단가(per 1M) | $5 / $30 | $2 / $10(도입가) | 약 $2 / $12 |
| SWE-bench Pro | 64.6% | 63.2% | 중위권 |
| Terminal-Bench 2.1 | 88.8%(Ultra 91.9%) | 경쟁적 | 공개 데이터 제한적 |
| ARC-AGI-2 | 92.5% | 강세 | 약 77% 수준 |
| 장문맥·멀티모달 | 표준 | 표준 | 최대 1M 토큰, GPQA 최상위권 |
| 릴리스 일자 | 2026-07-09 | 2026-06-30 | 2026 내 후속 공개 예정 |
Claude Sonnet 5는 도입가 기준으로 Terra보다 낮은 단가를 제시하며, Sol과의 코딩 벤치마크 격차도 근소하다. GPT-5.6 Sol은 ARC-AGI-2와 Terminal-Bench에서 우위를 보이므로 자율 에이전트와 고난도 추론 워크로드에 강점이 있다.
장문맥과 멀티모달 영역에서는 Gemini 계열이 최대 컨텍스트와 관련 벤치마크에서 앞선다. 다만 Gemini 3.5 Pro는 이 글 작성 시점에 정식 공개 전이거나 초기 롤아웃 단계다. 표의 수치는 3.1 Pro 실측치를 참고선으로 제시한 것이다.
모델 선택 기준은 벤치마크 한 줄로 끝나지 않는다. 워크로드 난도 분포를 실측해 티어 조합을 최적화하고, 정부 게이트 같은 제도적 병목을 BCP에 반영해야 한다. Preparedness Framework 등급과 샌드박스 격리 구조는 보안 통제 근거로 남길 수 있어야 한다.
2026년 프론티어 모델 경쟁의 축은 순수 성능에서 티어 아키텍처, 정부 게이트 대응력, 운영 거버넌스로 이동하고 있다. Luna·Terra·Sol의 가격 차이보다 중요한 것은 요청을 어느 경로로 보내고, 얼마나 많은 추론 예산을 허용하며, 다음 배포 게이트가 지연될 때 어떤 벤더로 연속성을 확보할지다.
Sources
- https://openai.com/index/gpt-5-6/
- https://openai.com/index/previewing-gpt-5-6-sol/
- https://www.techtimes.com/articles/319979/20260709/gpt-56-goes-public-after-12-day-white-house-gate-tests-voluntary-ai-framework.htm
- https://imisofts.com/blog/gpt-5-6-public-launch-sol-terra-luna-news-july-9-2026/
- https://venturebeat.com/technology/openai-unveils-gpt-5-6-sol-terra-and-luna-models-but-only-accessible-to-limited-preview-partners-for-now-per-us-gov
- https://www.nextgov.com/artificial-intelligence/2026/07/openais-advanced-gpt-56-models-be-available-public/414651/
- https://www.edenai.co/post/claude-sonnet-5-vs-gpt-5-6-sol-vs-gemini-3-1-benchmarks-pricing-which-to-use
- https://www.datacamp.com/blog/claude-sonnet-5-vs-gpt-5-6
- https://pricepertoken.com/pricing-page/model/google-gemini-3.1-pro-preview