Claude Sonnet 5의 1M 컨텍스트와 에이전트 운영 전환

Claude Sonnet 5의 네이티브 1M 컨텍스트, 가격 전환, Claude Code 기본 모델 변경에 따른 에이전트 운영 전략을 정리한다.

2026-08-14 · 최초 발행 2026-08-02

Anthropic은 2026년 6월 30일 Claude Sonnet 5를 공개했다. Sonnet 티어에 Opus급 에이전트 코딩 성능과 네이티브 100만 토큰 컨텍스트 윈도를 함께 넣었고, Free·Pro 플랜의 기본 모델도 즉시 교체했다. Claude Code와 엔터프라이즈 워크플로에서 이 변화는 단순한 모델 업데이트보다 비용, 컨텍스트, 전환 통제를 다시 정리해야 하는 운영 이슈에 가깝다.

기본값이 된 Sonnet 5의 범위

Sonnet 5는 2026-06-30 정식 출시와 동시에 Free·Pro 플랜의 기본 모델이 됐고, Max·Team·Enterprise·Claude Code 전 채널에도 제공됐다. Sonnet 티어에서는 처음으로 Opus급 에이전트 코딩 성능을 내세웠으며, Sonnet 4.6 대비 전 벤치마크 개선이 제시됐다.

가격은 2026-08-31까지 1M 토큰당 입력 $2, 출력 $10의 프로모션 체계다. 이후에는 입력 $3, 출력 $15의 정식 가격으로 전환될 예정이다.

컨텍스트 윈도는 1M 토큰이 기본값이자 최대값이다. 별도 롱컨텍스트 모델이나 확장 옵션이 아니라 하나의 표준 컨텍스트로 제공되며, 200K를 넘는 구간에도 프리미엄 요금이 없다. 다만 새 토크나이저는 동일 텍스트에서 이전 세대보다 약 1.0~1.35배 많은 토큰을 사용할 수 있으므로, 기존 비용 및 컨텍스트 예산을 그대로 적용하기는 어렵다.

장기 실행을 겨냥한 모델 동작

thinking 파라미터를 생략해도 적응형 사고(adaptive thinking)가 자동 실행돼 다단계 작업의 계획과 실행 루프를 조정한다. effort는 low, medium, high, xhigh, max의 5단계를 지원하며, Sonnet 티어에서는 처음으로 xhigh를 제공한다. 코딩과 에이전트 워크로드에서는 이 설정이 권장된다.

작업을 마친 뒤 별도 지시 없이 결과를 다시 확인하는 행태가 관찰됐고, 이전 Sonnet 세대보다 사람의 수정 루프 빈도가 줄었다. 기존 모델이 중단하던 지점에서도 도구 호출을 이어 가는 장기 실행 안정성 역시 모델의 핵심 변화로 제시된다.

대규모 소스 코드베이스, 장문 계약서나 정책 문서, 로그 묶음처럼 긴 문맥을 지속해서 유지해야 하는 작업이 1M 컨텍스트에 적합하다. 프롬프트 캐싱과 컨텍스트 압축(compaction)을 함께 사용하면 긴 에이전트 세션에서도 컨텍스트 초과 없이 처리를 이어 갈 수 있다.

가격 전환은 비용 기준선을 바꾼다

아니오Sonnet 5 정식 출시(2026-06-30)프로모션 가격 적용 구간입력 2달러 / 출력 10달러 (1M토큰당)2026-08-31 도달?정식 가격(GA pricing) 전환입력 3달러 / 출력 15달러 (1M토큰당)운영팀 비용 대시보드 재기준선설정워크로드별 티어 재배치 검토

프로모션 가격은 2026-08-31까지만 적용되고, 이후 동일 API 엔드포인트에서 별도 계약 갱신 없이 정식 가격으로 바뀐다. 정식 가격인 입력 $3·출력 $15도 Opus 4.8의 입력 $5·출력 $25보다 약 40% 낮다.

프로모션 구간의 입력 $2·출력 $10은 정식 가격보다 약 33% 낮으므로 대량 배치나 검증 파이프라인을 이 시기에 집중하는 선택이 가능하다. 다만 2026-08-31 이후 입력과 출력 단가는 각각 +50%가 된다. 월별 비용 시뮬레이션에는 이 전환분을 미리 반영해야 한다.

또한 동일 프롬프트의 토큰 수가 최대 1.35배 늘어날 수 있다. 프로모션 단가의 이점이 토큰 증가분으로 일부 상쇄될 수 있으므로, 비용은 실측값을 바탕으로 다시 계산해야 한다.

기본 모델 변경을 운영 통제 안에 넣기

Claude 생태계에서는 Free·Pro·Max·Team·Enterprise·Claude Code·API 전반에 동일 모델 아이디어가 즉시 반영된다. Claude Code도 별도 옵트인 없이 기본 에이전트 모델이 Sonnet 5로 바뀌므로, 기존 워크플로는 자동으로 새 모델 성능을 상속한다. Sonnet 4.6 같은 이전 모델은 즉시 폐기되지 않고 일정 기간 함께 제공된다.

기본 모델 자동 전환은 조직 차원에서 모델 버전을 명시적으로 고정(pin)해야 할 필요를 만든다. Sonnet 4.6 기준으로 검증한 프롬프트와 에이전트 워크플로는 Sonnet 5에서 다시 실행하고, 품질 저하 여부를 확인한 후 트래픽을 넘기는 편이 안전하다.

충족미충족Sonnet 4.6 운영Sonnet 5 기본 모델 전환 공지골든셋 기반 회귀 테스트품질·비용 기준 충족?프로덕션 트래픽 단계적 이관Sonnet 4.6 유지 원인 분석Claude Code 워크플로 전면전환모니터링 예외 처리 루프

에이전트 코딩 워크플로는 SWE-bench류 사내 벤치마크나 대표 태스크 셋으로 전환 전후의 성공률과 토큰 소비량을 비교할 수 있다. Sonnet 4.6에서 설정한 effort 값, 예를 들어 high를 그대로 쓰기보다 xhigh를 포함해 재스윕(sweep)하고 워크로드별 값을 다시 정한다.

트래픽은 카나리 방식으로 일부만 먼저 Sonnet 5에 이관한 뒤 실패율과 응답 품질을 모니터링한다. 회귀가 발생하면 이전 모델로 바로 돌아갈 수 있는 이원화 구조도 필요하다. 자기검증 루프가 장기 세션에서 수행되는 특성을 고려해 결과 로그와 사후 감사 체계도 함께 갖춰야 한다.

짧은 응답 생성이나 단순 분류처럼 긴 컨텍스트가 의미 없는 작업은 Haiku 4.5 등 경량 모델에 남겨 불필요한 비용을 피할 수 있다. 반대로 대규모 코드베이스 전체 리뷰, 여러 문서의 통합 분석, 긴 대화형 에이전트 세션은 컨텍스트 유지와 다단계 도구 호출, 사람 개입 최소화가 중요한 우선 적용 대상이다. 1M 토큰 한도에 가까워지는 세션에는 응답 품질 저하 없이 지속할 수 있도록 compaction 트리거 임계치를 미리 정한다.

비용과 성능에서 보는 Opus 4.8의 경계

항목 Claude Sonnet 5 Claude Opus 4.8
입력/출력 단가(1M 토큰, 정식) $3 / $15 $5 / $25
입력/출력 단가(프로모션, ~2026-08-31) $2 / $10 해당 없음
SWE-bench Pro(에이전트 코딩) 63.2% 69.2%
OSWorld-Verified 81.2% 더 높은 상위권
HLE(추론) 57.4% 상위권
GDPval-AA v2(지식노동) 1,618 1,615
컨텍스트 윈도 1M(기본·최대) 1M(기본·최대)
강점 비용 대비 에이전트 효율 최고 정확도·정밀 코딩

SWE-bench Pro에서는 Sonnet 5가 Opus 4.8보다 6%p 낮지만, GDPval-AA v2에서는 1,618로 1,615보다 근소하게 높다. 대다수 에이전트 코딩, 도구 사용, 지식노동 워크로드를 Sonnet 5로 옮기고 정확도가 결정적인 작업만 Opus 4.8에 남기는 방식이 제시된다.

단가만으로 실비용을 판단해서는 안 된다. Sonnet 5의 새 토크나이저는 동일 입력에서 Opus 4.8보다 더 많은 토큰을 소비할 수 있다.

경쟁 모델과 다른 운영 모델

항목 Claude Sonnet 5 GPT-5.6 Sol/Terra Gemini 3.5 Pro/Flash
가격 전략 프로모션→정식 2단계 전환 Sol·Terra·Luna 3티어 상시 구조 저가 지향, 추격 국면
에이전트 코딩 벤치마크 SWE-bench Pro 63.2% Terminal-Bench 2.1 88.8%(체계 상이) 경쟁적 수준, 공개 지표 제한적
컨텍스트 구조 1M 단일 표준(기본=최대) 모델별 상이, 티어 분리 Flash 저가·경량 중심
기본 모델 전환 방식 즉시 자동 전환(Free/Pro) 티어 선택형 라우팅 모델 선택형
강점 지식노동·장기 에이전트 안정성 티어별 비용 최적화 유연성 저비용·멀티모달

GPT-5.6은 출시 시점부터 Sol·Terra·Luna의 3티어 상시 구조로 비용과 성능을 조절한다. Sonnet 5는 프로모션 가격 뒤 정식 가격으로 옮겨 가는 2단계 구조다. 벤치마크 체계가 달라 수치를 직접 비교하기에는 제한이 있지만, 두 모델 모두 에이전트 코딩 성능을 보고한다.

Sonnet 5가 1M을 기본값과 최대값이 같은 단일 표준으로 제시한 데 비해 경쟁 모델은 티어와 버전별 컨텍스트 정책이 나뉜다. 이 차이는 Sonnet 5 쪽이 운영 예측을 단순하게 만드는 요소다. Claude Code의 기본 모델 전환은 Anthropic이 GPT-5.6 Codex와 Gemini 계열 코딩 에이전트가 경쟁하는 개발자 도구 시장에서 기본값 선점 전략을 취하고 있음을 시사한다.

2026년의 경쟁 축은 최상위 플래그십 모델만의 비교에서 일상적으로 사용하는 기본 모델의 에이전트 성능과 비용 균형으로 옮겨 가고 있다. 1M 토큰이 옵션이 아니라 표준으로 자리 잡으면서, 컨텍스트 크기 자체보다 압축과 캐싱을 어떻게 운영하는지가 차별화 요소가 된다. Claude Code와 Sonnet 5의 결합은 Anthropic이 소비자 시장보다 개발자 및 엔터프라이즈 워크플로를 성장 전략의 축으로 두고 있음을 다시 보여 준다.

Sources

Claude Sonnet 5Claude CodeAI 에이전트롱컨텍스트모델 거버넌스