Claude 모델 EOL과 Agent SDK 과금 분리 대응
Claude 구형 모델의 API 지원 종료와 Agent SDK 과금 분리가 자동화 파이프라인에 미치는 영향과 마이그레이션 대응책을 다룬다.
2026-08-14 · 최초 발행 2026-08-02
2026년 6월 15일, Anthropic의 모델 수명주기와 에이전트 과금 체계가 동시에 바뀐다. claude-sonnet-4-20250514와 claude-opus-4-20250514의 API 지원이 끝나는 한편, Agent SDK·Claude Code 헤드리스·GitHub Actions 사용량은 구독 한도에서 분리된 크레딧으로 집계된다.
CI/CD와 에이전트 자동화를 운영하는 팀이라면 모델 ID 교체만으로 대응이 끝나지 않는다. 출력 호환성을 다시 검증하고, 자동화 워크로드의 비용 경계와 중단 조건도 함께 점검해야 한다.
짧아진 모델 수명주기에 대응하기
Anthropic은 2026년 4월 15일 지원 종료 계획을 발표하고 약 2개월의 마이그레이션 기간을 제공했다. RFC 8594가 권고하는 최소 사전 공지 기간인 6–12개월보다 짧지만, 이번 변경은 같은 세대의 상위 호환 모델로 옮기는 경로가 제시돼 파괴적 변경의 범위가 제한된 사례다.
모델은 최신 활성 상태에서 유지보수 단계로 이동하고, 지원 중단 공지를 거쳐 EOL(End of Life)에 도달한다. EOL 이후에도 이전이 완료되지 않았다면 해당 모델에 의존하는 서비스가 장애로 이어질 수 있다.
claude-sonnet-4-20250514는 2025년 5월 14일 출시된 뒤 약 1년 만에 EOL에 들어간다. GPT 계열보다 빠른 편이며, LLM 시장의 모델 갱신 주기가 짧아지는 흐름을 보여준다.
레거시 모델 호출은 명시적으로 실패한다
2026년 6월 15일 09:00 PT가 지나면 레거시 모델 ID는 신규 모델로 조용히 전환되지 않는다. 호출은 하드 오류로 끝난다.
암묵적 폴백을 허용하면 코드베이스에 남은 오래된 의존성을 발견하기 어렵다. 모델이 자동으로 교체되는 동안 프롬프트 응답 형식, 툴 사용 방식, JSON 구조가 달라질 수도 있다. Anthropic은 모델을 몰래 바꾸는 대신 실패를 드러내는 방식을 택했다.
오류 코드는 model_not_found 또는 invalid_model 형태가 예상된다. 이 상태를 감시하는 알림이 없다면 프로덕션 장애가 발생한 뒤에야 문제를 인지해 MTTR이 급격히 늘어날 수 있다.
버전 핀닝의 이점과 EOL 부채
모델 문자열을 고정하는 버전 핀닝은 실험을 재현하고 응답 행동을 일정하게 유지하는 데 유리하다. 반대편에는 EOL 시점마다 모든 참조를 찾아 일괄 교체해야 하는 운영 부담이 있다.
이번 마이그레이션의 교체 경로는 다음과 같다.
| 레거시 모델 ID | 권장 교체 대상 | 확인할 사항 |
|---|---|---|
claude-sonnet-4-20250514 |
claude-sonnet-4-6 |
프롬프팅·툴 사용·JSON 포맷 하위 호환 |
claude-opus-4-20250514 |
claude-opus-4-7 |
Extended Thinking 옵션 인터페이스 변경 확인 필요 |
신규 모델 ID를 스테이징에 먼저 반영한 뒤 회귀 테스트로 출력 변화를 확인해야 한다. 구조화 출력이나 함수 호출에 의존하는 워크플로우라면 스키마 검증도 자동화 테스트에 넣어야 한다. API 호출이 성공했다는 사실만으로는 마이그레이션이 끝났다고 보기 어렵다.
대화와 자동화가 서로 다른 크레딧을 쓴다
2026년 6월 15일부터 대화형 사용과 프로그래매틱 사용은 독립된 버킷에서 계산된다. claude.ai 웹·앱 대화는 기존 구독 한도를 사용하고, Agent SDK나 헤드리스 실행은 Agent SDK 크레딧 풀을 소비한다.
이는 가격표만 바뀌는 일이 아니라 사용 유형을 기준으로 소비를 격리하는 미터링 구조의 도입이다. 대화형 요청과 자동화 호출은 사용 빈도와 비용 특성이 다르므로 하나의 구독 한도에서 분리해 추적한다.
플랜별 Agent SDK 크레딧은 아래와 같다.
| 플랜 | 월 크레딧 | 미터링 방식 | 롤오버 |
|---|---|---|---|
| Pro | $20 | 표준 API 요금 | 없음 |
| Max 5x | $100 | 표준 API 요금 | 없음 |
| Max 20x | $200 | 표준 API 요금 | 없음 |
크레딧은 달러 단위로 집계되고 표준 API 토큰 요금에 따라 차감된다. 다음 달로 이월되지 않으며 매월 초 리셋된다. Anthropic은 6월 15일 이전인 약 6월 8일 전후에 크레딧 클레임 이메일을 발송하며, 사용자는 계정 설정에서 수령 절차를 완료해야 한다.
어느 호출이 별도 미터링 대상인가
Agent SDK 크레딧 풀에 포함되는 범위는 다음과 같다.
claude -p명령어로 실행하는 파이프라인- Claude Agent SDK를 이용한 프로그래매틱 API 호출
- Claude Code GitHub Actions에서 수행하는 자동화
- 구독 계정을 사용하는 서드파티 에이전트 프레임워크 호출
반면 claude.ai 웹 인터페이스 대화, Claude 모바일 앱, 터미널에서 직접 사용하는 Claude Code 로컬 인터랙티브 세션은 기존 구독 한도를 유지한다.
로컬 Claude Code를 스크립트에서 호출하는 것처럼 두 범주의 경계에 걸친 사용 방식은 Anthropic 공식 문서를 기준으로 확인해야 한다.
CI/CD 사용량이 비용으로 바뀌는 구간
Pro 플랜의 $20 크레딧이 자동화 파이프라인에서 어떻게 소진되는지 Claude Sonnet 4.6의 표준 API 요금인 입력 $3/1M 토큰, 출력 $15/1M 토큰을 기준으로 계산하면 다음과 같다.
| 시나리오 | 1회 평균 토큰 | 월 실행 횟수 | 월 예상 비용 |
|---|---|---|---|
| 코드 리뷰 자동화 (소형) | 입력 2K + 출력 1K | 200회 | ~$9.6 |
| 문서 생성 파이프라인 | 입력 5K + 출력 3K | 100회 | ~$6.0 |
| 멀티 에이전트 오케스트레이션 | 입력 20K + 출력 10K | 50회 | ~$10.5 |
| 대용량 배치 처리 | 입력 50K + 출력 20K | 30회 | ~$13.5 |
중간 강도의 CI/CD 워크플로우라면 Pro 플랜의 $20 크레딧을 2–3주 만에 소진할 수 있다. 그동안 이 사용량을 구독 한도 안에서 처리했던 팀은 자동화 비용을 별도 항목으로 다시 계산해야 한다.
커뮤니티 일부에서는 이번 변화를 “최대 175배 실효 가격 인상”이라고 표현한다. 구독료 $20을 모두 에이전트 자동화에 사용하던 경우, API를 직접 구매하는 방식보다 효율이 낮아지는 구간이 생긴다는 주장이다.
고정비와 변동비를 함께 다루는 방식
Anthropic의 구조는 정액 구독과 종량제를 결합한 하이브리드 과금 모델이다. AWS의 예비 인스턴스(RI)와 온디맨드 조합, GCP의 약정 사용 할인과 종량제 병행 방식과 구조적으로 같다.
구독료는 예측 가능한 고정비로 남는다. 자동화 사용량은 별도 크레딧에서 빠져나가므로 어느 워크로드에서 비용이 발생했는지 귀속하기 쉬워진다. 다만 크레딧이 롤오버되지 않기 때문에 월별 자동화 워크로드가 고르지 않으면 남은 크레딧을 쓰지 못할 수 있다.
자동화 비중이 높은 팀은 Max 5x의 $100, Max 20x의 $200 크레딧 풀과 직접 API 구독을 비교해야 한다. 구독 등급만 올리는 판단보다 실제 토큰 소비 패턴을 기준으로 비용 효율을 분석하는 편이 맞다.
Anthropic과 OpenAI의 과금 경계
2026년 기준 Anthropic과 OpenAI는 소비자 구독에 에이전트 사용량을 포함하는 방식에서 차이를 보인다.
| 구분 | Anthropic (Claude) | OpenAI (GPT·Codex) |
|---|---|---|
| 소비자 구독 | Pro $20 / Max $100·$200 | ChatGPT Plus $20 / Pro $200 |
| 에이전트·CI 과금 | 별도 크레딧 풀 (6월 15일~) | ChatGPT Pro 내 포함 (일부 제한) |
| 직접 API 표준가 | Sonnet 4.6: $3/$15 per 1M | GPT-5.4: $2.5/$15 per 1M |
| 장기 컨텍스트 추가 요금 | 200K 토큰~: 없음 | 272K 토큰~: 추가 요금 |
| 캐싱 할인 | 최대 90% | 최대 50% |
캐싱이 70% 이상 적용되는 워크로드에서는 Sonnet 4.6의 실효 입력 요금이 $0.30/1M으로 GPT-4.1의 $1.30/1M보다 낮아진다. 캐싱을 적용하기 어려운 다양한 컨텍스트의 배치 처리에서는 OpenAI가 비용 우위를 가진다.
미터링 아키텍처로 읽는 이번 변경
IT 서비스 과금 체계 관점에서 보면 이번 개편은 정액 구독(Flat-Rate Subscription)과 사용 기반 과금(Usage-Based Billing, UBB)을 결합한 전환이다. ITIL 서비스 전략의 수요 관리(Demand Management)와도 직접 연결된다.
대화형 요청과 자동화 요청을 분리하는 소비 격리(Consumption Isolation)는 각 사용 패턴의 한계 비용을 측정할 수 있게 한다. 단일 구독 풀에서는 호출 빈도가 높은 자동화 사용자가 다른 사용자의 용량을 잠식하는 역선택(adverse selection)이 발생할 수 있다.
토큰 단위의 미터링 정밀도(Metering Granularity)는 프롬프트 캐싱, 배치 처리, 컨텍스트 압축 같은 최적화가 비용 변화로 곧바로 이어지게 한다. 크레딧 소진 뒤 요청을 막으면 예산 상한을 지킬 수 있고, 오버플로우 빌링을 활성화하면 SLA 연속성을 유지할 수 있다. 클라우드의 RI와 온디맨드를 조합하는 방식과 같은 패턴이다.
코드베이스에서 모델 ID를 찾아 교체하기
레거시 모델 참조는 2026년 6월 15일 09:00 PT 전에 모두 찾아야 한다.
# 레거시 모델 ID 전체 검색 (git grep 활용)
git grep -r "claude-sonnet-4-20250514" .
git grep -r "claude-opus-4-20250514" .
# 환경 변수 파일 점검
grep -r "claude-sonnet-4-20250514\|claude-opus-4-20250514" .env* config/ ci/
검색 범위는 애플리케이션 소스에 그치지 않는다. .env와 AWS Secrets Manager·Vault 같은 환경 변수 관리 시스템, .github/workflows/·.gitlab-ci.yml·Jenkinsfile 등의 CI/CD 설정도 확인해야 한다. Terraform이나 CDK에서 Lambda 환경 변수로 모델 ID를 주입하거나, LangChain 같은 프레임워크의 에이전트 설정을 데이터베이스에 저장한 경우도 교체 대상이다.
Opus 4.7로 옮길 때는 Extended Thinking 파라미터 인터페이스의 변경 여부를 따로 검증해야 한다. Sonnet 4.6은 프롬프팅·툴 사용·JSON 포맷이 하위 호환되므로 모델 문자열 교체만으로 충분한 경우가 대부분이다.
과금 전환 전에 운영 경계를 정한다
6월 15일 전에는 Anthropic 계정 설정에서 Agent SDK 크레딧 수령을 완료해야 한다. 자동화 중단을 감수하고 예산 상한을 지킬지, 오버플로우 빌링으로 SLA 연속성을 확보할지도 정해야 한다. 월별 자동화 토큰 사용량을 측정해 필요한 예산을 산정하는 작업도 이 시기에 필요하다.
6월부터 8월까지는 동일한 시스템 프롬프트를 재사용하는 워크로드를 중심으로 프롬프트 캐싱 범위를 넓힐 수 있다. 실시간 처리가 필요하지 않은 작업은 50% 비용 절감이 가능한 Batch API 전환을 검토하고, 경량 태스크를 Haiku로 보내는 멀티 모델 라우팅으로 크레딧 소비를 조정한다.
2026년 하반기에는 모델 버전 관리, 비용 모니터링, 자동 마이그레이션을 LLMOps 플랫폼으로 통합하는 방향을 고려할 수 있다. 모델 ID를 환경 변수나 설정 파일로 중앙화하면 다음 디프리케이션 때 코드베이스 전체를 다시 뒤지는 시간을 줄일 수 있다. 여기에 FinOps 관점의 AI 비용 거버넌스를 연결하면 모델 수명주기와 자동화 비용을 같은 운영 체계에서 관리할 수 있다.
이번 변경이 남기는 과제는 분명하다. 단기적으로는 레거시 모델 문자열과 크레딧 수령 상태를 확인해야 한다. 이후에는 모델의 EOL을 예외 상황이 아닌 반복되는 운영 이벤트로 취급하고, 대화형 사용과 자동화 사용의 비용을 분리해 추적해야 한다.
Sources
- https://platform.claude.com/docs/en/about-claude/model-deprecations
- https://platform.claude.com/docs/en/about-claude/models/migration-guide
- https://www.mindstudio.ai/blog/claude-sonnet-4-opus-4-deprecation-migration-guide
- https://tygartmedia.com/claude-4-deprecation/
- https://usagebox.com/articles/anthropic-june-15-agent-sdk-credit-split-claude-4-retirement
- https://codersera.com/blog/anthropic-june-2026-billing-change-claude-code/
- https://thenewstack.io/anthropic-agent-sdk-credits/
- https://vantagepoint.io/blog/ai/claude-agent-sdk-billing-change-june-15
- https://chatforest.com/guides/anthropic-claude-sonnet-4-opus-4-deprecation-june-15-2026/
- https://www.finout.io/blog/openai-vs-anthropic-api-pricing-comparison
- https://www.vantage.sh/blog/anthropic-vs-openai-api-costs
- https://theplanettools.ai/blog/claude-agent-sdk-billing-model-deprecation-june-15-2026-migration-playbook
- https://calmops.com/architecture/llmops-architecture-managing-llm-production-2026/