Claude Agent SDK 과금 분리와 CI/CD 비용 운영 전략
Claude Agent SDK 자동화 사용량이 구독 한도에서 분리되는 과금 구조와 크레딧·오버플로·CI/CD 비용 관리 방안을 분석한다.
2026-08-14 · 최초 발행 2026-08-02
자동화 사용량이 구독 한도에서 빠진다
Anthropic은 2026년 6월 15일부터 Claude Agent SDK, claude -p, Claude Code GitHub Actions, 서드파티 에이전트의 사용량을 기존 구독 한도와 분리한다. 대화형 사용과 프로그래매틱 자동화의 비용을 서로 다른 경로로 정산하는 Claude Agent SDK Billing Separation이다.
Claude를 CI/CD 파이프라인에 연결한 팀에는 단순한 요금제 변경이 아니다. 자동화가 어느 크레딧 풀을 쓰는지, 크레딧 소진 후 파이프라인을 중단할지 계속 실행할지, 초과 비용을 어떻게 감시할지를 함께 결정해야 하는 운영 구조의 변경이다.
정책 변경이 이어진 배경
이번 분리는 2026년에 이루어진 세 번째 과금 조정이다.
- 2026년 2월:
claude -p및 헤드리스 Agent SDK 사용을 구독 약관상 금지 - 2026년 4월: 금지 규정 강화, 자동화 우회 패턴 명시적 차단
- 2026년 5월 13일: "분리 과금(Split Billing)" 정책 발표, 6월 15일 시행 예고
- 2026년 6월 15일: 크레딧 풀 분리 공식 적용
구독 모델과 에이전트 워크로드 사이에는 구조적인 불균형이 있었다. Pro($20/월) 구독자가 자동화 에이전트로 수백~수천 달러 상당의 토큰을 소비하는 사례가 Claude Code 출시 이후 급증했다. 플랫 레이트 구독은 장시간 동작하는 에이전트의 컴퓨트 소비를 감당하도록 설계된 모델이 아니었다. OpenClaw 같은 도구를 이용한 장시간 자율 태스크가 이 취약점을 확대하면서 Anthropic은 손실을 방어하기 위한 정책을 선택하게 됐다.
변경 전후의 청구 경계
| 구분 | 변경 전 | 변경 후 |
|---|---|---|
| Agent SDK / claude -p | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| Claude Code GitHub Actions | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| 서드파티 Agent SDK 앱 | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| Claude.ai 웹/앱 대화 | 구독 한도 내 포함 | 구독 한도 내 유지 (변경 없음) |
| Claude Code 터미널 대화형 사용 | 구독 한도 내 포함 | 구독 한도 내 유지 (변경 없음) |
| 크레딧 롤오버 | 해당 없음 | 미지원(월 만료) |
| 크레딧 소진 후 동작 | 요청 제한 | 오버플로 활성화 여부에 따라 API 요금 또는 거부 |
시행 전에는 Anthropic이 발송하는 크레딧 청구 이메일을 확인하고 6월 15일 이전에 Claude 계정에서 크레딧을 수동으로 클레임해야 한다. 아울러 "Usage Credits(오버플로 과금)"를 활성화할지 결정해야 한다. 이를 활성화하지 않으면 크레딧 소진과 함께 자동화 요청이 전면 거부된다.
사용 맥락으로 나뉘는 이중 버킷
Anthropic은 요청을 사용 맥락(Usage Context) 에 따라 대화형과 프로그래매틱 버킷으로 구분한다.
대화형(Interactive) 버킷
├── Claude.ai 웹/데스크톱/모바일 채팅
├── Claude Code 터미널 (사용자가 직접 조작하는 세션)
└── Claude Cowork
프로그래매틱(Programmatic) 버킷 [신규 분리]
├── Claude Agent SDK (headless 실행)
├── claude -p (파이프라인 모드)
├── Claude Code GitHub Actions
└── 서드파티 앱 (Agent SDK 인증 경유)
경계를 가르는 기준은 인간의 실시간 개입 여부다. 개발자가 터미널에서 직접 claude 명령을 다루는 세션은 기존 구독 버킷에 남는다. 반대로 CI/CD, GitHub Actions, 스크립트 자동화처럼 사람의 개입 없이 호출되는 작업은 새 프로그래매틱 크레딧 버킷으로 이동한다.
구독 플랜별 크레딧은 다음과 같다.
| 구독 플랜 | 월 구독료 | 프로그래매틱 크레딧 | 적용 API 단가 |
|---|---|---|---|
| Pro | $20 | $20/월 | 표준 API 리스트 가격 |
| Max 5x | $100 | $100/월 | 표준 API 리스트 가격 |
| Max 20x | $200 | $200/월 | 표준 API 리스트 가격 |
Claude Sonnet 4.6의 표준 API 가격을 적용하면 Pro의 $20 크레딧은 약 66만 7천 입력 토큰에 해당한다. 이는 캐싱이 없고 입력 단가가 $3/1M인 조건이다. 헤비 에이전트 워크로드에서는 실효 가격 인상 폭이 12배에서 최대 175배에 달한다는 분석이 나온다.
크레딧을 모두 사용한 뒤의 처리는 오버플로 설정에 달려 있다.
월간 크레딧 풀 ($20/$100/$200)
↓ 소진
오버플로 과금 활성화 여부?
├── YES → API 표준 단가로 자동 청구 (무제한 계속 실행)
└── NO → 모든 프로그래매틱 요청 즉시 거부 (자동화 파이프라인 중단)
오버플로를 끄면 비용 상한을 통제할 수 있지만 CI/CD 파이프라인이 예고 없이 멈출 수 있다. 켜 두면 실행은 이어지지만 비용이 무제한으로 늘어날 수 있다. 개인 설정이 아니라 팀의 비용 거버넌스 정책으로 다뤄야 할 선택이다.
헤드리스 요청의 미터링과 정산 경로
프로그래매틱 요청은 입력 토큰, 출력 토큰, 캐시 히트 토큰을 API 리스트 가격에 따라 실시간으로 차감한다. 해당 사용량은 claude.ai 대시보드에서 구독 사용량과 분리해 집계된다.
크레딧은 청구 주기가 시작될 때 리셋되며 사용하지 않은 금액은 이월되지 않는다. 자동으로 활성화되는 방식도 아니다. 사용자가 직접 클레임해야 프로그래매틱 크레딧을 사용할 수 있다.
파이프라인 비용을 계산하는 기준
CI/CD 워크로드의 월 비용은 태스크 수와 입출력 토큰, 캐시 사용량을 함께 넣어 추정할 수 있다.
월 예상 비용 = Σ (태스크_수 × 평균_입력_토큰 × 입력_단가)
+ Σ (태스크_수 × 평균_출력_토큰 × 출력_단가)
- (캐시_히트율 × 입력_토큰_합계 × 캐싱_할인율)
Claude Sonnet 4.6의 2026년 6월 단가는 다음과 같다.
| 항목 | 단가 | 비고 |
|---|---|---|
| 입력 토큰 | $3.00/1M | 표준 |
| 출력 토큰 | $15.00/1M | 표준 |
| 캐시 쓰기 | $3.75/1M | +25% |
| 캐시 읽기 | $0.30/1M | -90% |
GitHub Actions에서 PR 리뷰 봇을 운용한다고 가정한다.
- PR 당 평균 입력: 8,000 토큰 (코드 컨텍스트 포함)
- PR 당 평균 출력: 1,500 토큰 (리뷰 코멘트)
- 월 PR 수: 200건
- 캐시 히트율: 60% (시스템 프롬프트 재사용)
입력 비용: 200 × 8,000 × $3.00/1M = $4.80
출력 비용: 200 × 1,500 × $15.00/1M = $4.50
캐시 절감: 200 × 4,800 × ($3.00 - $0.30)/1M = -$2.59
총 월 비용 ≈ $6.71
이 조건에서는 Pro($20 크레딧)로 감당할 수 있다. 월 PR 수가 600건 이상이면 Max 5x로 업그레이드해야 한다.
전체 구조를 구독, 크레딧, 오버플로 영역으로 나누면 다음과 같다.
전환 전에 예산과 중단 정책을 정한다
먼저 현재 사용 중인 claude -p, GitHub Actions, Agent SDK 워크플로를 식별하고 호출 빈도와 토큰 소비량을 측정한다. Anthropic 콘솔이나 내부 로그에서 월평균 사용량을 추출하면 기존 자동화가 어느 플랜의 크레딧에 들어오는지 계산할 수 있다.
6월 15일 전에는 비용 예측 공식을 적용해 Pro $20, Max 5x $100, Max 20x $200 가운데 적절한 티어를 선택해야 한다. 자동화 중단 비용과 오버플로 비용을 비교해 조직 차원의 초과 사용 정책도 확정한다.
6월 15일에는 Anthropic 이메일의 클레임 링크를 확인하고 Claude 계정 설정에서 크레딧을 수동 활성화한다. 이후에는 주간·월간 소진율을 추적하고 팀별 사용량 할당(Budget Allocation) 정책을 운영한다.
마이그레이션 과정에서 확인할 범위는 다음과 같다.
| 평가 항목 | 확인 내용 | 우선순위 |
|---|---|---|
| 사용 워크플로 인벤토리 | claude -p / GitHub Actions / SDK 사용 목록 전체 파악 | 높음 |
| 월 토큰 소비량 | 최근 3개월 평균 토큰 사용량 측정 | 높음 |
| 오버플로 정책 | 소진 후 계속 실행 vs 중단 선택 | 높음 |
| 크레딧 클레임 | 이메일 수신 후 수동 클레임 완료 | 높음 |
| 비용 예측 모델 | 현재 워크로드 기준 월 예상 비용 산출 | 중간 |
| 티어 최적화 | Pro/Max 5x/Max 20x 최적 플랜 선택 | 중간 |
| 캐싱 전략 | 프롬프트 캐싱으로 토큰 절감 여지 탐색 | 중간 |
| 알림 체계 | 크레딧 소진 전 경보 구성 | 중간 |
| 대안 라우팅 | 단순 작업을 저비용 모델로 전환 가능성 | 낮음 |
사용량과 예산 경보를 함께 운영한다
모니터링은 실시간 사용량, 예산 경보, 거버넌스 정책을 연결해야 한다.
L1: 실시간 모니터링
├── Claude 대시보드: 프로그래매틱 사용량 별도 집계 확인
├── API 응답 헤더: x-ratelimit-remaining-tokens 모니터링
└── 자체 로깅: 워크플로별 토큰 소비량 기록
L2: 예산 경보
├── 월 크레딧의 50% 소진 시 Slack/Email 알림
├── 월 크레딧의 80% 소진 시 긴급 알림
└── 소진 시 오버플로 과금 발생 알림
L3: 거버넌스 정책
├── 워크플로별 최대 토큰 예산 할당
├── 비필수 자동화 우선순위 조정 기준
└── 월별 비용 리뷰 및 티어 최적화
실시간 계층에서는 Claude 대시보드와 API 응답 헤더, 자체 로그를 함께 사용한다. 그 위에 월 크레딧의 50%와 80% 소진 경보를 두고, 최종적으로 워크플로별 토큰 예산과 월별 비용 검토 정책을 적용한다.
GitHub Actions에서 주기적으로 잔액을 확인해 Slack으로 알리는 구성은 다음과 같다.
# .github/workflows/claude-budget-check.yml
name: Claude Budget Monitor
on:
schedule:
- cron: '0 9 * * 1' # 매주 월요일 오전 9시
jobs:
budget-check:
runs-on: ubuntu-latest
steps:
- name: Check Claude Credit Usage
run: |
USAGE=$(curl -s -H "Authorization: Bearer $ANTHROPIC_API_KEY" \
https://api.anthropic.com/v1/usage/credits | jq '.remaining')
THRESHOLD=20 # 잔액 $20 미만 시 알림
if (( $(echo "$USAGE < $THRESHOLD" | bc -l) )); then
curl -X POST $SLACK_WEBHOOK \
-d '{"text": "Claude 크레딧 잔액 부족: '$USAGE' USD 남음"}'
fi
Anthropic과 OpenAI의 에이전트 비용 구조
2026년 6월 기준 API 단가를 직접 비교하면 다음과 같다.
| 모델 | 입력 ($/1M) | 출력 ($/1M) | 특징 |
|---|---|---|---|
| Claude Sonnet 4.6 | $3.00 | $15.00 | 코딩/에이전트 최적화 |
| Claude Opus 4.6 | $5.00 | $25.00 | 최고 성능 |
| GPT-5.4 | $2.50 | $15.00 | 범용 고성능 |
| GPT-4.1 | $2.00 | $8.00 | 코드 생성 특화 |
| GPT-4.1 Nano | $0.10 | $0.40 | 초저가 경량 |
표면적인 단가만 보면 OpenAI가 대부분의 티어에서 저렴하다. 다만 CI/CD처럼 같은 시스템 프롬프트를 반복해서 사용하는 환경에서는 캐싱 조건까지 넣어 비교해야 한다.
| 항목 | Anthropic | OpenAI |
|---|---|---|
| 프롬프트 캐시 히트 할인 | 90% (캐시 읽기 $0.30/1M) | 50% (캐시 히트) |
| 배치 API 할인 | 50% | 25% |
| 월별 청구 방식 | 크레딧 선불 (구독자) + API 직접 | 크레딧 선불 또는 월 청구 |
| 크레딧 롤오버 | 없음 (월 만료) | 1년 유효 |
| 에이전트 SDK 분리 과금 | 6월 15일부터 | 없음 (API 직접 청구만 존재) |
| 자동화 사용 약관 | 별도 크레딧 풀로 허용 | 직접 API 키 사용으로 허용 |
캐시 히트율을 70%로 가정하면 입력 토큰의 실효 단가는 다음과 같이 계산된다.
- Claude Sonnet 4.6: $3.00 × 30% + $0.30 × 70% = $1.11/1M (캐시 적용)
- GPT-4.1: $2.00 × 50% + $1.00 × 50% = $1.50/1M (캐시 적용)
Anthropic의 캐시 읽기 할인은 90%, OpenAI의 캐시 히트 할인은 50%다. 시스템 프롬프트 재사용률이 높은 CI/CD 워크로드에서는 표면 단가와 달리 Anthropic의 실효 비용이 더 낮아질 수 있다.
워크로드별 라우팅도 선택지가 된다. 복잡한 코드 분석과 에이전트 루프에는 캐싱을 극대화한 Claude Sonnet 4.6을 사용하고, 단순 포맷 변환과 분류는 GPT-4.1 Nano($0.10/1M)로 넘길 수 있다. 고성능 아키텍처 설계와 복잡한 추론은 Claude Opus 4.6 또는 GPT-5.4로 선택적으로 라우팅한다.
하이브리드 빌링으로 보는 과금 구조
IT 서비스 과금 체계의 관점에서 이번 변경은 **하이브리드 빌링 모델(Hybrid Billing Model)**로의 전환에 해당한다.
플랫 레이트가 가진 확장성 한계와 순수 종량제가 가진 예측 가능성 부족을 구독과 크레딧, 오버플로의 조합으로 보완하는 구조다. AWS의 Reserved Instance + On-Demand 하이브리드나 Snowflake의 Credit + Compute Cost와도 구조적으로 같다. 과금 설계의 원칙인 예측 가능성(Predictability), 공정한 비용 귀속(Fair Attribution), **스케일 탄력성(Scale Elasticity)**을 함께 충족하려는 방식이다.
2026년에는 대화형·자동화·배치의 사용 맥락별 분리 과금이 보편화될 전망이다. 태스크와 서브에이전트 단위로 미터링을 세분화할 가능성도 있다. 여러 LLM 공급자를 동적으로 선택하는 게이트웨이 수요가 늘고, 클라우드 FinOps는 AI 토큰 비용 관리로 확장될 수 있다. 예산 정책을 Infrastructure as Code(IaC) 방식으로 관리하는 "AI Cost as Code"도 부상할 전망이다.
Claude 자동화를 운영하는 팀은 대화형 구독과 프로그래매틱 비용을 별도의 예산으로 봐야 한다. 6월 15일 이전에 크레딧 클레임, 오버플로 정책, 비용 예측 모델을 준비하고, 이후에는 프롬프트 캐싱과 LLM 라우팅으로 실효 비용을 통제해야 한다.
Sources
- Anthropic June 15 Claude subscription billing overhaul - Apiyi.com
- Anthropic's June 15 Billing Change: What Every Claude Code & Agent SDK User Must Do - CoderSera
- Anthropic Ends Subscription Subsidy for Agents June 15 - TechTimes
- Anthropic splits billing again: Agent SDK gets separate credit pools - The New Stack
- Claude Agent SDK Billing Splits June 15: What Teams Must Do - VantagePoint
- Claude Agent SDK Dual-Bucket Billing: June 2026 Change Explained - TygartMedia
- Anthropic puts Claude agents on a meter across its subscriptions - InfoWorld
- Claude subscriptions get separate budgets for programmatic use - The Decoder
- OpenAI vs Anthropic API Pricing Comparison 2026 - Finout
- Claude Code Pricing After June 15: The Decision Table - FindSkill.ai
- Canonical reference for Anthropic's May 13, 2026 Agent SDK policy change - GitHub Gist