Claude Agent SDK 분리 과금과 CI/CD 비용 운영 전략
Claude Agent SDK의 구독·종량제 분리 과금 구조와 크레딧, 오버플로, CI/CD 비용 예측 및 운영 기준을 정리한다.
2026-08-14 · 최초 발행 2026-08-02
Anthropic은 2026년 6월 15일부터 Claude Agent SDK, claude -p, Claude Code GitHub Actions, 서드파티 에이전트의 사용량을 구독 한도와 분리해 청구한다. Claude Agent SDK Billing Separation은 단순한 요금 변경이 아니다. 사람이 직접 사용하는 대화형 세션과 자동으로 실행되는 프로그래매틱 워크로드 사이에 비용 책임을 나누는 구조 개편이다.
Claude를 CI/CD 파이프라인에 연결한 팀은 기존 구독료만 볼 수 없게 된다. 크레딧 소진 뒤의 동작, 월간 토큰 소비량, 캐시 적용 효과까지 비용 모델에 포함해야 한다.
구독이 자동화 비용을 떠안던 구조의 종료
이번 조정은 2026년에 이어진 과금 정책 변화의 연장선에 있다.
- 2026년 2월:
claude -p및 헤드리스 Agent SDK 사용을 구독 약관상 금지 - 2026년 4월: 금지 규정 강화, 자동화 우회 패턴 명시적 차단
- 2026년 5월 13일: "분리 과금(Split Billing)" 정책 발표, 6월 15일 시행 예고
- 2026년 6월 15일: 크레딧 풀 분리 공식 적용
플랫 레이트 구독은 에이전트가 장시간 소비하는 컴퓨트 자원을 감당하는 방식으로 설계되지 않았다. Claude Code 출시 이후 Pro($20/월) 구독자가 자동화 에이전트로 수백~수천 달러 상당의 토큰을 소비하는 사례가 급증했고, OpenClaw 같은 도구를 이용한 장시간 자율 태스크는 이 불균형을 더 크게 드러냈다. Anthropic의 선택은 구독이 자동화 사용량을 보조하던 구조에서 벗어나 손실을 방어하는 방향이었다.
변경 전후를 나누면 다음과 같다.
| 구분 | 변경 전 | 변경 후 |
|---|---|---|
| Agent SDK / claude -p | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| Claude Code GitHub Actions | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| 서드파티 Agent SDK 앱 | 구독 한도 내 포함 | 별도 크레딧 풀 차감 |
| Claude.ai 웹/앱 대화 | 구독 한도 내 포함 | 구독 한도 내 유지 (변경 없음) |
| Claude Code 터미널 대화형 사용 | 구독 한도 내 포함 | 구독 한도 내 유지 (변경 없음) |
| 크레딧 롤오버 | 해당 없음 | 미지원(월 만료) |
| 크레딧 소진 후 동작 | 요청 제한 | 오버플로 활성화 여부에 따라 API 요금 또는 거부 |
사용자는 Anthropic이 발송하는 크레딧 청구 이메일을 받은 뒤 6월 15일 이전에 Claude 계정에서 크레딧을 수동으로 클레임해야 한다. 함께 정해야 할 항목은 "Usage Credits(오버플로 과금)" 활성화 여부다. 이를 켜지 않으면 크레딧이 소진되는 순간 자동화 요청이 전면 거부된다.
대화형 세션과 자동화는 다른 버킷을 쓴다
분리 기준은 어떤 제품을 사용했는지가 아니라 사용 맥락(Usage Context) 이다.
대화형(Interactive) 버킷
├── Claude.ai 웹/데스크톱/모바일 채팅
├── Claude Code 터미널 (사용자가 직접 조작하는 세션)
└── Claude Cowork
프로그래매틱(Programmatic) 버킷 [신규 분리]
├── Claude Agent SDK (headless 실행)
├── claude -p (파이프라인 모드)
├── Claude Code GitHub Actions
└── 서드파티 앱 (Agent SDK 인증 경유)
터미널에서 개발자가 직접 claude 명령을 실행하고 대화를 이어가는 세션은 기존 구독 버킷에 남는다. CI/CD, GitHub Actions, 스크립트 자동화처럼 사람의 실시간 개입 없이 호출되는 워크플로는 프로그래매틱 크레딧 버킷으로 전달된다.
구독 플랜에 따라 제공되는 프로그래매틱 크레딧은 아래와 같다.
| 구독 플랜 | 월 구독료 | 프로그래매틱 크레딧 | 적용 API 단가 |
|---|---|---|---|
| Pro | $20 | $20/월 | 표준 API 리스트 가격 |
| Max 5x | $100 | $100/월 | 표준 API 리스트 가격 |
| Max 20x | $200 | $200/월 | 표준 API 리스트 가격 |
Claude Sonnet 4.6의 표준 API 가격을 기준으로 보면 Pro의 $20 크레딧은 약 66만 7천 입력 토큰에 해당한다. 캐싱을 적용하지 않고 $3/1M을 사용한 계산이다. 헤비 에이전트 워크로드에서는 실효 가격 인상 폭이 12배에서 최대 175배에 이른다는 분석도 나온다.
크레딧을 모두 썼을 때의 처리는 오버플로 설정이 결정한다.
월간 크레딧 풀 ($20/$100/$200)
↓ 소진
오버플로 과금 활성화 여부?
├── YES → API 표준 단가로 자동 청구 (무제한 계속 실행)
└── NO → 모든 프로그래매틱 요청 즉시 거부 (자동화 파이프라인 중단)
오버플로를 끄면 지출 상한을 통제할 수 있지만 자동화 파이프라인이 예고 없이 멈출 수 있다. 반대로 활성화하면 파이프라인은 계속 실행되지만 비용이 무제한으로 늘어날 수 있다. 개인 설정으로 남겨두기보다 팀이나 조직의 비용 정책으로 다뤄야 하는 선택이다.
요청 분류부터 초과 청구까지 이어지는 경로
프로그래매틱 사용량은 요청의 사용 맥락을 판별한 뒤 별도 크레딧 풀에서 차감된다.
입력 토큰, 출력 토큰, 캐시 히트 토큰은 API 리스트 가격에 따라 실시간 차감된다. 프로그래매틱 사용분은 claude.ai 대시보드에서 구독 사용량과 분리해 집계한다. 크레딧은 청구 주기가 시작될 때 리셋되고 사용하지 않은 잔액은 이월되지 않는다. 자동 활성화가 아니므로 사용자가 직접 클레임해야 한다는 점도 운영 절차에 포함해야 한다.
두 과금 영역의 관계를 펼쳐 보면 구독과 종량제가 결합된 하이브리드 구조가 드러난다.
CI/CD 비용을 워크로드 단위로 계산하기
자동화 비용은 태스크 수와 평균 토큰 소비량을 기준으로 추정할 수 있다. 캐시가 적용된다면 입력 비용에서 캐시 절감분을 분리한다.
월 예상 비용 = Σ (태스크_수 × 평균_입력_토큰 × 입력_단가)
+ Σ (태스크_수 × 평균_출력_토큰 × 출력_단가)
- (캐시_히트율 × 입력_토큰_합계 × 캐싱_할인율)
Claude Sonnet 4.6의 2026년 6월 기준 단가는 다음과 같다.
| 항목 | 단가 | 비고 |
|---|---|---|
| 입력 토큰 | $3.00/1M | 표준 |
| 출력 토큰 | $15.00/1M | 표준 |
| 캐시 쓰기 | $3.75/1M | +25% |
| 캐시 읽기 | $0.30/1M | -90% |
GitHub Actions에서 PR 리뷰 봇을 운영한다고 가정한다. PR 하나가 코드 컨텍스트를 포함해 평균 입력 8,000 토큰을 쓰고 리뷰 코멘트로 평균 출력 1,500 토큰을 생성한다. 월간 PR은 200건이며, 시스템 프롬프트를 재사용해 캐시 히트율 60%를 얻는 조건이다.
입력 비용: 200 × 8,000 × $3.00/1M = $4.80
출력 비용: 200 × 1,500 × $15.00/1M = $4.50
캐시 절감: 200 × 4,800 × ($3.00 - $0.30)/1M = -$2.59
총 월 비용 ≈ $6.71
이 계산에서는 Pro($20 크레딧) 플랜으로 감당할 수 있다. 다만 PR 수가 600건 이상으로 늘어나면 Max 5x 업그레이드가 필요하다.
전환 전에 예산과 중단 정책을 함께 정한다
먼저 현재 claude -p, GitHub Actions, SDK 워크플로를 전부 찾아 사용 빈도와 토큰 소비량을 측정한다. Anthropic 콘솔이나 내부 로그에서 월평균 사용량을 뽑으면 비용 공식에 대입할 기준을 얻을 수 있다.
6월 15일 이전에는 현재 워크로드의 예상 월 비용을 계산하고 Pro $20, Max 5x $100, Max 20x $200 가운데 적정 티어를 정한다. 자동화가 멈췄을 때의 비즈니스 영향과 오버플로 비용도 비교해야 한다. 이 평가가 끝나야 조직 단위로 오버플로를 켤지, 크레딧 소진 시 실행을 중단할지 결정할 수 있다.
6월 15일에는 Anthropic이 보낸 이메일에서 크레딧 클레임 링크를 확인하고 Claude 계정 설정에서 수동으로 활성화한다. 이후에는 주간·월간 크레딧 소진율을 추적하고 팀별 사용량 할당 정책을 운영한다.
영향 범위를 점검할 때는 다음 항목을 빠뜨리지 않아야 한다.
| 평가 항목 | 확인 내용 | 우선순위 |
|---|---|---|
| 사용 워크플로 인벤토리 | claude -p / GitHub Actions / SDK 사용 목록 전체 파악 | 높음 |
| 월 토큰 소비량 | 최근 3개월 평균 토큰 사용량 측정 | 높음 |
| 오버플로 정책 | 소진 후 계속 실행 vs 중단 선택 | 높음 |
| 크레딧 클레임 | 이메일 수신 후 수동 클레임 완료 | 높음 |
| 비용 예측 모델 | 현재 워크로드 기준 월 예상 비용 산출 | 중간 |
| 티어 최적화 | Pro/Max 5x/Max 20x 최적 플랜 선택 | 중간 |
| 캐싱 전략 | 프롬프트 캐싱으로 토큰 절감 여지 탐색 | 중간 |
| 알림 체계 | 크레딧 소진 전 경보 구성 | 중간 |
| 대안 라우팅 | 단순 작업을 저비용 모델로 전환 가능성 | 낮음 |
모니터링과 예산 경보를 한 체계로 묶기
사용량 거버넌스는 실시간 관측, 예산 경보, 조직 정책을 연결해야 한다.
L1: 실시간 모니터링
├── Claude 대시보드: 프로그래매틱 사용량 별도 집계 확인
├── API 응답 헤더: x-ratelimit-remaining-tokens 모니터링
└── 자체 로깅: 워크플로별 토큰 소비량 기록
L2: 예산 경보
├── 월 크레딧의 50% 소진 시 Slack/Email 알림
├── 월 크레딧의 80% 소진 시 긴급 알림
└── 소진 시 오버플로 과금 발생 알림
L3: 거버넌스 정책
├── 워크플로별 최대 토큰 예산 할당
├── 비필수 자동화 우선순위 조정 기준
└── 월별 비용 리뷰 및 티어 최적화
Claude 대시보드만 확인해서는 어떤 워크플로가 예산을 소비했는지 알기 어렵다. 자체 로그에 워크플로별 토큰 사용량을 남기고, 월 크레딧의 50%와 80% 소진 지점에서 서로 다른 수준의 알림을 보내야 한다. 크레딧이 모두 소진돼 오버플로 청구가 시작될 때도 별도 경보가 필요하다.
GitHub Actions에서 주기적으로 잔액을 확인하는 예시는 다음과 같다.
# .github/workflows/claude-budget-check.yml
name: Claude Budget Monitor
on:
schedule:
- cron: '0 9 * * 1' # 매주 월요일 오전 9시
jobs:
budget-check:
runs-on: ubuntu-latest
steps:
- name: Check Claude Credit Usage
run: |
USAGE=$(curl -s -H "Authorization: Bearer $ANTHROPIC_API_KEY" \
https://api.anthropic.com/v1/usage/credits | jq '.remaining')
THRESHOLD=20 # 잔액 $20 미만 시 알림
if (( $(echo "$USAGE < $THRESHOLD" | bc -l) )); then
curl -X POST $SLACK_WEBHOOK \
-d '{"text": "Claude 크레딧 잔액 부족: '$USAGE' USD 남음"}'
fi
Anthropic과 OpenAI 비용 구조를 비교할 때 볼 것
2026년 6월 기준 모델별 API 단가는 아래와 같다.
| 모델 | 입력 ($/1M) | 출력 ($/1M) | 특징 |
|---|---|---|---|
| Claude Sonnet 4.6 | $3.00 | $15.00 | 코딩/에이전트 최적화 |
| Claude Opus 4.6 | $5.00 | $25.00 | 최고 성능 |
| GPT-5.4 | $2.50 | $15.00 | 범용 고성능 |
| GPT-4.1 | $2.00 | $8.00 | 코드 생성 특화 |
| GPT-4.1 Nano | $0.10 | $0.40 | 초저가 경량 |
표면 단가만 비교하면 OpenAI가 대부분의 티어에서 저렴하다. 하지만 CI/CD처럼 같은 시스템 프롬프트를 반복해서 쓰는 환경에서는 캐시 정책이 실제 비용을 바꿀 수 있다.
| 항목 | Anthropic | OpenAI |
|---|---|---|
| 프롬프트 캐시 히트 할인 | 90% (캐시 읽기 $0.30/1M) | 50% (캐시 히트) |
| 배치 API 할인 | 50% | 25% |
| 월별 청구 방식 | 크레딧 선불 (구독자) + API 직접 | 크레딧 선불 또는 월 청구 |
| 크레딧 롤오버 | 없음 (월 만료) | 1년 유효 |
| 에이전트 SDK 분리 과금 | 6월 15일부터 | 없음 (API 직접 청구만 존재) |
| 자동화 사용 약관 | 별도 크레딧 풀로 허용 | 직접 API 키 사용으로 허용 |
캐시 히트율 70%를 가정하면 입력 토큰의 실효 단가는 다음과 같이 계산된다.
- Claude Sonnet 4.6: $3.00 × 30% + $0.30 × 70% = $1.11/1M (캐시 적용)
- GPT-4.1: $2.00 × 50% + $1.00 × 50% = $1.50/1M (캐시 적용)
시스템 프롬프트 재사용률이 높은 CI/CD 워크로드에서는 Anthropic의 90% 캐시 할인이 OpenAI의 50%보다 유리하다. 표면 단가에서 OpenAI가 저렴해 보여도 헤비 캐싱 환경에서는 Anthropic의 실효 비용이 더 낮아질 수 있다.
워크로드를 한 모델에 고정할 필요도 없다. 복잡한 코드 분석과 에이전트 루프에는 Claude Sonnet 4.6을 배치해 캐싱을 극대화하고, 단순 포맷 변환과 분류에는 GPT-4.1 Nano($0.10/1M)를 사용할 수 있다. 고성능 아키텍처 설계와 복잡 추론은 Claude Opus 4.6 또는 GPT-5.4로 선택적으로 라우팅하는 구성이 가능하다.
하이브리드 빌링으로 보는 비용 귀속 구조
IT 서비스 과금 체계 관점에서 이번 변경은 **하이브리드 빌링 모델(Hybrid Billing Model)**의 전형적인 진화에 해당한다.
플랫 레이트가 주는 예측 가능성과 종량제가 주는 비용 귀속을 결합하고, 티어별 크레딧으로 사용량을 제한한 뒤 초과분을 다시 종량제로 넘기는 구조다. AWS의 Reserved Instance + On-Demand 하이브리드, Snowflake의 Credit + Compute Cost 구조와도 구조적으로 같다. 이 설계는 IT 서비스 과금의 핵심 원칙인 예측 가능성(Predictability), 공정한 비용 귀속(Fair Attribution), **스케일 탄력성(Scale Elasticity)**을 함께 충족하려는 접근이다.
2026년에는 대화형, 자동화, 배치 사용을 구분하는 맥락 기반 과금이 보편화될 전망이다. 에이전트 사용량도 태스크와 서브에이전트 단위로 더 세분화해 미터링할 가능성이 있다. 여러 LLM 공급자를 동적으로 선택하는 게이트웨이 수요가 늘고, 클라우드 FinOps 방법론은 AI 토큰 비용 관리로 확장될 수 있다. 예산 정책을 IaC 방식으로 코드화하는 "AI Cost as Code" 역시 같은 흐름에서 등장한다.
Claude 자동화 비용은 이제 구독 플랜 하나로 설명되지 않는다. 팀은 대화형 사용과 자동화 사용의 비용을 분리하고, 크레딧 클레임과 오버플로 정책, 워크플로별 예산을 함께 관리해야 한다. 장기적인 비용 통제는 LLM 라우팅과 프롬프트 캐싱을 실제 사용량 데이터에 맞춰 조정하는 데 달려 있다.
Sources
- Anthropic June 15 Claude subscription billing overhaul - Apiyi.com
- Anthropic's June 15 Billing Change: What Every Claude Code & Agent SDK User Must Do - CoderSera
- Anthropic Ends Subscription Subsidy for Agents June 15 - TechTimes
- Anthropic splits billing again: Agent SDK gets separate credit pools - The New Stack
- Claude Agent SDK Billing Splits June 15: What Teams Must Do - VantagePoint
- Claude Agent SDK Dual-Bucket Billing: June 2026 Change Explained - TygartMedia
- Anthropic puts Claude agents on a meter across its subscriptions - InfoWorld
- Claude subscriptions get separate budgets for programmatic use - The Decoder
- OpenAI vs Anthropic API Pricing Comparison 2026 - Finout
- Claude Code Pricing After June 15: The Decision Table - FindSkill.ai
- Canonical reference for Anthropic's May 13, 2026 Agent SDK policy change - GitHub Gist