Claude Code·Codex·Antigravity 아키텍처와 기업 비용 비교
Claude Code, Codex CLI, Antigravity 2.0의 실행 구조와 성능, 가격 체계, 기업 도입 시 비용 거버넌스를 비교한다.
2026-08-14 · 최초 발행 2026-06-10
코딩 보조를 넘어 실행 주체가 된 도구들
2026년 6월, AI 코딩 도구 시장에서 Claude Code, OpenAI Codex CLI, Google Antigravity 2.0의 역할은 뚜렷하게 갈렸다. 이들은 더 이상 자동완성에 머물지 않는다. 코드베이스를 탐색하고 PR을 만들며 여러 태스크를 병렬로 처리하는 코딩 에이전트로 자리 잡았다.
도입 경쟁의 변수도 성능만은 아니다. Microsoft가 Claude Code 라이선스를 전면 취소하고 Uber가 AI 도구에 배정한 예산을 4개월 만에 소진한 사례는 비용 거버넌스가 기업 AI 전략의 핵심 조건임을 드러냈다.
같은 청사진, 다른 실행 철학
Claude Code는 터미널 네이티브 방식을 유지한다. 기본 모델은 Claude Sonnet 4.6이며 SWE-Bench Verified에서 79.6%를 기록했다. 100만 토큰 컨텍스트 윈도우는 베타로 제공되고, 자동 컴팩션과 결합해 대형 모노레포를 탐색하는 데 강점을 보인다. 작업 단계마다 개발자의 확인을 받는 승인 중심 흐름을 채택했으며, 복잡한 레거시 코드베이스를 빠르게 처리한다는 실전 평가를 받는다.
OpenAI Codex CLI는 Rust로 작성된 오픈소스 도구다. ChatGPT Plus·Pro·Business·Enterprise 구독에 번들로 제공되며, 추론 레벨을 조정하면서 GPT-5.4와 GPT-5.3-Codex를 선택할 수 있다. 병렬 서브에이전트와 내장 워크트리, 클라우드 실행 환경을 지원하고 커밋·푸시 전에 별도의 코드 리뷰 에이전트를 거친다. 실행 결과는 가장 보수적인 편이지만 안전한 태스크에서는 가장 빠른 처리 성능을 보인다.
Google Antigravity 2.0은 2026년 5월 19일 Google I/O에서 데스크톱 앱, CLI, SDK, Managed Agents API, 엔터프라이즈로 구성된 5개 서페이스 플랫폼으로 다시 출시됐다. Gemini 3.5 Flash가 기본 모델이며, 추가 최적화를 통해 다른 프론티어 모델보다 12배 빠른 처리 속도를 일시 제공한다. 실행 환경은 격리된 Linux이며 프로토타입 품질에서 가장 높은 평가를 받는다.
컨텍스트와 실행 환경이 사용 경험을 가른다
Claude Code는 로컬 파일시스템을 직접 훑고 1M 토큰 컨텍스트를 이용해 큰 코드베이스를 한 세션에서 파악한다. Codex CLI는 워크트리 격리와 클라우드 인덱싱을 결합해 병렬 작업 사이의 충돌을 줄인다. Antigravity 2.0은 멀티에이전트 오케스트레이션으로 복잡한 요청을 서브에이전트에 나눈다.
격리 방식도 다르다. Codex CLI는 태스크를 격리된 클라우드 환경에서 실행해 로컬 시스템을 보호하고, Antigravity 2.0은 격리된 Linux 환경을 사용한다. Claude Code는 로컬에서 실행하는 대신 승인 흐름으로 위험한 작업을 사전에 제어한다.
터미널에서 CI/CD까지 이어지는 작업 방식
Claude Code는 터미널을 중심으로 멀티파일 리팩터링과 레거시 코드 분석, 대규모 테스트 작성을 수행한다. 1M 토큰 컨텍스트를 활용하면 전체 모노레포를 한 세션에서 다룰 수 있고, PR 자동화는 터미널의 Git 조작으로 이어진다.
Codex CLI의 구별점은 커밋과 푸시 전에 동작하는 자동 코드 리뷰 에이전트다. 변경이 끝나면 별도의 에이전트가 품질을 검사한 뒤 Git 반영 단계로 넘어간다. 독립적인 피처 브랜치를 동시에 개발할 때는 병렬 서브에이전트가 유리하다. ChatGPT 생태계와 연결되어 있어 기업 환경에서도 추가 도구 설치 없이 사용할 수 있다.
Antigravity 2.0의 Scheduled Tasks는 cron을 기반으로 에이전트를 예약 실행한다. 개발자가 자리를 비운 야간에도 보안 스캔, 의존성 업데이트, 테스트를 정기 실행할 수 있다. Google Cloud 엔터프라이즈 통합은 GCP 인프라를 사용하는 조직에 네이티브한 운영 경험을 제공한다. Gemini Audio 모델을 이용한 라이브 음성 전사는 음성으로 코딩 작업을 지시하는 인터페이스를 제시한다.
Node.js 태스크에서 드러난 성향
실전 Node.js 태스크에서는 도구마다 장단점이 분명했다.
| 도구 | 강점 | 약점 |
|---|---|---|
| Claude Code | 가장 빠른 완료 속도 | 토큰 비용 높음 |
| Codex CLI | 가장 안전/보수적 | 복잡 태스크에서 느림 |
| Antigravity 2.0 | 최고 프로토타입 품질 | Google Cloud 종속성 |
Claude Sonnet 4.6은 SWE-Bench Verified에서 79.6%를 기록해 Sonnet 4.5의 77.2%보다 높은 결과를 냈다. Claude Code 사용자 테스트에서는 Sonnet 4.6이 Sonnet 4.5보다 70%의 경우에서 선호됐고, Opus 4.5와 비교해도 59%에서 선택됐다. ARC-AGI-2 점수는 이전 세대의 13.6%에서 58.3%로 올라 4.3배 향상됐다.
Codex CLI는 단일 벤치마크 점수보다 안전성과 통합성에서 평가받는다. Rust 기반 구현이 오픈소스로 공개돼 기업 보안 감사에서도 내부 동작을 확인할 수 있다.
Antigravity 2.0에서는 Gemini 3.5 Flash가 Gemini 3.1 Pro보다 코딩·에이전트 벤치마크에서 앞섰다. 기본 모델 변경이 플랫폼 전략과 맞물린 결과다.
Microsoft와 Uber가 드러낸 비용 문제
2026년 5월 Microsoft는 Windows, Microsoft 365, Outlook, Teams, Surface를 담당하는 Experiences & Devices 사업부 전체에서 Claude Code 라이선스를 철회했다. 종료일은 6월 30일이었으며, 수천 명의 엔지니어는 GitHub Copilot CLI로 이동했다.
배경에는 토큰 기반 비용이 있었다. Claude Code는 좌석당 기본 요금 $20/좌석/월에 실제 API 토큰 사용료가 더해진다. 사용이 늘수록 비용도 함께 증가하는 구조다. Microsoft의 파일럿은 연간 AI 예산 전체를 수개월 만에 소진했다. 취소일인 6월 30일이 Microsoft 회계연도 마지막 날과 겹친 점은 의도적인 예산 절감 조치로 해석된다.
Uber는 약 5,000명의 엔지니어에게 Claude Code를 배포했다. 2026년 4월 기준 월 채택률은 8495%였지만, 엔지니어 1인당 API 지출도 월 $500$2,000에 이르렀다. 결국 Cursor를 포함한 AI 도구의 2026년 전체 예산 $34억을 4개월 만에 소진했다.
이 사례에서 구독료만으로 토큰 기반 도구의 TCO를 예측하기 어렵다는 점이 확인된다. 채택률 상승이 비용 통제의 부담으로 돌아올 수도 있다. 따라서 사용량 모니터링과 별도의 예산 거버넌스 없이 기업 규모로 확대하기는 어렵다.
생산성 체감과 측정 결과의 간극
2026년 AI 코딩 도구 시장 규모는 약 $9.8B~$11.0B로 성장했고 개발자 채택률은 91%에 이르렀다. 반면 McKinsey 2025 State of AI 보고서에서 AI가 EBIT에 기여한다고 답한 기업은 39%였으며, 대부분은 5% 미만의 기여도를 보고했다.
개발자의 체감과 통제 실험 결과도 일치하지 않는다. 주관적 설문에서는 개발자가 20%의 생산성 향상을 느꼈지만, METR의 무작위 대조 실험에서는 경험 많은 개발자가 복잡한 태스크를 수행할 때 19% 순 둔화가 측정됐다. MIT 연구에서는 생성 AI 파일럿의 95%가 P&L에 측정 가능한 영향을 주지 못했다.
구독료 역시 전체 비용의 일부다. 실제 비용은 구독료의 23배이며 토큰 초과 사용, 프리미엄 모델 접근 요금, 좌석 관리의 복잡성, 에이전트 사용 배수가 숨은 비용을 만든다. 헤비 유저가 지불하는 금액은 기본 구독료의 25배에 이른다.
기업 규모와 운영 환경에 따라 선택 기준도 달라진다.
- 소규모 스타트업은 30인 이하를 기준으로 Claude Code $20/월 진입 티어를 검토할 수 있다. 복잡한 레거시가 없는 그린필드 개발에서는 넓은 컨텍스트 윈도우와 처리 속도가 빠른 프로토타이핑을 돕는다.
- 30~500인 규모의 중견기업에서는 ChatGPT 라이선스에 번들된 Codex CLI가 비용 면에서 유리하다. 병렬 에이전트와 코드 리뷰 자동화는 팀 작업 방식을 표준화하는 데 쓰인다.
- 500인 이상 대기업은 토큰 사용량 거버넌스를 먼저 마련한 뒤 도구를 혼용해야 한다. Google Cloud 사용 비중이 높다면 Antigravity 2.0 엔터프라이즈의 네이티브 통합을 활용할 수 있다.
- Google Cloud 중심 조직에서는 Antigravity 2.0 엔터프라이즈 티어가 인프라 통합과 보안 정책의 일관성 측면에서 유리하다.
구독 가격만으로 TCO를 계산할 수 없는 이유
Codex CLI는 2026년 4월 2일부터 토큰 기반 과금으로 바뀌었고 엔터프라이즈에는 4월 23일부터 적용됐다. 초기에는 번들로 제공되는 무료 도구로 받아들여졌지만, 사용량이 증가하면서 실제 비용이 $100~$200/개발자/월에 이른다는 보고가 나왔다.
GitHub Copilot Business는 $19/사용자/월에 300 프리미엄 요청을 제공한다. 엔터프라이즈 확장 버전은 $39/사용자/월에 1,000 프리미엄 요청을 제공한다. 예측 가능한 고정 비용 구조 덕분에 AI 코딩 도구 예산을 통제하기 어려운 기업에서 다시 주목받고 있다.
ROI는 도구 하나를 도입하는 것만으로 생기지 않는다. 도구를 조합하고 AI 코드 리뷰에 맞는 작업 방식을 설계하며, 복잡한 신규 엔지니어링보다 반복적인 루틴 작업에 에이전트를 집중할 때 실질적인 성과로 연결된다.
2026년 6월의 경쟁 구도에서 Claude Code는 복잡한 코드베이스 탐색, Codex CLI는 안전성과 ChatGPT 생태계 통합, Antigravity 2.0은 멀티에이전트 오케스트레이션과 속도를 각자의 강점으로 내세웠다. Microsoft의 라이선스 취소는 기술적 우위와 기업 도입 가능성이 서로 다른 문제임을 보여준다. 기업에 필요한 질문도 어느 도구가 최고인지보다 측정 가능한 ROI를 유지하면서 어떤 조합으로 운용할 것인지에 가깝다.
Sources
- https://thenewstack.io/claude-code-vs-cursor-vs-codex-vs-antigravity-2026/
- https://lushbinary.com/blog/ai-coding-agents-comparison-cursor-windsurf-claude-copilot-kiro-2026/
- https://www.aimadetools.com/blog/antigravity-2-vs-claude-code-vs-codex-cli/
- https://techcrunch.com/2026/05/19/google-launches-antigravity-2-0-with-an-updated-desktop-app-and-cli-tool-at-io-2026/
- https://www.marktechpost.com/2026/05/19/google-launches-antigravity-2-0-at-i-o-2026-a-standalone-agent-first-platform-with-cli-sdk-managed-execution-and-enterprise-support/
- https://www.nxcode.io/resources/news/claude-sonnet-4-6-complete-guide-benchmarks-pricing-2026
- https://claudefa.st/blog/models/claude-sonnet-4-6
- https://www.eesel.ai/blog/codex-pricing
- https://vpsranking.com/ai/claude-code-vs-codex-vs-google-antigravity/
- https://www.xda-developers.com/used-claude-code-google-antigravity-codex-for-month-have-clear-winner/
- https://www.windowscentral.com/microsoft/microsoft-cancels-claude-code-licenses-shifting-developers-to-github-copilot-cli-a-move-likely-driven-by-financial-motives
- https://www.techradar.com/pro/microsoft-may-discontinue-claude-code-internally-as-it-looks-to-push-users-towards-github-copilot
- https://www.sitepoint.com/ai-coding-tools-cost-analysis-roi-calculator-2026/
- https://blog.exceeds.ai/enterprise-ai-coding-roi-studies/
- https://masterofcode.com/blog/ai-roi
- https://www.getpanto.ai/blog/ai-coding-assistant-statistics
- https://www.mckinsey.com/capabilities/quantumblack/our-insights/the-state-of-ai
- https://keyholesoftware.com/ai-software-development-cost-2026/