AI 코딩 에이전트의 아키텍처 수렴과 도구 선택 기준
Claude Code, Cursor, Codex CLI, Antigravity 2.0의 공통 아키텍처와 보안·UX·생태계 차이를 비교한다.
2026-08-14 · 최초 발행 2026-06-10
서로 다른 출발점이 같은 실행 구조로 모였다
2026년 6월 현재 AI 코딩 에이전트 시장에서는 아키텍처 자체보다 가격, UX, 보안, 생태계 통합이 더 선명한 차이를 만든다. Claude Code, Cursor, OpenAI Codex CLI, Google Antigravity 2.0은 서로 다른 제품 철학에서 출발했지만, 이제는 컨텍스트를 모으고 도구를 호출한 뒤 실행 결과를 검증하는 공통 블루프린트 위에서 경쟁하고 있다.
2025년 초만 해도 각자의 위치는 분명했다. Claude Code는 개발자가 운전석을 지키는 터미널 에이전트에 가까웠고, Cursor는 IDE 안에 들어온 AI 어시스턴트를 지향했다. Codex는 클라우드 기반 자율 에이전트를, Antigravity 1.0은 멀티에이전트 코딩 플랫폼을 내세웠다. 그러나 2026년 2월 주요 도구들이 2주 이내에 멀티에이전트 기능을 잇달아 출시하면서 이런 구분은 빠르게 희미해졌다.
25년간 개발 현장을 지켜본 관점에서 보면, 지금의 선택은 어느 제품의 철학이 더 앞섰는지를 가리는 문제가 아니다. 같은 실행 구조를 각 제품이 어떤 환경과 통제 방식으로 제공하는지를 따져야 한다.
공통 블루프린트를 이루는 레이어
컨텍스트 수집에서는 AST와 코드 그래프를 이용한 구조적 인덱싱에 벡터 검색을 결합하는 방식이 표준으로 자리 잡았다. Anthropic Applied AI 팀은 2025년 9월 컨텍스트 엔지니어링을 LLM 추론 과정에서 최적의 토큰 집합을 선별하고 유지하는 전략 체계로 정의했다. 목표는 원하는 결과가 나올 가능성을 높이면서도 작고 신호 밀도가 높은 토큰 집합을 유지하는 데 있다.
외부 시스템과 연결하는 계층에서는 MCP(Model Context Protocol)가 사실상 공통 커넥터 역할을 한다. MCP는 2026년 5월 기준 9700만 다운로드와 75개 엔터프라이즈 커넥터를 기록했으며, 네 도구 모두 이를 이용해 외부 시스템과 통합한다. 도구 실행을 서브프로세스에 맡기고 결과의 요약본만 대화 컨텍스트에 넣는 패턴도 mksglu/context-mode가 2026년 4월 대중화된 뒤 공통 구현으로 확산됐다.
멀티에이전트 영역에서도 병렬 실행, 서브에이전트 위임, 장기 실행 워크플로우는 더 이상 특정 제품만의 기능이 아니다. 1000회 이상의 순차 도구 호출을 중단 없이 처리하는 수준이 기본 성능 기준선으로 올라왔다.
CI/CD와 연결되는 방식도 닮았다. GitHub Actions 통합, PR 자동화, 이슈 트리아지를 에이전트가 맡고, 생성된 코드는 사람이 작성한 코드와 같은 CI 파이프라인을 통과한다. 에이전트가 수정하고 기존 검증 체계가 결과를 판정하는 이 구조가 개발 워크플로우의 공통 패턴이 됐다.
실행 환경에서 갈라지는 제품 아키텍처
Claude Code: 터미널에서 개발자와 에이전트가 함께 운전한다
Claude Code는 터미널 우선 설계를 유지하면서 자동화 범위를 넓혀 왔다. 모델은 작업 성격에 따라 선택할 수 있다. Opus 4.7는 복잡한 아키텍처 설계에서 가장 높은 벤치마크를 기록하고, Sonnet 4.6는 일상적인 코딩 작업의 속도와 품질 사이를 맡는다. Haiku 4.5는 빠른 편집과 인라인 자동완성에 쓰인다. 작업 복잡도에 맞춰 모델 계층을 고를 수 있다는 점이 경쟁력이다.
통제 장치는 애플리케이션 레이어의 훅 시스템에 놓여 있다. 훅이 실행 전에 명령을 가로채 위험한 작업을 막거나 조직의 비즈니스 로직을 강제한다. Codex의 커널 수준 샌드박스보다 유연하지만 보안 강도는 낮다. 엔터프라이즈 환경에서는 SSO, SCIM, RBAC, 감사 로그와 HIPAA 준수 옵션을 제공한다.
GitHub Actions를 이용한 CI/CD, Slack, 예약 루틴, MCP 커넥터까지 자동화 통합 범위가 넓다. 서브에이전트 위임과 병렬 실행을 이용하면 복잡한 멀티파일 리팩토링도 장기 작업으로 이어갈 수 있다. 개인용 가격은 Pro $17/월부터 시작하며, 팀과 엔터프라이즈는 요청 기반으로 최대 $200+/월까지 분포한다.
Cursor: IDE 안에서 병렬 작업을 조직한다
Cursor 3와 Composer 2.5의 중심은 IDE에 녹아든 에이전트 경험이다. 2026년 2월 업데이트에서는 git worktree를 기반으로 최대 8개의 병렬 에이전트를 동시에 실행하는 기능을 도입했다. 대규모 코드베이스의 리팩토링처럼 작업을 분리할 수 있는 상황에서 생산성 차이를 만든다.
특정 모델 공급자에 고정되지 않는 것도 Cursor의 특징이다. GPT-5.5, Claude Sonnet, Gemini 3.5 가운데 작업에 맞는 모델을 고를 수 있다. 탭 자동완성은 속도와 정확도에서 업계 최고 수준으로 평가받고 있으며, 파일 사이의 컨텍스트를 이해하는 에이전트 모드는 여러 파일에 걸친 변경을 처리한다.
기업용 통제 기능으로는 SAML/OIDC SSO, 팀 Privacy Mode 강제 적용, 사용 분석 대시보드, AI 코드 추적 API가 있다. Pro 가격은 $20/월이며 엔터프라이즈 가격은 별도 협의 대상이다.
VS Code 포크를 기반으로 기존 확장 프로그램과의 호환성을 유지한 설계도 채택에 영향을 미쳤다. 새로운 AI 기능을 쓰면서 익숙한 편집 환경과 확장 생태계를 계속 가져갈 수 있기 때문이다.
Codex CLI: 커널 샌드박스와 자율 실행을 함께 밀어붙인다
Codex CLI는 네 제품 가운데 자율 실행에 가장 공격적으로 접근한다. 2026년 4월 GPT-5.5 출시와 함께 CLI 0.124–0.125가 릴리스됐고, Goal 모드는 프리뷰를 벗어나 정식 기능이 됐다. 1000+ 순차 도구 호출을 중단 없이 수행한 데모는 장시간 자율 실행의 방향을 보여줬다.
보안 경계는 OS 커널 수준에 둔다. macOS에서는 Apple Seatbelt 프레임워크를, Linux에서는 Landlock+seccomp를 사용한다. 권한은 읽기 전용, 작업공간 쓰기, 전체 접근으로 구분된다. 커널에서 시스템 호출을 차단해 에이전트가 허용되지 않은 파일시스템 영역에 접근하지 못하도록 통제하는 구조다.
클라우드 오케스트레이션은 여러 에이전트가 원격 환경에서 병렬로 작업한 뒤 결과를 합치는 방식이다. 장기 실행 작업, 대규모 코드베이스 마이그레이션, 복잡한 버그 수정에 강점을 보인다. OpenAI API, GPTs, Assistants API를 포함한 OpenAI 플랫폼과의 통합은 엔터프라이즈 고객이 공급업체 구성을 단순화하는 데도 영향을 준다.
Antigravity 2.0: 코딩 도구를 에이전트 운영 플랫폼으로 확장한다
Google I/O 2026이 열린 5월 19일 공개된 Antigravity 2.0은 코딩 에이전트를 플랫폼 차원으로 확장했다. Google은 기존 Gemini CLI를 공식 은퇴시키고, 데스크톱 IDE와 CLI인 agy, SDK, Managed Agents API, 엔터프라이즈 배포 경로로 이어지는 5계층 아키텍처를 후계자로 내놓았다.
백엔드 모델인 Gemini 3.5 Flash는 초당 289 토큰의 추론 속도를 제공한다. 다른 프론티어 모델보다 4배 빠른 속도는 실시간 에이전틱 워크플로우에서 체감 차이를 만든다. 멀티에이전트 병렬 오케스트레이션과 동적 서브에이전트, 예약 백그라운드 작업을 플랫폼 수준에서 함께 제공하는 유일한 도구다.
내장 Chromium 브라우저와 공개 SDK도 제품의 범위를 넓힌다. SDK를 사용하면 서드파티 인프라에 커스텀 에이전트를 호스팅할 수 있다. Google AI Studio, Firebase, Android와의 네이티브 통합은 Google 스택을 중심으로 운영하는 팀에서 인력 절감 효과로 이어진다.
응답형 도구에서 장기 실행 루프로
2026년 에이전틱 개발의 변화는 단일 프롬프트에 답하는 응답 모드에서 실제 작업이 끝날 때까지 움직이는 실행 루프로 넘어간 데 있다. 이 루프에는 도구 호출, 파일 읽기, 셸 출력 해석, 서브에이전트 핸드오프가 포함된다. 15단계 리팩토링 작업은 실제 사고가 시작되기 전에 100,000 토큰을 쉽게 소모할 수 있다.
작업은 GitHub 이슈를 읽고 관련 코드를 찾는 단계에서 시작된다. 에이전트가 AST 분석으로 수정 대상 파일을 특정하고 계획을 세운다. GitHub Agentic Workflows는 자동화 목표를 Markdown 파일로 정의하고, 에이전트가 GitHub Actions에서 이를 실행하는 구조를 표준화했다.
코드 작성에서는 TDD 기반 에이전트 패턴이 주류가 됐다. 먼저 테스트를 실행하고 컴파일러 오류를 자율적으로 수정한 뒤, 회귀 테스트를 포함한 PR을 제출한다. 이때 테스트는 에이전트가 따라야 할 실행 가능한 명세가 된다.
PR 단계에서는 사람이 검토 루프에 들어온다. 에이전트가 만든 코드도 기존 코드와 같은 CI 파이프라인을 통과하며, 보안 정책과 코드 품질 게이트, 자동 문서화가 함께 적용된다. 자율 에이전트가 이슈부터 배포된 PR까지 최소한의 인간 개입으로 처리하는 흐름이 2026년의 목표 상태다. 현재 선도적인 팀은 전체 작업의 40-60%를 에이전트에 위임하고 있다.
기능이 비슷해진 뒤 무엇으로 선택할 것인가
가격은 가장 직접적인 기준이다. 2026년 6월 AI 코딩 에이전트 시장은 연간 약 98억~110억 달러 규모로 추산된다. 가격대는 GitHub Copilot의 $10/월부터 완전 자율 도구인 Devin의 $500/월까지 펼쳐져 있다. 주요 제품 중 Cursor는 $20/월, Claude Code Pro는 $17/월 구간에서 경쟁한다. Windsurf가 2026년 5월 Pro 가격을 $15에서 $20으로 올려 Cursor와 같은 가격대에 진입한 일은 중간 시장이 포화되고 있다는 신호로 읽힌다.
개발 환경과 맞물리는 방식도 중요하다. Cursor는 VS Code 포크를 이용해 기존 워크플로우와의 마찰을 줄인다. Claude Code는 터미널 우선이라 특정 IDE에 묶이지 않는다. Antigravity 2.0은 자체 IDE를 제공하므로 팀이 새로운 사용 경험을 받아들여야 한다. Codex CLI는 클라우드 오케스트레이션에 무게를 두어 로컬 개발 환경과의 통합은 상대적으로 약하다.
모델 백엔드에서는 제품별 강조점이 다르다. Claude Code의 Opus 4.7는 복잡한 추론 작업에서 최고 점수를 기록하고, Codex의 GPT-5.5는 클라우드 자율 실행에 최적화됐다. Antigravity의 Gemini 3.5 Flash는 속도를 앞세우며, Cursor는 여러 모델을 선택하게 해 특정 공급자에 대한 종속을 피한다.
소스 공개 전략 역시 조직의 판단에 영향을 준다. Codex CLI는 오픈소스로 공개돼 기업 내부 보안 감사와 커스터마이징이 가능하다. Claude Code, Cursor, Antigravity는 클로즈드소스지만 API와 확장 지점을 제공한다. 엄격한 보안 요구가 있는 금융·의료 기업은 감사 가능성과 커스터마이징 때문에 Codex CLI 또는 자체 호스팅 옵션을 선호하는 경향이 있다.
대기업에서는 보안 모델, HIPAA·SOC2·GDPR 컴플라이언스, GitHub Enterprise·Azure DevOps·GitLab 같은 기존 인프라와의 연결, 토큰 기반과 구독 기반 가격 중 어느 쪽이 사용량을 예측하기 쉬운지가 도입 결정을 좌우한다.
제품별 포지셔닝을 한눈에 비교하면
| 기준 | Claude Code | Cursor | Codex CLI | Antigravity 2.0 |
|---|---|---|---|---|
| 실행 환경 | 로컬 터미널 | IDE 내장 | 클라우드+로컬 | 멀티 플랫폼 |
| 모델 백엔드 | Opus 4.7/Sonnet 4.6/Haiku 4.5 | 멀티모델 선택 | GPT-5.5 | Gemini 3.5 Flash |
| 보안 레이어 | 훅 기반 앱 레이어 | Privacy Mode + SSO | OS 커널 샌드박스 | Managed Agents API |
| 병렬 에이전트 | 서브에이전트 위임 | 최대 8개 동시 | Goal 모드 클라우드 | 동적 서브에이전트 |
| 오픈소스 | 아니오 | 아니오 | 예(CLI) | 아니오(SDK 공개) |
| 개인용 가격 | $17/월~ | $20/월 | API 사용량 기반 | 베타 무료~ |
| 주요 강점 | 추론 품질·자동화 | UX·커뮤니티 | 보안·자율성 | 속도·플랫폼 |
| 최적 사용자 | 복잡한 기능 개발 | 일상적 편집 | 보안 중시 기업 | Google 스택 팀 |
Codex CLI는 커널 샌드박스 코드를 포함한 전체 CLI를 공개해 커뮤니티 기여와 기업 내부 수정을 허용한다. Antigravity는 SDK를 열어 서드파티 에이전트 개발을 유도하지만 핵심 플랫폼은 닫아 둔다. Claude Code와 Cursor는 MCP 표준을 통한 확장성에 집중하는 선택적 개방 전략을 택했다.
수렴 이후에는 신뢰성과 생태계가 남는다
장기 실행의 안정성은 다음 경쟁의 핵심이다. 에이전트가 막혔을 때 스스로 복구할 수 있는지, 복잡한 멀티에이전트 실행을 예측 가능한 방식으로 통제할 수 있는지가 실제 배포를 가른다. 무한 루프, 컨텍스트 폭발, 잘못된 도구 호출 같은 실패를 어떻게 처리하는지가 기능 목록보다 중요해진다.
각 공급자는 자사 생태계와의 결합도 강화하고 있다. Antigravity 2.0은 Google 스택에, Claude Code는 Anthropic 엔터프라이즈 플랫폼에, Cursor는 VS Code 생태계에, Codex는 OpenAI 플랫폼에 연결된다. 기술 우위만큼이나 다른 도구로 옮길 때 발생하는 전환 비용이 경쟁 수단이 되는 셈이다.
Grok Build 같은 신규 제품도 같은 블루프린트를 들고 시장에 진입하면서 가격 압력은 더 커지고 있다. Windsurf의 가격 인상에서 확인되는 중간 시장의 포화도 이 흐름과 맞닿아 있다. 장기적으로 에이전틱 코딩은 클라우드 컴퓨팅처럼 범용화되고 가격도 수렴할 가능성이 높다.
2026년 6월의 선택 기준을 제품별로 좁히면 차이가 선명해진다. 복잡한 기능 개발과 자동화 파이프라인에는 Claude Code가, 일상적인 편집 경험과 커뮤니티 생태계에는 Cursor가 맞는다. 커널 수준 보안과 자율 실행이 필요한 기업은 Codex CLI를, Google 스택과의 깊은 통합이 필요한 팀은 Antigravity 2.0을 우선 검토할 수 있다. 공유하는 아키텍처가 늘어날수록 승부는 신뢰성, 생태계, 가격에서 갈린다.
Sources
- Claude Code vs. Cursor vs. Codex vs. Antigravity — six months in - The New Stack
- AI Coding Agents 2026: Claude Code vs Antigravity 2.0 vs Codex vs Cursor vs Kiro vs Copilot vs Windsurf - Pricing & Features Compared | Lushbinary
- Claude Code vs Cursor vs OpenAI Codex vs Google Antigravity (2026): The Honest Comparison
- Agentic Coding in 2026: Claude Code vs Codex CLI vs Gemini CLI vs Cursor Agent
- Context Architecture for AI Agents: A Complete 2026 Guide
- The State of AI Coding Agents (2026): From Pair Programming to Autonomous AI Teams
- Google I/O 2026 Antigravity 2.0 — Gemini CLI Shutdown and Agent IDE War
- Google Antigravity 2.0 Complete Guide: The Agent-First Coding Platform
- Codex CLI vs Claude Code 2026: Architecture, Pricing, and China Access
- Beyond Autocomplete: Best Agentic Coding Workflow in 2026 | Kilo
- How agentic AI will reshape engineering workflows in 2026 | CIO
- GitHub Agentic Workflows Unleash AI-Driven Repository Automation - InfoQ
- Antigravity 2.0 vs Cursor vs Claude Code: The Honest Comparison | FindSkill.ai