Claude Code Auto Mode: 분류기가 대신 판단하는 권한 승인

Anthropic이 출시한 Claude Code Auto Mode의 분류기 기반 권한 판단 기준, 지원 모델과 요구사항, 안전성에 대한 공식 입장을 정리한다.

2026-08-14 · 최초 발행 2026-03-25

Anthropic이 2026년 3월 24일, Claude Code에 'Auto Mode'를 정식 출시했다. 개발자가 매번 권한 요청을 수동으로 승인하지 않아도, 별도의 분류기 모델이 각 작업의 범위와 안전성을 자동으로 판단해 실행 여부를 결정하는 방식이다.

완전 수동과 완전 우회, 그 사이가 없었다

Auto Mode는 Claude Code가 파일 쓰기, bash 명령 실행 등의 작업을 수행할 때마다 발생하는 권한 승인 요청을 줄이기 위한 기능이다. 기존에는 개발자가 --dangerously-skip-permissions 플래그를 사용해 모든 권한을 우회하거나, 매 작업마다 수동으로 승인해야 했다. Auto Mode는 이 두 가지 극단 사이의 중간 지점을 목표로 한다. 각 액션이 실행되기 전에 별도의 분류기 모델(classifier model)이 해당 액션을 검토하고 실행 허용 여부를 결정한다.

분류기가 액션을 실행 전에 검토한다

(1) 범위 작업(2) 범위 초과 / 위험승인거부개발자 요청Claude Code작업 계획분류기 모델검토안전한가?자동 실행차단 또는개발자 승인 요청작업 완료개발자 검토작업 취소

무엇을 기준으로 막고, 무엇을 통과시키나

분류기 모델은 세 가지 기준으로 액션의 안전성을 평가한다. 첫째는 범위 초과 여부다. 요청된 작업의 범위를 벗어나는 액션인지 판단하는데, 예를 들어 "이 함수를 리팩토링해줘"라는 요청에서 다른 프로젝트의 파일을 수정하려 한다면 차단된다. 둘째는 신뢰할 수 없는 인프라 접근이다. 분류기가 신뢰할 수 없다고 판단하는 인프라를 대상으로 하는 액션은 차단되며, 외부 네트워크 호출이나 권한 범위 밖의 시스템 접근이 해당된다. 셋째는 악의적 콘텐츠 기반 판단이다. 파일이나 웹 페이지에서 발견된 악의적 콘텐츠(프롬프트 인젝션 등)에 의해 유도된 것으로 판단되는 액션도 차단된다.

지금 쓸 수 있는 조건

Auto Mode는 현재 Team 플랜에서 사용 가능하며, Enterprise 및 API 지원은 곧 추가될 예정이다. 기술적 요구 사항은 다음과 같다.

  • 지원 모델: Claude Sonnet 4.6 또는 Claude Opus 4.6
  • 미지원 환경: Haiku, claude-3 모델 계열, 서드파티 제공업체
  • 상태: 리서치 프리뷰(Research Preview)

Anthropic이 명시한 안전성의 한계

Anthropic은 Auto Mode가 권한 승인 요청을 줄이지만, 완전한 안전을 보장하지는 않는다고 명시했다. Auto Mode는 --dangerously-skip-permissions보다는 더 많은 보호를 제공하지만, 각 액션을 수동으로 검토하는 것만큼 철저하지는 않다. 이 때문에 Anthropic은 샌드박스 환경에서만 Auto Mode를 사용할 것을 권장한다. 잠재적인 피해를 제한하기 위해 격리된 환경에서 실행하는 것이 중요하다.

장시간 자동화 워크플로에 주는 의미

Auto Mode는 장시간 실행되는 자동화 작업이나 CI/CD 파이프라인 통합 시나리오에서 특히 유용하다. 매번 사람의 승인 없이도 안전하게 작업을 수행할 수 있는 환경이 마련되기 때문이다. 기존의 두 가지 옵션(완전 수동 vs. 완전 우회) 사이의 간극을 분류기 기반 자동 판단으로 채운 것은, AI 에이전트 시스템의 안전성과 자율성을 동시에 확보하려는 시도다.

Claude Code Auto Mode는 AI 코딩 에이전트가 더 자율적으로 작동하면서도 일정한 안전 경계를 유지하는 방향으로 나아가는 이정표다. 분류기 모델을 별도로 도입해 실행 전 검토하는 구조는, 향후 더 복잡한 에이전트 워크플로우에서도 핵심 패턴이 될 가능성이 높다. 현재는 리서치 프리뷰 단계이므로, 샌드박스 환경에서 활용하며 동작 방식을 파악하는 것이 바람직하다.

Sources

ClaudeCodeAutoMode권한분류기AIAgentSafetyAnthropic