Codex Goal Mode와 잠금 화면 컴퓨터 사용의 에이전트 설계
Codex Goal Mode의 세션 영속 목표 구조와 macOS Locked Computer Use의 권한·보안·감사 설계를 실무 관점에서 비교한다.
2026-08-14 · 최초 발행 2026-06-10
세션이 끝나도 목표를 남기는 Codex
OpenAI는 2026년 5월 21일 Codex의 Goal Mode와 Locked Computer Use를 GA(일반 제공)로 전환했다. Goal Mode는 /goal로 지정한 작업을 세션 종료, 프로세스 재시작, 토큰 예산 초기화와 분리해 유지한다. Locked Computer Use는 macOS 화면이 잠긴 동안에도 GUI 앱을 조작할 수 있도록 OS 수준의 접근 경로를 제공한다.
Goal Mode는 Codex 앱, VS Code·JetBrains 확장, CLI v0.128.0 이상에 같은 날 적용됐다. Appshots와 Locked Computer Use도 함께 출시됐다. 기능은 GPT-5.3-codex를 기반으로 동작하며, 1,000회 이상의 연속 툴 콜에 대한 내구성 검증을 마쳤다.
기존의 1질문→1응답 방식과 가장 크게 달라진 부분은 작업 단위다. 에이전트는 하나의 응답을 만드는 데서 멈추지 않고 plan→act→test 순환을 반복하며 성공 기준을 추적한다. 엔지니어 Yannik Zuehlke는 오후 9시 20분에 /goal을 할당한 뒤 랩톱을 닫았고, 5.5시간 후 돌아와 완료된 작업을 확인했다.
목표 상태를 세션 바깥에 보관하는 방식
Goal Mode는 스레드마다 하나의 목표를 SQLite 테이블에 직렬화한다. 저장되는 값은 UUID 형식의 goal_id, status, token_budget, usage_counter다. 목표 상태는 active, paused, budget_limited, complete로 구분된다.
동시에 발생하는 accounting 업데이트는 Semaphore(1)로 직렬화한다. 목표가 교체되면 새로운 goal_id UUID를 만들고, 상태를 갱신하는 호출자는 expected_goal_id를 함께 전달한다. 두 식별자가 다르면 해당 업데이트를 조용히 무시한다. 이전 목표에서 늦게 도착한 in-flight 호출이 새 목표의 상태를 덮어쓰는 문제를 막기 위한 장치다.
턴 라이프사이클에는 런타임 훅이 연결된다. 이 훅은 토큰 사용량의 델타와 wall-clock 경과를 추적한다. Ctrl+C나 프로세스 킬과 같은 인터럽트가 들어오면 목표를 paused로 바꾸고 SQLite에 플러시한다. 이후 같은 스레드에서 resume 이벤트가 발생하면 목표를 다시 active로 전환하고 저장된 진행분을 복원한다. TUI 종료나 터미널 크래시, 프로세스 재시작도 같은 복원 경로를 사용한다.
컨텍스트와 분리된 예산 회계
목표에는 세션 컨텍스트 윈도우와 별도의 토큰 예산 슬롯이 배정된다. 사용량은 delta = current_usage - last_accounted로 계산해 SQLite에 원자적으로 누적한다. 장시간 실행 중 컨텍스트 윈도우가 여러 번 교체되더라도 목표 수준의 잔여 예산은 하나의 누적 카운터로 유지된다.
예산이 소진되면 상태는 budget_limited가 된다. 이때 모델 응답 스트림에 인라인 스티어링 메시지를 넣어 개발자에게 확인을 요청한다. Goals는 기본값으로 활성화돼 있으며 전용 스토리지가 상태를 뒷받침한다.
각 턴이 끝날 때 Codex는 성공 기준과 현재 결과를 대조해 진행률을 평가한다. 외부 의존성, API 오류, 권한 부족처럼 더 진행할 수 없는 상황을 감지하면 목표를 paused로 바꾸고 개발자에게 알린다.
잠긴 Mac을 다루는 제한된 권한 경로
Locked Computer Use는 Apple Authorization Plug-in을 이용해 임시로 잠금을 해제한다. 범용 원격 잠금 해제 기능이 아니라 Codex만 사용할 수 있는 제한 채널이다. 인증은 현재 Codex 태스크 범위에서만 유효하고, 작업이 끝나면 곧바로 만료된다. 다른 앱이나 로컬 프로세스는 같은 채널에 접근할 수 없다.
Codex Mobile에서 Mac으로 태스크를 보내면 화면이 꺼진 상태에서도 GUI 자동화를 실행할 수 있다. 잠금 해제 중에는 Codex가 연결된 모든 디스플레이를 덮어 화면 내용이 주변에 드러나지 않게 한다. UI 요소와 현재 상태는 macOS Accessibility API와 화면 캡처를 함께 사용해 인식한다.
로컬 키보드나 포인터에서 물리 입력이 감지되면 시스템은 즉시 다시 잠긴다. Mac 앞에 있는 다른 사람이 에이전트가 연 화면을 열람하지 못하도록 하기 위한 동작이다. 앱별로는 사전 허가를 요청하며, 신뢰할 앱을 "Always allow"로 등록할 수 있다.
자동화 범위에도 명시적인 경계가 있다. Terminal 앱, Codex 자체, 시스템 수준 관리자 프롬프트는 자동화할 수 없다. MacBook의 뚜껑이 닫힌 상태에서도 Locked Use는 동작하지 않는다. 출시 시점에는 EEA(유럽경제지역), 영국, 스위스에서 지원되지 않으며 플랫폼도 macOS로 한정된다. Windows와 Linux는 지원 대상이 아니다.
무인 실행을 남기는 감사 기록
에이전트가 사람 없이 앱과 네트워크를 다루려면 실행 결과뿐 아니라 의사결정 과정도 추적할 수 있어야 한다. Codex는 사용자 프롬프트, 툴 승인 결정, 툴 실행 결과, MCP 서버 사용, 네트워크 프록시 허용·거부 이벤트를 OpenTelemetry 형식의 구조화 로그로 내보낸다.
Enterprise·Edu 고객은 OpenAI 컴플라이언스 플랫폼을 통해 불변(immutable)·시간 윈도우 JSONL 로그 파일을 익스포트할 수 있다. 이 기록은 코드 변경 추적, 인증 활동 모니터링, Codex 사용 패턴 분석에 활용된다. 팀 단위 감사나 이슈 조사, 컴플라이언스 요건에 맞춰 선택적으로 활성화하는 구조다.
다른 코딩 에이전트와 갈리는 지점
Goal Mode의 차이는 단순히 작업을 오래 실행하는 데 있지 않다. 목표 상태, 예산, 인터럽트 이후 복원을 세션 외부에서 함께 관리한다는 점이 핵심이다.
| 항목 | Codex Goal Mode | Claude Code | Antigravity 2.0 |
|---|---|---|---|
| 세션 영속 목표 | /goal — SQLite 기반 영속 |
없음 (단발 또는 hook 기반) | 없음 (단발 루프) |
| 예산 독립 관리 | 목표 레벨 별도 예산 슬롯 | 컨텍스트 윈도우 기준 | 컨텍스트 윈도우 기준 |
| 자동 일시정지·재개 | 인터럽트 감지 자동 전환 | 없음 | 없음 |
| 잠금 화면 자동화 | macOS 전용 지원 | 미지원 | 미지원 |
| 코딩 품질(SWE-Bench Pro) | — | 64.3% (Opus 4.7 기준) | 55.1% |
| 토큰 처리 속도 | — | 67 tok/s | 289 tok/s |
| 컨텍스트 윈도우 | — | 200K 토큰 | 1M 토큰 |
Codex Goal Mode의 사용 방식은 "목표를 주고 자리를 떠난다"에 가깝다. 에이전트가 수 시간~수 일 동안 루프를 이어가고 개발자는 결과를 확인한다. Claude Code는 인간이 주 드라이버가 되는 흐름을 유지한다. 편집 과정에서 승인을 요청하고 hook과 서브에이전트 확장을 지원하며, 복잡한 태스크의 고품질 코드 생성에 강점을 둔다.
Gemini CLI의 후속인 Antigravity 2.0은 1M 토큰 컨텍스트와 289 tok/s 처리 속도, 데스크톱·CLI·SDK 통합을 앞세운다. 따라서 장시간 무인 자율 실행은 Codex Goal Mode, 복잡한 태스크의 고품질 생성은 Claude Code, 대규모 컨텍스트의 고속 처리는 Antigravity가 각각 중심에 놓인다.
운영 자동화에 연결할 수 있는 범위
Apple Authorization Plug-in을 사용하면서 에이전트 접근 범위는 기존 Accessibility API에서 시스템 인증 레이어까지 넓어졌다. Codex Mobile은 데스크톱 태스크를 원격 할당하는 오케스트레이터 역할을 하고, 하나의 에이전트 세션이 연결된 모든 디스플레이를 통합 제어한다. "Always allow"에 등록한 신뢰 앱은 반복 자동화 파이프라인에도 포함할 수 있다.
기업 환경에서는 Goal Mode를 개발자의 퇴근 이후 기능 브랜치 개발, 테스트 그린, PR 생성까지 이어지는 야간 CI/CD 작업과 병행할 수 있다. Locked Use로 잠금 화면에서 여러 브라우저와 플랫폼을 대상으로 GUI 앱 E2E 테스트를 실행하는 방식도 가능하다.
장시간 데이터 처리에는 Goal을 설정하고 완료나 오류 알림만 받을 수 있다. 금융·의료처럼 감사 기록이 필요한 환경에서는 OpenTelemetry 로그로 에이전트 행위를 남긴다. 목표 수준의 예산 캡은 실행 비용의 사전 한도를 정해 TCO를 통제하는 수단이 된다.
자율성이 커질수록 넓어지는 신뢰 경계
2026년 컴퓨터 사용 에이전트는 Accessibility API에서 인증 플러그인으로 접근 범위를 넓히고 있다. 다음 단계로 OS 커널 수준의 에이전트 샌드박스까지 통합될 가능성이 예상된다. Goal Mode, Ralph Loop, Jules V2처럼 세션을 넘어 목표를 유지하는 기능도 주요 에이전트의 경쟁 영역이 됐다.
잠금 화면 자동화에서는 단기 인증, 전용 채널, 물리 입력에 따른 자동 재잠금이 보안과 자율성의 균형점으로 수렴할 것으로 예상된다. 목표 구조 역시 단일 에이전트에서 플래너·실행자·검증자가 목표를 공유하는 멀티 에이전트 오케스트레이션으로 확장되는 흐름이다.
반면 에이전트가 OS 인증 레이어에 접근하면 최소 권한 원칙을 적용하기가 더 복잡해진다. EU AI Act와 NIST AI RMF 같은 규제 프레임워크가 에이전트 행위 로그의 불변성을 요구하면서 OpenTelemetry 기반 감사 기록은 사실상 표준으로 자리 잡을 가능성이 있다.
사용자 개입이 줄어들수록 오동작을 뒤늦게 발견할 위험은 커진다. 실시간 블로커 감지와 자동 일시정지가 자율 실행의 부가 기능이 아니라 운영 안전장치가 되는 이유다. macOS 전용인 Locked Use가 Windows, Linux, 모바일로 확대되면 기업 자동화의 적용 범위도 크게 넓어질 전망이다.
SQLite 목표 직렬화, 세션 간 자동 재개, 독립 예산 관리, OS 수준의 잠금 화면 자동화, OpenTelemetry 감사 로그는 Codex를 단발성 코드 생성 도구에서 장시간 실행 인프라로 옮겨 놓았다. 세션 영속 목표 패턴은 Claude Code, Antigravity, Jules 등 경쟁 에이전트에도 나타나고 있으며, 2026년 하반기에는 주요 코딩 에이전트의 기본 기능으로 정착할 것으로 전망된다.
Sources
- OpenAI Codex Goal Mode Reaches General Availability
- Codex Goal Mode & Remote Computer Use: How OpenAI's Agent Can Code for Days
- OpenAI Codex Launches Appshots and Stable Goal Mode
- OpenAI Codex /goal: The New Long-Horizon Mode for Agentic Coding
- OpenAI Just Added /goal to Codex CLI: How It Compares to Claude Code Agents
- OpenAI's Codex Can Now Use Your Mac Even When It's Locked - MacRumors
- Computer Use – Codex app | OpenAI Developers
- OpenAI's Codex is now smart enough to control your Mac even when it's locked | Macworld
- OpenAI Codex Can Now Control Your Mac Even When Locked
- Using Goals in Codex – OpenAI Developers Cookbook
- How OpenAI Codex implements the /goal slash command
- Security – Codex | OpenAI Developers
- Agent approvals & security – Codex | OpenAI Developers
- Agentic Coding in 2026: Claude Code vs Codex CLI vs Gemini CLI vs Cursor Agent
- The Post-Google I/O Coding Agent Landscape
- Antigravity 2.0 vs Claude Code vs Codex CLI: AI Coding Agents Compared