Claude Fable 5와 Mythos 5의 듀얼 트랙 배포 구조

Claude Fable 5의 코딩·비전·영속 메모리·장문맥 성능과 Mythos 5의 제한 배포, Project Glasswing 안전 전략을 분석한다.

2026-08-14 · 최초 발행 2026-08-02

2026년 6월 9일 Anthropic은 Claude Fable 5를 공개하며 Mythos급 역량을 일반 사용자에게 처음 제공했다. 같은 날 안전장치 구성이 다른 Claude Mythos 5는 승인된 파트너에게만 제한적으로 배포했다. 하나의 기반 가중치에 서로 다른 안전 레이어를 적용한 이 구조는 프런티어 모델의 역량과 접근 범위를 분리하는 시도다.

Fable 5가 공개한 모델 사양

Claude Fable 5는 Claude Opus 4.8보다 코딩, 지식 작업, 비전, 과학 연구, 장기 에이전틱 태스크 전반에서 10% 이상의 성능 향상을 달성했다. Anthropic은 파라미터 수와 학습 컴퓨팅 규모를 공개하지 않았지만, 공개된 사양과 성능 프로파일은 이전 세대와 다른 변화를 보여준다.

기본 컨텍스트 윈도우는 단일 세션에서 100만 토큰이며 최대 출력은 128,000토큰이다. 학습 데이터 컷오프는 2026년 1월이다. API 모델명은 claude-fable-5-20260609이고, 가격은 입력 100만 토큰당 $10, 출력 100만 토큰당 $50다.

사이버보안, 생물학, 화학, 모델 증류(distillation) 관련 요청은 안전 분류기가 감지한다. 분류기가 고위험 요청으로 판단하면 Claude Opus 4.8로 세션을 이관하며, Anthropic에 따르면 이 동작은 전체 세션의 5% 미만에서 트리거된다.

일반 요청 (95%+)고위험 요청 (<5%)사용자 요청안전 분류기(Safety Classifier)Claude Fable 5(Mythos 가중치)Claude Opus 4.8(폴백 처리)에이전틱 코딩에이전트비전 추론파이프라인영속 메모리레이어장문맥분석 엔진결과 출력

코딩 벤치마크에서 벌어진 격차

2026년 6월 기준 공개된 주요 벤치마크에서는 Fable 5가 전반적으로 앞선다.

벤치마크 Fable 5 GPT-5.5 Gemini 3.1 Pro Grok 4
SWE-Bench Pro 80.3% 58.6% 54.2% ~75%
FrontierCode Diamond 29.3% 5.7%
Humanity's Last Exam (도구 포함) 64.5%
OSWorld-Verified 1위
Terminal-Bench 2.1 1위

SWE-Bench Pro에서는 GPT-5.5보다 21.7포인트 높은 결과를 기록했다. FrontierCode Diamond의 차이는 29.3% 대 5.7%다. 원본 평가는 이 결과를 코딩 복잡도가 높아질수록 Fable 5의 우위가 지수적으로 확대되는 신호로 해석한다.

저장소를 오래 다루는 코딩 에이전트

Fable 5의 코딩 기능은 코드 완성보다 장기간 이어지는 엔지니어링 작업에 초점을 둔다. 100만 토큰 컨텍스트로 전체 Windows 저장소를 단일 세션에서 분석한 실제 사용 사례에서는 컴포넌트 간 통합 버그가 40% 감소한 것으로 보고됐다.

구현 과정에서는 테스트 스위트를 함께 생성할 수 있다. 비전 기능으로 렌더링 결과와 원본 설계 목표를 비교하는 시각적 검증도 수행한다. task budget(베타)은 토큰을 인식한 계획 수립에 사용되며, 컨텍스트 편집 기능은 장기 루프에서 누적된 도구 결과를 정리한다.

이 기능들을 결합하면 이전 세션의 설계 노트를 불러오고, 저장소를 분석한 뒤, 구현과 테스트 및 시각 검증을 거쳐 진행 상태를 다시 저장하는 흐름이 만들어진다.

"테스트 실행기""비전 모듈""메모리 레이어""Fable 5 에이전트""사용자""테스트 실행기""비전 모듈""메모리 레이어""Fable 5 에이전트""사용자""(1) 코드베이스 마이그레이션 요청""(2) 이전 세션 컨텍스트 로드""저장된 설계 노트 반환""(3) 전체 저장소 분석 (1M 토큰)""(4) 마이그레이션 계획 수립 (task budget)""(5) 코드 구현 + 테스트 자동 생성""테스트 결과 반환""(6) 출력물 시각 검증""설계 일치 여부 확인""(7) 진행 상태 저장 (세션 간 영속)""(8) 완료 보고 + 검증 결과"

코드와 시각 정보를 한 루프에서 검증한다

Anthropic은 Fable 5를 자사의 역대 최강 비전 모델로 표현했다. 과학 논문의 실험 그래프, 분자 구조 다이어그램, 통계 플롯에서 정밀한 수치 정보를 추출하는 능력이 연구자들의 주목을 받고 있다.

개발 작업에서는 UI 컴포넌트를 구현한 뒤 디자인 목업 이미지와 렌더링 결과를 비교하는 시각적 QA 루프를 에이전트가 자체 실행한다. 복잡한 레이아웃의 PDF, 스프레드시트 스크린샷, 핸드라이팅 노트에서 구조화된 정보를 추출하는 문서 이해 능력도 이전 세대보다 대폭 향상됐다.

세션 경계를 넘는 메모리

Fable 5는 메모리 도구를 네이티브로 지원한다. 장기 프로젝트를 수행하는 에이전트가 스스로 노트를 만들고 다음 세션에서 이를 불러와 작업을 이어갈 수 있다. 며칠 동안 계속되는 대규모 소프트웨어 개발 태스크를 염두에 둔 구조다.

장문맥 처리에서는 수백만 토큰에 걸쳐 집중력을 유지하면서 전체 코드베이스나 법률 문서 전문을 분석하는 능력이 실제 엔터프라이즈 사용 사례에서 검증됐다. 장기 루프가 이어질 때는 컨텍스트 편집 기능이 누적된 도구 결과를 자동 정리해 컨텍스트 창의 포화를 관리한다.

노트 저장노트 저장노트 저장컨텍스트 로드컨텍스트 로드컨텍스트 로드세션 1(Day 1)메모리스토어세션 2(Day 2)세션 3(Day 3)세션 N(장기 프로젝트)최종결과물

같은 가중치에 다른 안전장치를 얹다

Claude Fable 5와 Claude Mythos 5는 동일한 기반 가중치(underlying weights)를 공유한다. 모델 자체를 나눈 것이 아니라 안전 분류기 레이어를 다르게 구성했다.

구분 Fable 5 Mythos 5
대상 일반 사용자 전체 승인된 파트너 한정
사이버보안 요청 Opus 4.8로 이관 제한적 허용
생물학·화학 차단 연구 목적 허용
제로데이 취약점 발견 불가 방어 목적 허용
접근 경로 Claude.ai, API Project Glasswing

이 방식은 프런티어 모델 책임 배포 프레임워크(Responsible Deployment Framework)를 실제 제품에 적용한 사례다. 같은 역량을 안전장치 수준에 따라 차등 제공해 위험 관리와 연구 활용을 함께 다룬다.

출시 5일 전인 6월 4일 Anthropic은 “When AI builds itself” 논문에서 프런티어 AI 개발 속도를 전 지구적으로 조절해야 한다고 주장했다. 가장 강력한 공개 AI 모델을 내놓는 동시에 안전 경고를 제기한 셈이다. 이 긴장은 현재 프런티어 연구소들이 마주한 구조적 딜레마를 드러낸다.

Mythos 5가 들어가는 Project Glasswing

Mythos 5의 제한 배포 경로인 Project Glasswing은 Anthropic이 2026년 4월 출범시킨 $1억 규모의 방어적 사이버보안 이니셔티브다. AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks 등 총 11개 주요 기술 기업과 미국 정부 파트너가 참여한다.

2026년 5월 기준 Glasswing 파트너들은 Claude Mythos Preview를 이용해 세계 주요 소프트웨어 인프라에서 10,000건 이상의 고위험·치명적 취약점을 발견했다. 이 가운데 일부 결함은 20년 이상 존재한 것으로 밝혀졌다.

Mythos Preview는 방향 지시를 받으면 모든 주요 운영체제와 주요 웹 브라우저에서 제로데이 취약점을 찾고 익스플로잇을 자율적으로 생성하는 능력을 시연했다. 정찰과 취약점 발견, 래터럴 무브먼트, 익스플로잇 개발을 전체 공격 생명주기에서 연결하는 에이전틱 해킹 역량도 확인됐다.

성과 검증일반 배포Project Glasswing($1억 이니셔티브)파트너 기관(AWS·Apple·Google·Microsoft 11개)미국 정부 파트너Mythos Preview취약점 스캔10,000+ 취약점발견 (고위험/치명적)CVE 공개패치 적용인프라 보안강화Mythos 5정식 출시Fable 5(안전장치 적용)

경쟁 모델보다 비싼 가격을 어떻게 볼 것인가

프런티어 모델의 출시 순서는 Gemini 3.1 Pro가 2026년 2월 19일, GPT-5.5가 2026년 4월 23일, Claude Fable 5가 2026년 6월 9일이다.

모델 입력($/1M) 출력($/1M)
Gemini 3.1 Pro $2 $12
GPT-5.5 $5 $30
Claude Opus 4.8 $5 $25
Claude Fable 5 $10 $50

Fable 5는 표에 포함된 모델 가운데 가장 비싸다. 다만 코딩 품질과 장문맥 정확도를 기준으로 2026년 6월 현재 프런티어의 단독 선두 모델로 평가받는다. 에이전틱 코딩, 환각(hallucination) 감소, 비전 추론에서도 경쟁 모델보다 명확한 우위를 보인다는 평가다.

엔터프라이즈 환경에서는 에이전틱 코딩 태스크의 완성도가 재작업 비용에 영향을 준다. 이 관점에서 SWE-Bench Pro의 80.3% 대 58.6%, 즉 21.7포인트 차이가 주는 실질 가치는 단순 토큰 가격 차이인 2배를 상회할 수 있다.

Fable 5와 Mythos 5의 동시 출시는 모델 업그레이드뿐 아니라 단일 모델에 차등 안전장치를 적용하는 배포 방식을 현실화했다. 코딩·비전·메모리·장문맥의 동시 강화는 장기 자율 에이전트의 기술 기준을 바꿨고, Project Glasswing은 고위험 AI 역량을 방어 목적으로 제한 활용하는 거버넌스 사례를 만들었다. 안전 경고와 강력한 모델 공개가 공존하는 긴장 관계는 2026년 하반기 AI 거버넌스 논의의 핵심 의제로 이어질 전망이다.

Sources

Claude Fable 5Claude Mythos 5에이전틱 코딩장문맥 LLMAI 안전