Claude Fable 5와 Mythos 5의 듀얼 트랙 배포 아키텍처
Claude Fable 5와 Mythos 5의 공통 가중치, 안전장치 차등 적용, 에이전틱 코딩·비전·영속 메모리·장문 컨텍스트 설계를 분석한다.
2026-08-14 · 최초 발행 2026-08-02
Anthropic은 2026년 6월 9일 Claude Fable 5와 Claude Mythos 5를 함께 발표했다. 두 모델은 기반 가중치를 공유하지만 접근 대상과 안전장치의 범위가 다르다. Fable 5가 Mythos급 역량을 일반에 제공하는 첫 모델이라면, Mythos 5는 검증된 조직에 한정해 일부 민감 영역의 역량을 개방한다.
이 발표에서 눈여겨볼 부분은 모델 성능만이 아니다. 코딩·비전·메모리·장문 컨텍스트를 강화한 플래그십 모델과 듀얼 트랙 책임 배포 구조가 하나의 설계로 묶였다.
같은 가중치에서 갈라지는 공개·제한 배포
Fable 5와 Mythos 5에는 Opus 위의 최상위 등급인 Mythos 클래스가 적용됐다. 지식 컷오프는 2026년 1월이며, 기본 컨텍스트 윈도우는 1M 토큰, 요청당 최대 출력은 128k 토큰이다.
Fable 5는 Claude API, Amazon Bedrock, Google Vertex AI, Microsoft Foundry, Snowflake Cortex, Databricks에서 일반에 제공된다. Mythos 5는 Project Glasswing에 참여하는 약 150개 승인 기관만 사용할 수 있다.
코딩 에이전트가 장기 작업을 이어가는 방식
Fable 5는 Claude Code의 복잡한 멀티에이전트 세션을 처리하도록 설계됐다. 다일(multi-day) 자율 코딩 세션을 지원하므로 대규모 마이그레이션이나 복잡한 구현처럼 한 번의 응답으로 끝나지 않는 작업을 맡길 수 있다.
코드를 작성한 뒤 자체 테스트 케이스를 생성하고, 실행 결과를 바탕으로 반복 수정한다. 비전 기능으로 구현 결과를 목표 설계와 대조하는 흐름도 포함된다. 적응형 추론(Adaptive Thinking)은 태스크 복잡도에 맞춰 추론 깊이를 동적으로 조정한다. 이런 구성이 반영된 SWE-Bench Pro 점수는 80.3%다.
입력은 텍스트에 한정되지 않는다. PDF와 이미지 안의 차트·표·과학 그림을 읽고, 시각 정보와 구조화 정보에 담긴 의미를 함께 해석한다. CharXiv에서는 93.2%를 기록해 Gemini 3.1 Pro의 80.2%보다 13%p 높았다. 문서·PDF·다이어그램·밀집 테이블이 섞인 프로젝트를 하나의 멀티모달 파이프라인에서 처리하는 구상이다.
세션을 넘겨 작업 상태를 보존하는 메모리
영속 메모리는 세션 사이의 작업 메모를 파일로 유지한다. 장기 세션에서는 컴팩션(Compaction)으로 컨텍스트를 압축·요약하고, 진행 중 남긴 노트를 다음 판단에 반영한다. 외부 도구 사용과 메모리를 결합하면 여러 단계에 걸친 자율 태스크를 이어서 실행할 수 있다.
Anthropic의 Slay the Spire 검증 실험에서는 영속 메모리를 활성화했을 때 Opus 4.8 대비 성능이 3배 향상됐고, 최종 단계 도달률도 3배 증가했다. 수백만 토큰에 걸친 작업에서 컨텍스트를 단순히 늘리는 것과 별개로, 무엇을 기록하고 다시 불러올지 관리하는 메커니즘이 필요하다는 의미다.
안전 분류기가 배포 트랙을 나눈다
Fable 5와 Mythos 5의 차이는 별도의 기반 모델보다 안전 분류기(Safety Classifier)의 활성화 여부와 적용 범위에 있다.
Fable 5는 사이버보안·생물학·화학·증류(distillation) 관련 민감 요청을 차단하거나 Opus 4.8로 폴백한다. 안전장치가 발동하는 세션은 양성 요청의 오발동을 포함해 전체의 5% 미만이다. Mythos 5는 특정 영역의 안전장치를 해제하지만 승인된 파트너에만 제공된다.
사이버보안 지식은 방어와 공격에 함께 쓰일 수 있다. Fable 5는 공격적 사이버보안 쿼리를 차단하거나 폴백으로 처리하고, Mythos 5는 검증된 사이버 방어 기관에 공격 기법 관련 역량을 제한적으로 개방한다. 생물학적 위험 정보에는 가장 엄격한 통제가 적용된다.
Project Glasswing이 맡는 접근 통제와 감시
Project Glasswing의 Mythos 5 참여 범위는 초기 파트너에서 약 150개 신규 기관으로 확대됐다. 대상에는 사이버 보안 기관과 정보보안 전문 기업, 에너지·금융·의료 분야의 핵심 인프라 운영자, 오픈소스 소프트웨어 유지관리자, 미국 정부 협력 기관이 포함된다. 바이오의학 연구기관의 참여도 추가될 예정이다.
Mythos급 트래픽은 안전 조사와 모니터링을 위해 30일 동안 보존된다. 승인 기관의 사용 패턴도 지속적으로 관찰해 오남용을 탐지한다. 한편 미국 정부 지시에 따른 서비스 차단 우려가 제기되는 상황에서, 정부와 조율하는 협력 거버넌스 체계도 운영된다.
전체 배포 결정은 Responsible Scaling Policy에 따른 역량 평가, ASL(AI Safety Level) 등급 판정, 공개 또는 제한 배포 선택으로 이어진다.
코딩·비전·지식업무 벤치마크
에이전틱 코딩을 평가하는 SWE-Bench Pro에서 Fable 5는 80.3%를 기록했다.
| 모델 | SWE-Bench Pro |
|---|---|
| Claude Fable 5 | 80.3% |
| Claude Opus 4.8 | 69.2% |
| GPT-5.5 | 58.6% |
| Gemini 3.1 Pro | 54.2% |
GPT-5.5와의 차이는 21.7%p로, 단일 벤치마크 격차로는 프런티어 역사상 최대 수준이다. 자율 멀티파일 편집 과정에서 테스트를 자동으로 생성·실행하고 결과에 따라 코드를 수정할 수 있다. Claude Code 내부 엔지니어의 실제 워크플로우를 토대로 최적화한 점도 이 결과와 연결된다.
멀티모달 평가에서는 과학 논문의 복잡한 시각 자료와 중첩 PDF·테이블·다이어그램 처리 능력이 두드러진다.
| 모델 | CharXiv | 멀티모달 종합 |
|---|---|---|
| Claude Fable 5 | 93.2% | 92.4 |
| Gemini 3.1 Pro | 80.2% | 82.8 |
법률 문서 분석과 복잡한 공간 추론을 포함하는 지식업무 평가에서는 GDPval-AA 1932를 기록했다. 도구 호출 정확도 역시 최상위 수준이다.
| 모델 | GDPval-AA |
|---|---|
| Claude Fable 5 | 1932 |
| GPT-5.5 | 1769 |
| Gemini 3.1 Pro | 1314 |
성능과 비용 사이에서 모델을 고르는 기준
2026년 6월 프런티어 종합 집계는 Fable 5가 97점, Gemini 3.1 Pro가 91점으로 이례적으로 큰 격차를 보였다. Fable 5는 SWE-Bench Pro 80.3%로 GPT-5.5의 58.6%를 앞섰고, CharXiv 93.2%는 Gemini 3.1 Pro의 80.2%보다 높았다. GDPval-AA 역시 Fable 5가 1932, Gemini 3.1 Pro가 1314였다.
가격에서는 경쟁 모델이 유리하다. GPT-5.5는 $5/$30, Gemini 3.1 Pro는 $2/$12이며 Gemini 3.1 Pro가 가장 저렴하다. Fable 5는 최고 수준의 벤치마크 성능, 1M+ 토큰 컨텍스트, 에이전틱 코딩이 우선일 때 선택할 수 있다. 토큰 비용이나 지연 시간, 토큰 소비를 줄이는 일이 우선이라면 다른 모델이 대안이 된다.
컨텍스트와 도구 사용 사양
| 항목 | 사양 |
|---|---|
| 컨텍스트 윈도우 | 1M 토큰 (기본) |
| 최대 출력 | 128k 토큰 / 요청 |
| 지식 컷오프 | 2026년 1월 |
| 입력 캐싱 할인 | 기존 90% 캐시 할인 적용 |
| 비전 지원 | PDF·이미지·차트·표·다이어그램 |
| 도구 사용 | 지원 (Tool Use) |
| 메모리 | 지원 (파일 기반 영속 메모리) |
| 컴팩션 | 지원 (장기 세션 컨텍스트 압축) |
| 적응형 추론 | 지원 (Adaptive Thinking) |
Fable 5의 가격은 백만 토큰 기준 입력 $10, 출력 $50이다. 2026년 6월 9일부터 22일까지 Pro·Max·Team·Enterprise 요금제에서 추가 비용 없이 제공되며, 이후에는 사용량 크레딧(Usage Credits) 방식으로 전환된다.
제공 플랫폼은 다음과 같다.
- Claude API
- Claude Platform on AWS
- Amazon Bedrock
- Google Vertex AI
- Microsoft Azure Foundry
- Snowflake Cortex AI
- Databricks의 Unity AI Gateway 통합
엔터프라이즈 AI 설계에 남기는 선택지
1M 토큰 컨텍스트는 법률·의료·금융 분야의 대용량 문서를 일괄 처리하는 시스템에 적용할 수 있다. PDF·이미지·텍스트가 혼합된 데이터는 단일 멀티모달 파이프라인으로 구성할 수 있고, 멀티에이전트 오케스트레이션에서는 핵심 추론 엔진 역할을 맡길 수 있다.
장문 컨텍스트와 영속 메모리의 조합은 기존 RAG의 한계를 보완하는 설계 대안이 된다. 다만 긴 입력 자체와 세션 간 작업 상태 관리는 서로 다른 문제이므로, 검색 구조와 메모리 구조를 함께 검토해야 한다.
듀얼 트랙 배포는 기업 내부의 AI 접근 권한을 계층화하는 참조 모델로도 읽힌다. ASL 등급을 토대로 배포 수준을 결정하는 구조는 정보시스템 리스크 관리 체계와 맞닿아 있으며, 사이버 방어의 듀얼유즈 역량은 보안 AI 시스템을 설계할 때 별도의 통제 대상으로 다뤄야 한다.
SWE-Bench 80.3%는 소프트웨어 엔지니어링 자동화가 실무 보조에서 자율 실행으로 전환되는 흐름을 보여준다. 이때 운영자는 모델의 작업 능력뿐 아니라 테스트 생성, 결과 검증, 폴백, 장기 세션 메모리까지 하나의 실행 경로로 설계해야 한다.
공개 범위와 거버넌스가 향할 곳
Fable 5가 성공적으로 운영되면 Mythos 5의 공개 범위도 점진적으로 넓어질 것으로 예상된다. Project Glasswing은 바이오의학 연구기관을 대상으로 한 접근 프로그램을 예고했다.
듀얼 트랙 배포 모델은 프런티어 LLM의 표준 거버넌스 방식으로 논의될 가능성이 있다. 클라우드 보안 얼라이언스 등에서는 포스트-Mythos 라이선싱과 공시 프레임워크를 논의 중이다. 동시에 미국 정부 지시와 연계된 서비스 차단 우려는 지정학적 AI 거버넌스 위험이 실제 운영 문제로 이어질 수 있음을 보여준다.
주요 클라우드가 모두 Fable 5를 지원하면서 벤더 중립적인 AI 인프라 전략도 현실적인 선택지가 됐다. 반면 GPT-5.5와 Gemini 3.1 Pro보다 높은 단가는 성능과 비용을 함께 평가해야 한다는 과제를 남긴다.
동일 가중치에 서로 다른 통제 수준을 적용한 Fable 5와 Mythos 5는 프런티어 모델의 책임 배포를 접근 권한, 폴백, 데이터 보존, 지속 모니터링의 문제로 확장했다. 영속 메모리와 1M 토큰 장문 컨텍스트, 이원 배포 전략은 2026년 하반기 엔터프라이즈 AI 아키텍처의 주요 축이 될 것으로 전망된다.
Sources
- Claude Fable 5 and Claude Mythos 5 — Anthropic
- Introducing Claude Fable 5 and Claude Mythos 5 — Claude API Docs
- Anthropic releases Claude Fable 5 and Mythos 5 — The Decoder
- Anthropic's Claude Fable 5 is a version of Mythos the public can access — TechCrunch
- Claude Fable 5 Benchmarks — BenchLM.ai
- Claude Fable 5 vs GPT-5.5 vs Gemini 3.1 Pro — Eden AI
- Anthropic Claude Fable 5 on AWS — Amazon Web Services
- Anthropic shares Mythos with 150 more organizations — Cybersecurity Dive
- Claude Fable 5 available in Microsoft Foundry — Azure Blog
- Post-Mythos AI Model Regulation — Cloud Security Alliance Labs