Claude Mythos 5, 10조 파라미터가 데려온 제한적 프리뷰 시대
Anthropic이 공식 확인한 10조 파라미터 모델 Claude Mythos 5의 벤치마크 성과와 Project Glasswing 제한적 배포 전략, 사이버보안 영역에서의 파괴적 역량을 정리한다
2026-08-14 · 최초 발행 2026-04-11
Anthropic이 10조(10 trillion) 파라미터 규모의 대규모 언어 모델 Claude Mythos 5를 공개했다. 2026년 3월 말 내부 블로그 초안이 공개 접근 가능한 스토리지에 노출되면서 존재가 알려졌으며, 이후 Anthropic이 공식 확인과 함께 제한적 프리뷰 프로그램을 발표했다. Opus 4.6 대비 수학 증명 분야에서 55포인트 향상을 기록하는 등 전례 없는 벤치마크 성과를 보여주고 있다.
유출에서 공식 확인까지
Claude Mythos 5는 Anthropic의 모델 라인업에서 Opus 위에 새롭게 추가된 Capybara 티어에 해당하는 최상위 모델이다. 파라미터 수를 10조 규모로 확장함으로써 대규모 모델에서의 성능 향상이 여전히 유효함을 입증하는 스케일링 법칙의 검증이 출발점이었다. 2026년 3월 26일 CMS(콘텐츠 관리 시스템) 설정 오류로 약 3,000건의 내부 자산이 외부에 노출됐고, 이 중 Mythos 관련 내부 블로그 초안이 포함되면서 존재가 먼저 알려졌다. Anthropic은 모델의 존재를 확인하고, 안전한 배포를 위한 제한적 접근 프로그램인 Project Glasswing을 발표하는 것으로 대응했다.
10조 파라미터를 감당하는 인프라
10조 파라미터는 기존 최대 모델 대비 수배에 달하는 규모이며, 학습과 서빙 모두에서 근본적인 인프라 혁신이 요구된다. Anthropic 라인업에서 기존 Haiku < Sonnet < Opus 위에 Capybara 티어가 새로 신설됐고, 대규모 분산 학습을 위해 멀티 칩 클러스터를 활용했다. AWS Trainium, Google TPU, NVIDIA GPU의 이기종 컴퓨팅 자원 조합으로 추정되며, 실시간 추론을 위해서는 모델 병렬화, KV 캐시 압축, 양자화 등 다층적 최적화 기법이 적용됐다.
| 구분 | Claude Opus 4.6 | Claude Mythos 5 |
|---|---|---|
| 모델 티어 | Opus | Capybara |
| 파라미터 규모 | 비공개 | 10조(10T) |
| SWE-bench Verified | 약 72% | 93.9% |
| GPQA Diamond | 약 80% | 94.5% |
| 배포 상태 | 일반 공개 | 제한적 프리뷰 |
벤치마크가 보여주는 격차
Claude Mythos 5는 Anthropic이 측정한 18개 벤치마크 중 17개에서 최고 성적을 기록했다. 코딩·소프트웨어 엔지니어링에서는 SWE-bench Verified 93.9%(역대 최고 기록), SWE-bench Pro 77.8%(GPT-5.4의 57.7%, Gemini 3.1 Pro의 54.2% 대비 20포인트 이상 리드), Terminal-Bench 2.0 82%(GPT-5.4 75.1%, Gemini 3.1 Pro 68.5%)를 기록했다. 과학·수학적 추론에서는 GPQA Diamond 94.5%(Gemini 3.1 Pro 94.3%, GPT-5.4 92.8%), 수학 증명 분야에서는 Opus 4.6 대비 55포인트 향상을 보였다. 텍스트·이미지·코드를 아우르는 통합 추론 능력에서도 기존 모델 대비 현저한 향상을 보였다는 것이 멀티모달 역량 평가다.
Project Glasswing, 왜 일반 공개하지 않았나
Anthropic은 Mythos 5를 일반에 공개하지 않고 Project Glasswing이라는 제한적 프리뷰 프로그램으로 배포한다. AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Microsoft, NVIDIA 등 약 50개 핵심 인프라 기관에 한해 접근을 허용하며, 용도는 취약점 탐지·패치 개발·보안 감사 등 방어적 보안 작업에 한정한다. Anthropic은 최대 1억 달러 규모의 사용 크레딧을 제공하고, 오픈소스 보안 조직에 400만 달러를 직접 기부했다. 새로운 안전장치가 마련될 때까지 일반 공개 계획은 없으며, Mythos급 모델의 안전한 대규모 배포를 위한 기술적·제도적 프레임워크를 개발 중이라고 밝혔다.
이 배포 전략은 "방어자가 먼저 무장해야 한다"는 Anthropic의 AI 안전 철학을 반영한다. 유사한 역량의 모델이 다른 기업에서도 개발될 것을 예상하고, 방어 역량을 선제적으로 구축하는 접근이다.
사이버보안에서 드러난 양날의 칼
Mythos 5가 가장 주목받는 영역은 사이버보안이다. 27년간 발견되지 않았던 OpenBSD의 취약점을 자율적으로 식별하고 익스플로잇했는데, 인간 연구자와 자동화 스캐너가 모두 놓친 버그였다. 주요 운영체제와 웹 브라우저 전반에서 수천 건의 고위험 제로데이 취약점을 식별했고, NFS를 실행하는 FreeBSD 머신에서는 17년 된 원격 코드 실행 취약점을 완전 자율적으로 발견하고 익스플로잇했다. 방어에 활용하면 보안 역량의 극적 향상이 가능하나, 공격에 악용될 경우 심각한 위협이 될 수 있다는 양면성이 제한적 배포 결정의 핵심 근거다.
Claude Mythos 5는 10조 파라미터라는 전례 없는 규모와 압도적 벤치마크 성적으로 프론티어 AI의 새로운 기준을 제시했다. 특히 사이버보안 분야에서 수십 년간 발견되지 않은 취약점을 자율적으로 식별하는 역량은 AI 안전 논의의 긴급성을 한층 높였다. Anthropic이 Project Glasswing을 통해 방어적 보안에 한정해 제한적으로 배포하는 전략은, AI 역량의 급속한 발전 속에서 책임 있는 배포의 한 모델을 보여준다.
Sources
- Claude Mythos 5: The First 10-Trillion-Parameter Model - Medium
- Claude Mythos 5 Review - BuildFastWithAI
- Claude Mythos Preview Beats Gemini 3.1 Pro, GPT 5.4 - OfficeChai
- Anthropic Claude Mythos - Project Glasswing - Fortune
- Project Glasswing - Simon Willison
- Claude Mythos Preview: Benchmarks, Pricing - LLM Stats
- Anthropic's Claude Mythos Finds Thousands of Zero-Day Flaws - The Hacker News