Anthropic Claude Mythos 데이터 유출: 미공개 모델 유출 사고의 전말과 시사점
Anthropic의 CMS 설정 오류로 미공개 모델 'Claude Mythos' 정보가 유출된 사고의 경위, 기술적 원인, 이중 사용 위험 논란과 AI 기업 보안 관리의 구조적 문제를 정리한다.
2026-08-14 · 최초 발행 2026-03-27
2026년 3월 27일, AI 업계에 예상치 못한 뉴스가 터져 나왔다. Anthropic의 콘텐츠 관리 시스템(CMS) 설정 오류로 인해 아직 공개되지 않은 차세대 AI 모델 'Claude Mythos'의 상세 정보가 인터넷에 노출된 것이다. 이 사건은 단순한 기업의 실수를 넘어, AI 기업들이 고도화된 모델을 개발하는 과정에서 직면하는 보안 관리의 취약점을 적나라하게 드러냈다. 특히 유출된 정보에는 사이버보안 분야에서 전례 없는 수준의 성능을 보인다는 내용이 포함되어 있어, AI 안전성과 이중 사용 위험(dual-use risk)에 대한 논쟁에 새로운 불을 지폈다.
CMS 설정 오류가 만든 노출
이번 사건의 기술적 원인은 CMS의 기본 설정 오류였다. Anthropic이 사용하는 콘텐츠 관리 시스템이 업로드된 파일을 자동으로 공개 상태로 설정하도록 잘못 구성되어 있었고, 그 결과 아직 공개되지 않은 내부 문서들이 암호화되지 않은 공개 검색 가능한 데이터베이스에 저장되었다. Anthropic 측은 이를 "인적 오류(human error)"로 규정했으며, 노출된 자료는 "발표를 검토하기 위한 초기 초안"이었다고 해명했다.
문제는 이 초안에 담긴 내용의 민감도였다. 단순한 마케팅 자료가 아닌, Anthropic이 내부적으로 진행 중이던 가장 중요한 AI 모델 개발 정보가 고스란히 담겨 있었던 것이다.
유출 문서가 말하는 Claude Mythos
유출된 문서에 따르면, Claude Mythos는 기존 Anthropic 모델 라인업에서 Opus 시리즈를 능가하는 새로운 최상위 계층의 모델이다. 유출된 초안에는 "Capybara(카피바라)"라는 코드명도 등장하는데, 이는 새로운 모델 계층의 명칭으로, Opus보다 더 크고 지능적인 모델을 의미한다고 서술되어 있다.
Anthropic 대변인은 이 모델이 "AI 성능에서 단계적 변화(step change)를 대표하며, 현재까지 구축한 가장 유능한 모델"이라고 확인했다. 유출된 벤치마크 결과에 따르면 Claude Mythos는 Claude Opus 4.6 대비 복잡한 코드 작성·디버깅·리팩토링 능력이 대폭 향상된 소프트웨어 프로그래밍, 수학·과학·논리적 추론 등 다양한 학문 분야의 심층 분석 능력을 갖춘 학술적 추론, 기존 모든 AI 모델을 압도하는 수준의 취약점 분석·공격 표면 평가 능력을 보이는 사이버보안 영역에서 현저히 높은 점수를 기록했다. 특히 사이버보안 영역에서의 성능은 "기존 모든 AI 모델의 성능을 훨씬 능가한다"고 기술되어 있어, 업계 전문가들 사이에서 큰 주목을 받았다.
아래는 Claude Mythos 유출 사건의 전체 흐름을 정리한 다이어그램이다.
Claude Mythos 문서만이 아니었다
이번 유출 사건에서 노출된 자료는 Claude Mythos 관련 초안에 국한되지 않았다. 약 3,000개에 달하는 미공개 자산들이 포함되어 있었다.
Claude Mythos 관련 문서로는 모델의 성능 벤치마크 초안, 출시 계획 및 접근 전략, 사이버보안 위험 평가 내용이 있었다. 유럽 CEO 이그제큐티브 서밋 관련 문서도 있었는데, 영국 시골 지역의 18세기 영국식 장원(manor)을 개조한 호텔 겸 스파에서 개최 예정인 비공개 초청 이틀짜리 리트릿 행사 정보, 유럽 기업 CEO를 대상으로 한 "친밀한 모임(intimate gathering)"으로 기술된 내용, Dario Amodei CEO가 참석하며 입법자·정책 입안자들과의 대화와 미공개 Claude 기능 체험 세션이 포함될 예정이라는 내용, AI 도입 방식에 관한 "사려 깊은 대화(thoughtful conversation)"를 목적으로 기획됐다는 내용이 담겨 있었다.
이처럼 유출된 정보에는 기업의 핵심 기술 정보뿐 아니라 고위 임원 일정, 비공개 행사 정보 등 민감한 영업·전략적 내용이 포함되어 있었다.
보안 연구자들이 우연히 찾아낸 것
이 유출 사건은 두 명의 독립적인 보안 연구자에 의해 각각 발견되었다. 영국 케임브리지 대학 사이버보안 연구자 Alexandre Pauwels와 LayerX Security의 시니어 AI 보안 연구자 Roy Paz다.
이들은 서로 독립적으로 공개 검색 가능한 데이터베이스에서 Anthropic의 내부 문서들을 발견하고, Fortune 지에 제보했다. Fortune은 2026년 3월 26일(현지시각) 단독 기사를 통해 최초로 이 사건을 보도했다.
Anthropic 측의 대응은 신속했다. 보도 직후 CMS 설정을 수정하여 해당 데이터베이스를 비공개로 전환했고, 공식 성명을 통해 "인적 오류"임을 인정했다. 회사는 노출된 자료가 "발표를 검토하기 위한 초기 초안"이었다고 밝히면서, 실제 운영 중인 모델 데이터나 사용자 정보는 포함되지 않았음을 강조했다.
사이버보안 역량을 둘러싼 양날의 검 논란
이번 유출에서 가장 민감한 내용 중 하나는 Claude Mythos의 사이버보안 역량에 관한 것이었다. 유출된 초안은 이 모델이 "전례 없는 사이버보안 위험(unprecedented cybersecurity risks)"을 내포한다고 명시하고 있었다.
Claude Mythos의 사이버보안 능력은 양날의 검으로 묘사되었다. 방어적 측면에서는 취약점을 신속하게 식별하고 공격 표면을 평가하는 능력을 제공하고, 보안팀에게 전례 없는 수준의 도구를 제공하며, 복잡한 보안 코드 분석 및 패치 개발을 가속화한다. 공격적 측면에서는 동일한 능력이 악의적으로 활용될 경우 취약점 악용 속도가 방어자의 노력을 "훨씬 능가"할 수 있고, 기존 사이버보안 AI 모델 전체를 압도하는 성능이 AI 기반 사이버 공격의 새로운 지평을 열 가능성이 있다.
이 이중 사용 위험(dual-use risk) 문제는 AI 안전 연구자들 사이에서 오래전부터 논의되어 온 주제이지만, 실제로 이 정도 수준의 성능을 보이는 모델의 존재가 공개적으로 확인된 것은 이번이 처음이다. Analytics Insight는 이 사건을 "Claude Mythos 유출이 AI 기반 사이버 위협에 대한 경보를 촉발"했다고 보도했다.
제한적 조기 접근으로 조정된 출시 전략
Anthropic은 Claude Mythos의 뛰어난 역량과 높은 운영 비용, 그리고 잠재적 위험성을 감안하여 일반에 공개하지 않는 신중한 출시 전략을 채택했다. 대신 소수의 조기 접근 고객을 대상으로 먼저 제공하되, 사이버보안 방어 분야에 초점을 맞출 것이라고 밝혔다.
이는 Anthropic의 기존 AI 안전 철학과 일맥상통하는 전략이다. 위험 가능성이 높은 첨단 AI 모델을 즉시 공개하기보다는, 통제된 환경에서 제한적으로 운용하며 안전성을 검증하는 접근 방식이다. The-Decoder는 이를 두고 "Anthropic이 데이터 유출 이후 단계적 변화를 나타내는 유출 모델이 추론에서 '단계적 도약'임을 확인한다"고 평가했다.
왜 이런 일이 가능했는가
이번 사건의 기술적 원인을 좀 더 깊이 살펴보면, CMS 구성 관리의 문제점이 여실히 드러난다.
소프트웨어 및 시스템 설계에서 "최소 권한 원칙(Principle of Least Privilege)"과 "기본값 보안(Security by Default)"은 핵심 보안 원칙이다. 파일 업로드 시 기본값이 "공개"로 설정되어 있었다는 것 자체가 이 원칙의 위반이다. 올바른 기본값은 "비공개"이어야 하며, 의도적인 공개 설정이 있을 때만 외부에 노출되어야 한다.
3,000개에 달하는 자산이 외부에서 검색 가능한 상태로 노출되어 있었다는 것은, 해당 데이터 저장소에 대한 주기적인 접근 제어 감사(Access Control Audit)가 이루어지지 않았음을 시사한다.
기밀 수준이 다른 자료들(미공개 AI 모델 정보, CEO 행사 정보, 일반 마케팅 초안 등)이 동일한 저장소에 혼재되어 있었던 것으로 보인다. 기업 내 콘텐츠 분류 체계(Content Classification System)가 적절히 갖춰져 있었다면, 고위 기밀 자료는 별도의 보안 저장소에 격리 보관되었을 것이다.
AI 기업 보안 관리가 안고 있는 구조적 문제
이번 Anthropic 사건은 빠르게 성장하는 AI 기업들이 공통적으로 직면하는 구조적 보안 문제를 드러낸다.
AI 업계는 현재 극도로 빠른 경쟁 환경에 놓여 있다. OpenAI, Google DeepMind, Meta, Mistral 등 수많은 경쟁자들이 앞다퉈 신규 모델을 출시하는 상황에서, Anthropic 역시 개발 속도를 최우선으로 삼을 수밖에 없다. 이 과정에서 보안 프로세스가 충분히 내재화되지 못한 채 운용되는 경우가 발생한다.
첨단 AI 모델 개발에는 연구자, 엔지니어, 마케터, 경영진 등 수많은 이해관계자가 관여한다. 이들 간의 협업을 위한 CMS와 같은 도구가 필수적이지만, 동시에 보안 취약점이 되기도 한다. 특히 "초안" 단계의 문서들은 최종 검토 전이라 보안 레이블링이 미흡할 수 있다.
AI 기업들은 AI 모델의 안전성을 확보하는 동시에, 회사 자체의 운영 보안(Operational Security)도 철저히 관리해야 한다. Claude Mythos가 사이버보안 분야에서 "전례 없는 위험"을 내포한다고 자체 평가하면서도, 정작 그 모델에 대한 기밀 정보가 공개 데이터베이스에 노출되는 아이러니가 발생한 것이다.
이번 사건이 AI 업계 전반에 주는 교훈은 명확하다. 첨단 AI 모델의 기밀 정보는 일반 마케팅 자료보다 훨씬 엄격한 보안 통제 하에 관리되어야 하고, CMS 등 협업 도구의 기본 보안 설정을 반드시 "최소 권한" 원칙에 맞게 구성해야 하며, 주기적인 접근 제어 감사와 데이터 분류 체계가 갖춰져야 하고, 유출 사고 발생 시 신속한 대응과 투명한 커뮤니케이션이 신뢰 회복의 핵심이다.
Anthropic의 Claude Mythos 데이터 유출 사건은 여러 층위에서 중요한 의미를 지닌다. 표면적으로는 한 기업의 CMS 설정 오류라는 인적 실수이지만, 그 이면에는 AI 업계 전반의 구조적 보안 과제와, 첨단 AI 모델이 가져오는 이중 사용 위험이라는 본질적 문제가 담겨 있다. Claude Mythos가 사이버보안 분야에서 "전례 없는 위험"을 내포한다는 자체 평가는 Anthropic이 AI 안전에 대해 진지하게 고민하고 있음을 보여주는 동시에, 이 정보가 부주의한 설정 오류로 인해 외부에 노출되었다는 사실은 AI 안전 연구와 운영 보안이 별개의 문제가 아니라 통합적으로 다루어져야 함을 일깨워준다. AI 기업들은 더욱 강력한 모델을 개발할수록, 그 모델에 대한 정보 관리와 출시 전략에 있어 더 높은 수준의 책임감을 요구받는다.
Sources
- Exclusive: Anthropic 'Mythos' AI model representing 'step change' in power revealed in data leak | Fortune
- Anthropic data leak reveals powerful, secret Mythos AI model | Fortune
- Anthropic accidentally leaked details of a new AI model that poses unprecedented cybersecurity risks | Fortune
- Exclusive: Anthropic left details of an unreleased model, an upcoming exclusive CEO event, in a public database | Fortune
- Anthropic confirms leaked model marks a "step change" in reasoning after data breach reveals its existence | The Decoder
- Details leak on Anthropic's "step-change" Mythos model | Techzine Global
- Claude Mythos Leak Sparks Alarm Over AI-Driven Cyber Threats | Analytics Insight
- Anthropic accidentally reveals 'Claude Mythos' model: The next frontier in AI power | TheNews
- What Is Claude Mythos? | LowCode Agency
- 'Claude Mythos': Anthropic confirms testing its most advanced model yet | NewsBytesApp