Mistral Large 3: EU에 기본 내장된 675B/41B MoE 모델

Mistral Large 3의 675B/41B 희소 MoE 아키텍처, JSON Schema 구조화 출력·함수 호출, EU 데이터 레지던시 설계와 배포 옵션을 정리한다

2026-08-14 · 최초 발행 2026-04-17

675B 파라미터를 갖고도 추론 시 41B만 깨운다. 그리고 그 41B는 태어날 때부터 EU 땅을 벗어나지 않는다. Mistral AI가 2025년 12월 공개한 플래그십 모델 Mistral Large 3은 총 675B 파라미터 중 41B만 활성화하는 희소 혼합 전문가(Sparse Mixture-of-Experts) 아키텍처를 채택하여, 오픈소스 진영에서 가장 큰 규모의 MoE 모델로 자리잡았다. 구조화된 출력(Structured Output) 생성과 네이티브 함수 호출(Function Calling) 지원, 그리고 프랑스 기업으로서 EU 데이터 레지던시를 기본 제공하는 La Plateforme 기반 서비스가 핵심 차별점이다.

675B 중 41B만 깨우는 구조

Mistral Large 3은 675B 총 파라미터 중 41B 활성 파라미터를 사용하는 희소 MoE 구조의 오픈 웨이트(Open-Weight) 모델이다. 핵심 특징은 256K 토큰 컨텍스트 윈도우, 네이티브 함수 호출, JSON Schema 기반 구조화된 출력, 멀티모달(비전) 지원이다. 포지셔닝 면에서는 오픈소스 모델 LMArena 2위, 전체 6위로 프론티어급 성능을 오픈 웨이트로 제공하는 유일한 EU 기반 모델이다.

Mistral Large 3은 전통적인 밀집(Dense) 트랜스포머 대신 희소 MoE 아키텍처를 채택했다.

675B 파라미터41B 활성 파라미터입력 토큰라우터 네트워크전문가 1 (활성)전문가 2 (비활성)전문가 3 (활성)전문가 N (비활성)출력 결합다음 레이어

라우터 네트워크는 각 토큰에 대해 가장 적합한 전문가 서브셋을 동적으로 선택하고, 비활성 전문가는 연산에 참여하지 않아 추론 비용이 절감되는 전문가 병렬화가 이뤄지며, 675B 전체 파라미터에 분산된 지식을 41B 활성 경로로 효율적으로 접근하는 지식 분산 구조다.

항목 Mistral Large 3 경쟁 밀집 모델
총 파라미터 675B 400B~700B
활성 파라미터 41B 전체
추론 연산량 41B 수준 400B~700B 수준
컨텍스트 윈도우 256K 토큰 128K~200K
메모리 효율 높음 (활성 부분만 로드) 낮음 (전체 로드 필요)

MoE 구조의 핵심 이점은 추론 시 41B 파라미터만 연산에 참여하면서도, 675B에 해당하는 지식 용량을 확보한다는 점이다. 이는 동일 성능의 밀집 모델 대비 추론 비용을 대폭 절감한다.

스키마를 벗어나지 않는 출력

Mistral Large 3은 La Plateforme의 제한 출력 모드(Constrained Output Mode)와 결합하여, JSON Schema를 준수하는 구조화된 출력을 네이티브로 생성한다. API 호출 시 response_format 파라미터로 JSON Schema 명세를 전달하는 스키마 정의, 토큰 생성 과정에서 스키마를 위반하는 토큰을 사전 차단하는 제약 디코딩(Constrained Decoding), 문자열·숫자·불리언·배열·중첩 객체 등 복합 스키마를 지원하는 타입 안전성, 파싱 오류 없이 즉시 애플리케이션 로직에 통합 가능한 호출 신뢰성이 특징이다.

"외부 도구/API""Mistral Large 3""사용자""외부 도구/API""Mistral Large 3""사용자""서울 날씨 알려줘" + 도구 정의"도구 선택 및 인자 생성""get_weather(city='Seoul')""{'temp': 18, 'condition': 'sunny'}""서울은 현재 18도, 맑음입니다"

함수 호출 파이프라인은 사용자 쿼리와 함께 사용 가능한 도구 목록(함수 시그니처, 설명)을 수신하는 도구 명세 수신, 쿼리 의도를 분석해 적절한 함수를 자동 선택하는 도구 선택, 선택된 함수에 필요한 인자를 JSON 형식으로 구조화하는 인자 생성, 외부 도구의 응답을 자연어로 변환해 사용자에게 전달하는 결과 통합 네 단계로 진행된다. 이 파이프라인은 에이전틱 AI 워크플로우의 핵심 기반이 되며, Mistral Large 3의 함수 호출 정확도는 LMArena 기준 오픈소스 최상위권에 위치한다.

프랑스 기업이라 기본 제공되는 것

Mistral AI는 프랑스 파리에 본사를 둔 EU 기업으로, La Plateforme을 통해 제공하는 모든 API 서비스의 데이터 처리를 EU 내에서 수행한다. 별도 설정 없이 모든 API 데이터가 유럽 데이터센터에서 처리되는 기본 EU 호스팅, 데이터 처리 계약(Data Processing Agreement)이 서비스에 내장된 DPA 기본 제공, Privacy Shield 후속 프레임워크 평가가 불필요한 대서양 횡단 전송 불필요, EU 기업으로서 GDPR의 직접 적용을 받아 규제 불확실성을 제거하는 GDPR 네이티브 준수가 그 내용이다.

규제 프레임워크사용자 환경EU 데이터센터La Plateforme API추론 엔진모델 웨이트로그/감사EU 기업 애플리케이션자체 호스팅 (vLLM)GDPREU AI Act

Mistral Large 3이 EU 데이터 레지던시에서 갖는 구조적 우위는 표로 정리된다. 기본 데이터 처리 위치는 EU(미국 기반 제공업체는 미국, EU 옵션 추가 비용), DPA는 내장(미국 기반은 별도 협상 필요), 대서양 횡단 전송은 없음(미국 기반은 기본 발생), GDPR 직접 적용은 예(미국 기반은 간접 적용), EU AI Act 준수는 네이티브(미국 기반은 적응 필요), 규제 오버헤드는 최소(미국 기반은 상당)다.

벤치마크에서 어디에 서 있나

Mistral Large 3은 오픈소스 진영에서 최고 수준의 성능을 기록한다. LMArena 순위는 오픈소스 모델 2위, 전체 6위이고, 코딩 성능은 오픈소스 코딩 리더보드 최상위권으로 SWE-bench에서 경쟁 모델 대비 우수한 결과를 냈다. MMLU(지식/추론)는 일반 지식과 추론 벤치마크에서 다수의 폐쇄형 모델과 동등하거나 상회하고, 다국어 지원은 유럽 언어를 중심으로 강력하며, 멀티모달은 이미지 이해·문서 분석에서 경쟁력 있는 비전 성능을 보인다.

주요 비교 대상 모델과의 포지셔닝은 다음과 같다. Mistral Large 3(오픈 웨이트 MoE, 675B/41B, LMArena 전체 6위, EU 레지던시 기본 제공), Llama 4 Maverick(오픈소스 MoE, 400B/17B, 전체 상위권, EU 레지던시 미지원), GPT-5.4(폐쇄형, 파라미터 비공개, 전체 상위, EU 레지던시 옵션), Claude Opus 4.6(폐쇄형, 파라미터 비공개, 전체 1위, EU 레지던시 옵션)이다.

이미지까지 함께 보는 모델

Mistral Large 3은 텍스트와 이미지를 동시에 처리하는 비전-언어 멀티모달 기능을 지원한다. 비전 트랜스포머 기반 이미지 임베딩을 생성하는 이미지 인코더, 이미지 토큰과 텍스트 토큰 간 교차 주의(Cross-Attention) 메커니즘, OCR 없이 문서 이미지에서 직접 정보를 추출하는 문서 이해, 시각적 데이터 표현의 의미를 해석하는 차트/그래프 분석이 핵심이다. 멀티모달 기능은 함수 호출과 결합해 이미지 입력 → 분석 → 외부 API 호출 → 결과 반환의 에이전틱 파이프라인을 구현할 수 있다.

배포 방식을 고르는 법

Mistral Large 3은 오픈 웨이트 모델로, 다양한 배포 방식을 지원한다. La Plateforme(관리형 API)은 입력 $2/백만 토큰·출력 $6/백만 토큰이며 EU 데이터 레지던시가 기본 제공되고 함수 호출·구조화 출력·멀티모달 전체 기능을 지원한다. 자체 호스팅(vLLM/TGI)은 HuggingFace에서 오픈 웨이트를 다운로드하며 FP8 양자화 시 약 8x H100 GPU가 필요하고 데이터를 완전히 통제하며 커스텀 파인튜닝이 가능하다. 클라우드 파트너(Azure, AWS, GCP)는 Microsoft Foundry·Amazon Bedrock·Google Cloud Vertex AI에서 배포되며 기존 클라우드 인프라와 통합이 쉽고 엔터프라이즈급 SLA와 지원을 받는다. 온프레미스/주권 배포는 OVHcloud 등 EU 주권 클라우드에서 레퍼런스 아키텍처를 제공하며 완전한 데이터 주권이 필요한 정부·금융 기관에 적합하다.

구조화된 출력 생성과 네이티브 함수 호출은 에이전틱 AI 애플리케이션의 핵심 요건을 충족하며, GDPR과 EU AI Act 시대에 유럽 기업의 규제 준수 부담을 구조적으로 해소한다. 성능과 규제 준수를 동시에 확보해야 하는 조직에 Mistral Large 3은 현실적이고 강력한 선택지다.

Sources

Mistral Large 3Mixture of Experts구조화된 출력EU 데이터 레지던시GDPR