미스트랄의 귀환: 르 총크, GPT-6 아스트라와 클로드를 압도하다

GPT-6 아스트라와 클로드 오푸스 5.5가 거의 0점 수준에 그친 사이버 테스트에서 미스트랄 라지 4는 82%를 기록했습니다. 그 이유와 함께 사양, 0.68달러의 가격, 그리고 어떤 부분에서 약세를 보이는지 알려드립니다.

Ashley Innocent

Ashley Innocent

6 October 2026

미스트랄의 귀환: 르 총크, GPT-6 아스트라와 클로드를 압도하다

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

미스트랄은 한동안 최고급 모델 부문에서 잠잠했습니다. 2025년 12월에 미스트랄 라지 3가 출시된 이후, 공개 가중치 프론티어 모델에 대한 대화는 키미, 딥시크, GLM, 큐웬에 집중되어 있었습니다. 2026년 10월 6일, 미스트랄은 팀에서 "르 총크(Le Chonk)"라고 부르는 1조 개 매개변수 모델인 미스트랄 라지 4로 응답했습니다.

헤드라인 숫자는 라지 4가 82%를 기록하고 클로드 오퍼스 5.5와 GPT-6 아스트라가 거의 0점에 가까운 사이버 벤치마크입니다. 이는 사실이며, 미스트랄의 출시 페이지에도 나와 있습니다. 이 내용을 공유하기 전에 한 문장의 맥락이 필요합니다. 이 글은 그 맥락, 사양, 실제 가격, 그리고 라지 4가 여전히 부족한 점을 알려줍니다.

요약 (TL;DR)

"미스트랄의 귀환"이 타당한 이유

2026년 대부분 동안, 가장 강력한 공개 가중치 모델은 중국에서 나왔습니다. 미스트랄은 미디엄 3.5, 데브스트랄 2, 스몰 4를 계속 출시했지만, 프론티어 폐쇄형 모델과 자국 내에서 경쟁할 만한 것은 없었습니다.

라지 4는 판도를 바꿉니다. 미스트랄은 이 모델이 "미국이나 유럽에서 개발된 어떤 공개 가중치 모델보다도 훨씬 뛰어난 성능을 보인다"고 주장하며, EU 주권 지지자들을 위해 만들어진 훈련 스토리를 통해 이를 뒷받침합니다. 이 모델은 미스트랄 자체의 유럽 데이터센터에 있는 3,800개의 NVIDIA Grace Blackwell GPU에서 처음부터 훈련되었으며, 모든 공식 EU 언어를 포함한 160개 이상의 언어를 지원합니다. 또한 미스트랄이 유럽 기술 기업이 유치한 역대 최대 규모의 지분 투자라고 부르는 30억 유로 규모의 시리즈 D 투자 유치 몇 주 만에 출시되었습니다.

타이밍도 중요합니다. 라지 4는 Reflection이 공개 가중치 빔(Beam) 모델을 공개한 직후에 출시되었으므로, 미국 대 중국의 공개 모델 경쟁에 이제 세 번째 주요 경쟁자가 추가되었습니다.

사이버 헤드라인, 그리고 함정

모두가 스크린샷으로 찍고 있는 결과입니다. 아티피셜 애널리시스(Artificial Analysis) 사이버 인덱스에는 모델에게 오픈 소스 소프트웨어의 실제 취약점을 재현하고 패치하도록 요청하는 테스트가 포함되어 있습니다. 미스트랄은 라지 4가 82%로 어떤 모델보다도 높은 점수를 기록했다고 말합니다.

그리고 미스트랄 자신의 말에 따르면, 함정은 다음과 같습니다: "클로드 오퍼스 5.5와 GPT-6 아스트라를 포함한 여러 주요 폐쇄형 모델들은 해당 작업을 수행하기를 거부했기 때문에 동일한 테스트에서 거의 0점을 기록했습니다."

따라서 다음과 같이 해석할 수 있습니다:

주장 실제 의미
"라지 4가 사이버 분야에서 아스트라와 오퍼스 5.5를 이긴다" 이 한 가지 테스트에서 폐쇄형 모델들은 답변을 거부합니다. 라지 4는 답변하고 보통 성공합니다.
"라지 4가 최고의 해킹 모델이다" 확립되지 않았습니다. 거부는 정책적 선택이며, 능력의 한계가 아닙니다.
"라지 4는 안전하지 않다" 이 역시 확립되지 않았습니다. 미스트랄은 JailbreakBench, StrongREJECT, AgentHarm의 사이버 프롬프트에 대한 평균 거부율이 다른 모든 공개 가중치 모델보다 높다고 보고합니다.

헤드라인 뒤에는 실제 능력이 있습니다. 라지 4는 또한 40개의 깃발 쟁탈(capture-the-flag) 연습 세트인 사이벤치(Cybench)의 93%를 해결했으며, 미스트랄은 이를 공개 가중치 모델에 대해 보고된 가장 높은 점수 중 하나라고 말합니다. B3 에이전트 보안 벤치마크에서는 공격의 93.3%를 저항합니다.

보안 팀에게 있어 이 조합은 실제 이야기입니다: 자체 코드로 CVE를 재현하고 패치하는 데 도움이 되는 자체 호스팅 가능한 모델이며, 대부분의 명백히 유해한 요청을 여전히 거부합니다. API 팀에게는 다른 사람의 정책 필터 뒤에 있는 것보다 자체 하드웨어에 유용한 도구를 갖는 것입니다.

사이버 외 분야에서 라지 4가 GPT-6 아스트라를 이기는 부분

사이버 결과는 크게 회자되는 부분입니다. 아스트라에 대한 다른 두 가지 승리는 더 조용하지만 더 의미가 있습니다. 두 모델 모두 실제로 작업을 시도했기 때문입니다:

벤치마크 미스트랄 라지 4 GPT-6 아스트라 비고
Dense 200 (시각적 기반) 42% 41% 1점 차이로 앞섭니다. 실제지만 미미합니다.
Finance Agent v2 (vals.ai) 앞섬 뒤처짐 미스트랄은 점수가 아닌 순위를 보고했습니다.
Harvey Legal Agent Benchmark 최고의 공개 모델 목록에 있음 정확한 비교 수치는 공개되지 않았습니다.

다른 공개 모델들과 비교하면 그 격차는 더 큽니다:

벤치마크 미스트랄 라지 4 누구를 이기는가
AutomationBench (657개 워크플로) 59.9% Kimi K3, DeepSeek V4 Pro
AA-Briefcase (지식 작업) 1,393 Elo DeepSeek V4 Pro
DeepSWE v1.1 (코딩) 61.7% 공개 가중치 모델 중 선두
SWE-Atlas-QnA 59.4%
Terminal-Bench 4.0 28.3%

이 모든 수치는 미스트랄이 보고한 미리보기 모델의 수치입니다. 아직 독립적인 연구실에서 재실험한 결과는 없으며, 유로뉴스(Euronews)는 출시 당시 강화 학습이 아직 마무리 단계였다고 보도했습니다. 이 수치들은 강력한 신호로 받아들이되, 최종적인 판단으로 보지 마십시오.

여전히 뒤처지는 부분

미스트랄은 폐쇄형 모델이 명백히 승리한 한 가지 결과를 발표했습니다. Surge AI가 다섯 가지 모델을 대상으로 실시한 코딩 품질 인간 평가에서 라지 4 미리보기 버전은 2위를 차지했습니다:

모델 인간 코딩 점수 (5점 만점)
클로드 오퍼스 5 4.22
미스트랄 라지 4 미리보기 3.74
GLM-5.3 3.60
키미 K3 3.59
GLM-5.2 3.40

이는 최고의 중국 공개 모델들에 대한 확실한 승리이며, 클로드에는 0.5점 차이로 뒤쳐집니다. 미스트랄 자신의 표현은 라지 4가 코딩 분야에서 프론티어 모델들과 "격차를 좁히고 있다"는 것이며, 이는 솔직한 평가입니다.

또한 누락된 점: 출시 자료 어디에도 클로드 페이블(Fable) 5.1 또는 GPT-6 솔(Sol)과의 비교는 없습니다. 만약 누군가 라지 4가 페이블을 이긴다고 말한다면, 벤치마크를 요구하십시오.

사양 한눈에 보기

사양 미스트랄 라지 4
API 모델 ID mistral-large-4 (별칭 mistral-large-4-0)
버전 26.10, 공개 미리보기
아키텍처 전문가 혼합(Mixture-of-experts), 하이브리드 지시 + 추론
매개변수 총 1.05조 개, 활성 490억 개, 비전 인코더 16억 개
컨텍스트 창 1백만 토큰
입력 텍스트, 이미지
추론 reasoning_effort 매개변수 ("high" 또는 "none")
도구 함수 호출, 구조화된 출력, 내장 에이전트 도구
엔드포인트 /v1/chat/completions, /v1/conversations, /v1/agents, /v1/batch
가중치 공개, 2026년 10월 말까지; 라이선스 미공개

가격: 오늘 호출할 수 있는 가장 저렴한 프론티어급 모델

이 부분은 API 팀들이 주목해야 할 부분입니다. 미스트랄의 가격 페이지에 따르면, 미리보기 기간 동안 라지 4는 정가의 절반 가격으로 제공됩니다:

모델 입력 / 1백만 출력 / 1백만 공개 가중치
미스트랄 라지 4 (미리보기 가격) $0.68 $2.09 예, 10월 말
미스트랄 라지 4 (정가) $1.36 $4.18 예, 10월 말
클로드 오퍼스 5.5 $4.00 $20.00 아니요
GPT-6 아스트라 $10.00 $50.00 아니요

미리보기 가격으로 보면, 라지 4의 출력 비용은 아스트라의 약 24분의 1 수준입니다. 정가로도 출력 비용은 약 12배 저렴합니다. 캐시된 입력은 백만 토큰당 $0.07로 떨어지며, 이는 매번 동일한 시스템 프롬프트와 도구 정의를 다시 보내는 에이전트에게 중요합니다.

미스트랄은 미리보기 할인이 언제 끝날지 밝히지 않았으므로, 정가를 기준으로 예산을 책정하십시오.

전환해야 할까요?

Apidog에서 자체 API에 대해 라지 4를 테스트하는 방법

벤치마크는 다른 사람의 작업에서 모델이 어떻게 작동하는지 알려줍니다. 더 빠르게 결정하는 방법은 자체 프롬프트에서 라지 4를 실행하고 오늘 사용하고 있는 모델과 비교하는 것입니다. Apidog는 별도의 코딩 없이 이를 처리합니다:

  1. 요청을 한 번 저장합니다. POST https://api.mistral.ai/v1/chat/completions를 생성하고, API 키를 환경 변수로 저장한 다음, Authorization: Bearer {{MISTRAL_API_KEY}}를 설정합니다.
  2. 모델별로 복제합니다. 요청을 복제하고, model 필드만 변경하여(mistral-large-4와 현재 모델 비교) 두 요청을 모두 보냅니다. Apidog는 응답, 상태, 지연 시간 및 크기를 나란히 보여주며, usage 블록은 비용 비교를 위한 토큰 수를 제공합니다.
  3. 어설션을 추가합니다. 200 상태, 비어 있지 않은 답변, 그리고 구조화된 출력을 요청한 경우 JSON 스키마 일치 여부를 확인합니다. 이는 일회성 실험을 회귀 테스트로 전환시킵니다.
  4. 모델이 업데이트될 때마다 다시 실행합니다. 요청을 테스트 시나리오로 그룹화하고, 미스트랄이 미리보기를 업데이트하거나 가중치를 출시할 때 다시 실행합니다. 사용자보다 먼저 품질 변화를 확인할 수 있습니다.

라지 4의 두 가지 강점은 API 작업에 자연스럽게 들어맞습니다. 보안 결과는 API 보안 테스트의 훌륭한 두 번째 검토자 역할을 할 수 있습니다. 예를 들어 자체 스테이징 API에서 인증 우회를 재현할 때 그렇습니다. 또한 함수 호출 및 구조화된 출력을 통해 Apidog에서 설계된 OpenAPI 사양을 에이전트가 호출할 수 있는 도구 정의로 전환할 수 있습니다.

키, 추론 청크, 이미지, 함수 호출 및 비용 계산을 포함한 전체 코드 워크스루는 미스트랄 라지 4 API 가이드를 참조하십시오. 이전 미스트랄 모델에서 전환하시나요? 미스트랄 AI API 기본 사항 및 미스트랄 미디엄 3.5 API 가이드는 여전히 적용됩니다: 동일한 기본 URL, 동일한 인증, 새로운 모델 ID.

자주 묻는 질문 (FAQ)

미스트랄 라지 4는 오픈 소스인가요? 오픈 가중치(open-weight) 모델입니다. 미스트랄은 2026년 10월 말까지 가중치를 출시할 예정이라고 밝혔습니다. 라이선스는 아직 공개되지 않았으므로, 라지 3의 Apache 2.0과 동일하다고 가정하지 마십시오.

미스트랄 라지 4가 정말 GPT-6 아스트라를 이기나요? 시각적 기반(42% 대 41%)과 Finance Agent v2에서는 미스트랄의 수치에 따르면 그렇습니다. 사이버 취약점 테스트에서는 아스트라가 작업을 거부했기 때문에 거의 0점을 기록했으므로, 이는 동등한 조건의 승리가 아닙니다.

클로드를 이기나요? 코딩에서는 그렇지 않습니다. 클로드 오퍼스 5는 인간 코딩 평가에서 4.22 대 3.74로 앞서고 있습니다. 클로드 오퍼스 5.5 또한 사이버 재현 작업을 거부하여 거의 0점을 기록했습니다.

"르 총크(Le Chonk)"는 무슨 의미인가요? 이 모델의 비공식적인 별명으로, 그 크기에 대한 농담입니다. 공식 명칭은 미스트랄 라지 4, 또는 ML4입니다.

무료로 사용할 수 있나요? 미스트랄의 무료 플랜에는 매월 $10의 API 크레딧과 르 챗(Le Chat) 및 바이브(Vibe)의 최신 모델 액세스가 포함됩니다. 미리보기 가격으로 $10이면 라지 4에서 약 480만 개의 출력 토큰을 구매할 수 있습니다.

결론

미스트랄이 프론티어 모델 논의에 다시 등장했습니다. 미스트랄의 수치에 따르면 라지 4는 중국 외 지역에서 나온 가장 강력한 공개 가중치 모델이며, 아스트라나 오퍼스 5.5의 극히 일부 비용으로 작동하고, 몇 주 안에 자체 하드웨어에서 실행될 것입니다. "사이버 분야에서 아스트라와 클로드를 이긴다"는 말은 사실이지만, 이는 거부로 인한 것이며, 솔직한 코딩 평가는 "클로드에 이어 2위"입니다. 미리보기 가격이 지속되는 동안 Apidog에서 자체 API로 테스트해보고, 10월 27일 이후 독립적인 벤치마크가 나올 때까지 프로덕션 결정을 보류하십시오.

버튼

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요