Qwen 3.8-Max는 무엇인가요?

Qwen 3.8 설명: 알리바바의 2.4조 토큰 규모 오픈웨이트 플래그십으로, 950억 개의 활성 파라미터, 100만 토큰 컨텍스트, 2달러/6달러 요금, 실제 벤치마크, 그리고 접근 가능한 모든 방법을 포함합니다.

Ashley Innocent

Ashley Innocent

3 August 2026

Qwen 3.8-Max는 무엇인가요?

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Alibaba는 2026년 8월 초 Qwen 3.8-Max를 공식 출시했으며, 이는 특이한 조합으로 등장했습니다: 2.4조 매개변수 규모의 MoE(Mixture-of-Experts) 모델이지만 토큰당 95B 매개변수만 활성화되며, 100만 컨텍스트 전체에 걸쳐 100만 토큰당 입력 $2 / 출력 $6의 단일 가격을 제공하고, 일주일 내에 가중치를 Hugging Face와 ModelScope에 공개할 것을 약속했습니다. 마지막 부분이 중요합니다. 지금까지 Qwen-Max급 모델이 오픈 가중치를 공개한 적은 없었기 때문입니다.

공식 발표에서는 이 모델을 현재까지 가장 유능한 Qwen이라고 칭하며, 공급업체 벤치마크 표는 이를 뒷받침하는 강력한 결과와 몇 가지 솔직한 패배를 보여줍니다. 이 가이드는 Qwen 3.8-Max가 실제로 무엇인지, 수치가 무엇을 말하는지, Kimi K3, Fable 5, GPT-5.6 Sol과 비교했을 때 어떤 위치에 있는지, 그리고 지금 당장 이를 실행할 수 있는 모든 방법을 분석합니다. API를 기반으로 개발할 계획이라면, 이 모델은 OpenAI 호환 및 Anthropic 호환 엔드포인트를 모두 제공하므로, Apidog와 같은 프로토콜 인식 클라이언트가 동일한 키로 두 가지 형태를 테스트하는 데 유용할 것입니다.

버튼

Qwen 3.8-Max 한눈에 보기

사양 Qwen 3.8-Max
개발사 Alibaba (Qwen 팀)
출시일 2026년 8월 초 (Model Studio 정식 출시, 8월 3일)
아키텍처 MoE, Qwen 3.5 기반으로 구축
총 매개변수 2.4T
활성 매개변수 95B (약 4% 활성화)
컨텍스트 창 1,000,000 토큰
최대 출력 65,536 토큰
모달리티 텍스트 + 이미지 입력, 텍스트 출력
추론 제어 reasoning_effort: xhigh (기본), medium, low
API 모델 ID qwen3.8-max
가격 100만 토큰당 입력 $2 / 출력 $6, 전체 컨텍스트에 걸쳐 단일 요금
공개 가중치 다음 주 (~8월 10일) 공개 약속; 2026년 8월 초 현재 다운로드 불가
API 프로토콜 OpenAI 호환 및 Anthropic 호환

이 표의 모든 정보는 Alibaba 자체의 출시 자료와 Model Studio 가격 책정 페이지에서 가져온 것입니다. 이제 자세히 살펴보겠습니다.

Qwen 3.8-Max는 무엇인가

Qwen 3.8-Max는 Alibaba Qwen 제품군의 새로운 플래그십 모델로, Qwen 3.5 아키텍처 기반으로 구축되었습니다. 이는 라인업의 최상단에서 Qwen 3.7-Max를 대체하며, 공급업체 표는 이전 모델 대비 의미 있는 성능 향상을 보여줍니다: Terminal Bench 2.1은 74.5에서 86.6으로, PaperBench는 64.8에서 93.0으로 상승했습니다. 이전 모델에서 전환할지 여부를 결정하고 있다면, 자세한 차이점은 Qwen 3.8 vs Qwen 3.7 Max 비교에서 확인할 수 있습니다.

가장 주목할 만한 사양은 매개변수 분할입니다. 2.4T의 총 매개변수는 엄청난 규모이지만, MoE 설계는 각 순방향 패스당 95B만 활성화합니다. 약 4%의 활성화 비율 덕분에 Alibaba는 이처럼 큰 모델을 100만 토큰당 $2/$6이라는 가격에 제공할 수 있습니다. 참고로 Kimi K3는 총 2.8T에 104B가 활성화되므로, Qwen 3.8-Max는 두 가지 면에서 더 작은 모델입니다.

입력 측면에서 이 모델은 API를 통해 텍스트와 이미지를 모두 받습니다. Alibaba의 블로그는 또한 장문 문서 이해(200페이지 이상의 PDF)와 '메모리 그래프'라고 불리는 100시간 분량의 비디오 이해 기능을 시연합니다. 이들은 별도의 API 입력 유형이라기보다는 블로그에서 시연된 기능으로 이해해야 합니다; 공개된 API 구성은 텍스트와 이미지를 입력 모달리티로 나열하고 있습니다.

추론은 세 가지 수준의 `reasoning_effort` 매개변수(xhigh(기본), medium, low)를 통해 제어됩니다. 또한 `enable_thinking`과 `preserve_thinking`도 있으며, '사고 과정'은 기본적으로 보존됩니다. 초기부터 알아야 할 한 가지 가격 책정 세부 사항: 사고 모드와 비사고 모드는 동일한 요금으로 청구되지만, '사고 토큰'은 출력으로 계산되므로, xhigh 기본값에서의 실제 청구 금액은 순진한 가격표 계산보다 높게 나올 수 있습니다.

최초의 오픈 가중치 Max급 Qwen

이것은 이번 출시의 가장 큰 전략적 움직임입니다. Alibaba는 수년간 수많은 Qwen 모델을 오픈 소스화했지만, Max 등급은 단 한 번도 공개하지 않았습니다. Qwen 3.8-Max는 이러한 패턴을 깨고 있습니다. 회사는 가중치가 Hugging Face와 ModelScope에 "다음 주"에 공개될 것이라고 밝혔는데, 이는 대략 8월 10일경이 될 것입니다.

솔직히 말하자면, 두 가지 주의사항이 있습니다:

  1. 가중치는 아직 다운로드할 수 없습니다. 2026년 8월 초 현재, 약속은 약속일 뿐입니다. Kimi K3는 최근 이 분야에서 선례를 남겼습니다: 출시 11일 후에 가중치가 공개되었으니, 약간의 지연은 놀랄 일이 아닙니다.
  2. 2.4T 모델을 자체 호스팅하는 것은 다중 노드 프로젝트입니다. 공격적으로 양자화하더라도, 이는 워크스테이션에서 실행할 수 있는 수준이 아닙니다. 대부분의 팀에게 "오픈 가중치"는 로컬 배포보다는 서드파티 제공업체를 통한 더 저렴한 호스팅 액세스를 의미할 것입니다.

Qwen 3.8-Max에 대한 관심이 주로 정가 지불을 피하는 것에 있다면, 현재 현실적인 방법은 Qwen Chat과 Model Studio 무료 할당량이며, 둘 다 Qwen 3.8을 무료로 사용하는 방법에 대한 가이드에서 다루고 있습니다.

벤치마크 결과 (패배 항목 포함)

Alibaba는 Qwen 3.8-Max를 Claude Opus 4.8, Fable 5, GPT-5.6 Sol, 그리고 Qwen 3.7-Max와 비교한 전체 벤치마크 표를 공개했습니다. 수치를 보기 전에 두 가지 공개 사항: 이들은 공급업체가 직접 실행한 결과이며, 대부분의 코딩 항목은 모든 모델에 대해 Claude Code 하네스를 사용하여 실행되었습니다. 여러 벤치마크(QwenSWEBench, QwenQoderBench, CoWorkBench, RecreationBench)는 Alibaba 자체의 내부 개발물입니다. 이 글을 작성하는 시점에는 Artificial Analysis와 같은 기관의 독립적인 수치는 존재하지 않았습니다.

이러한 맥락에서 Alibaba의 표에 따르면 뛰어난 결과는 다음과 같습니다:

승리한 분야:

패배한 분야:

솔직한 요약: Alibaba 자체 수치에 따르면 Qwen 3.8-Max는 여러 에이전트 항목에서 Opus 4.8을 능가하지만, 대부분의 핵심 코딩 작업에서는 Fable 5에 뒤처지며, 멀티모달 및 문서 인텔리전스에서는 크게 앞섭니다. GPQA Diamond에서는 92.6점으로 Fable 5와 동률이며 Sol의 94.1에 약간 뒤쳐져 있어, 순수 과학 추론은 경쟁력이 있습니다. 하네스 세부 사항과 주시해야 할 독립 검증을 포함한 전체 표 분석은 Qwen 3.8 벤치마크 분석에서 확인하세요.

Alibaba는 또한 일련의 쇼케이스 실행 결과를 발표했습니다: 공개 저장소에서의 16일간 자율 코딩 세션(265개 커밋, 127개 풀 리퀘스트), 원본 논문의 AIME24 결과를 뛰어넘은 논문 재현 실행, 그리고 24시간 만에 526개 인간 팀 중 458개 팀을 능가한 Tianchi 콘테스트 참가. 이들은 공급업체 자체의 데모이므로, 통제된 평가라기보다는 기능 광고로 이해해야 합니다. 하네스 설정 재현 방법을 포함한 코딩 스토리는 코딩을 위한 Qwen 3.8에서 별도로 다루고 있습니다.

Kimi K3, Fable 5, GPT-5.6 Sol과의 비교 위치

Kimi K3 대비. 이것은 자연스러운 경쟁 구도입니다: 두 중국 연구소, 두 개의 오픈 가중치 거대 MoE 모델이 몇 주 간격으로 출시되었습니다. K3는 더 크고(총 2.8T, 활성 104B 대 2.4T/95B), Qwen이 멀티모달인 반면 텍스트 전용이며, Qwen의 가중치는 아직 약속인 반면 K3의 가중치는 이미 공개되어 있습니다. 가격도 크게 다릅니다: K3는 입력 $3/출력 $15에 캐시 적중 시 $0.30를 부과하는 반면, Qwen은 고정 $2/$6입니다. 아직 직접적인 일대일 평가는 존재하지 않으며, 각 공급업체가 자체 표를 발표했습니다. Qwen 3.8 vs Kimi K3에서 항목별로 비교했으며, Moonshot의 모델이 처음이시라면 Kimi K3는 무엇인가부터 시작해보세요.

Fable 5 대비. Anthropic의 플래그십은 여전히 코딩 벤치마크의 기준이며, Qwen 3.8-Max는 이를 능가하지 못합니다. Alibaba 자체 표에 따르면 SWE-bench Pro (67.7 대 80.0)와 HLE (43.6 대 53.3)는 명확한 격차를 보입니다. 대신 Qwen이 제공하는 것은 가격(최첨단 요금의 일부), 1M 컨텍스트, 곧 공개될 오픈 가중치, 그리고 더 강력한 멀티모달 항목입니다.

GPT-5.6 Sol 대비. Sol은 Terminal Bench (88.8 대 86.6), GPQA (94.1 대 92.6), HLE (47.2 대 43.6)에서 우위를 차지하는 반면, Qwen 3.8-Max는 PaperBench (93.0 대 90.5)와 IFBench (82.8 대 72.7)에서 승리합니다. 가격 면에서 Qwen의 $2/$6은 GPT-5.6 Terra의 $2/$12(출력)를 밑돌며, Sol 등급 액세스는 훨씬 더 비쌉니다.

또 다른 기준점: Claude Opus 5는 $5/$25로 책정되어 있습니다. 공급업체 표에 대해 어떤 판단을 하든, Alibaba는 자사 플래그십 모델의 가격을 대량 워크로드에 대한 계산을 바꿀 수 있는 수준으로 책정했습니다.

가격: 1M 토큰 전체에 걸쳐 $2/$6, 단일 요금

가격은 한 문장으로 간단히 설명할 수 있습니다: 100만 입력 토큰당 $2, 100만 출력 토큰당 $6이며, 0토큰부터 1M 컨텍스트 제한까지 단일 요금으로 적용되고, '사고 모드' 여부와 관계없이 동일합니다.

단일 요금은 이례적인 부분입니다. 대부분의 긴 컨텍스트 모델은 프롬프트가 길어질수록 가격이 상승하지만, Qwen 3.8-Max는 그렇지 않습니다. 또한 Qwen 3.7-Max의 정가($2.5/$7.5)보다 저렴하게 출시되었지만, 이전 모델은 현재 50% 할인($1.25/$3.75) 프로모션을 진행 중이어서 가성비 측면에서 여전히 유효합니다.

컨텍스트 캐싱은 반복되는 접두사 워크로드에 이점을 제공합니다: 캐시 적중은 입력 요금의 10%로 청구되며, 명시적인 캐시 생성은 125%가 부과됩니다. 또한 테스트를 위한 무료 할당량(1M 토큰, 싱가포르 지역 한정, 90일 유효)도 있습니다. 작업당 예시와 사고 토큰의 함정을 정량화한 전체 비용 분석은 Qwen 3.8 가격 가이드에 있습니다.

Qwen 3.8-Max에 접근하는 방법

접근 방식은 일반적인 출시보다 더 광범위합니다. 다섯 가지 방법이 있습니다:

1. Qwen Chat. 소비자 앱으로, API 키가 필요 없습니다. 가장 빠르게 의견을 형성할 수 있는 방법입니다.

2. Alibaba Cloud Model Studio (DashScope)의 API. home.qwencloud.com에서 키를 받고, `DASHSCOPE_API_KEY`를 설정한 다음, OpenAI 호환 채팅 완성 또는 응답 엔드포인트를 통해 모델 ID `qwen3.8-max`를 호출하세요. 세 가지 지역 기본 URL이 활성화되어 있습니다: 베이징 (`dashscope.aliyuncs.com/compatible-mode/v1`), 싱가포르 (`dashscope-intl.aliyuncs.com/compatible-mode/v1`), 그리고 미국 버지니아 (`dashscope-us.aliyuncs.com/compatible-mode/v1`). Model Studio 모델 페이지에서는 이를 권장 스택의 최상단에 나열합니다.

3. Anthropic 호환 엔드포인트. 이것은 정말 이례적인 것입니다: `https://dashscope-intl.aliyuncs.com/apps/anthropic`는 Anthropic Messages 프로토콜을 사용하므로, Claude용으로 구축된 도구는 두 개의 환경 변수로 Qwen을 가리킬 수 있습니다.

4. 코딩 하네스. Alibaba는 다섯 가지 에이전트에 대한 공식 구성을 발표했습니다: Claude Code (`ANTHROPIC_BASE_URL` 및 `ANTHROPIC_MODEL=qwen3.8-max`를 통해), Codex, Qoder, Qwen Code, 그리고 OpenClaw. Alibaba가 대부분의 코딩 벤치마크를 Claude Code 하네스 내에서 실행했으므로, 공개된 구성은 자체 수치 뒤에 있는 구성과 동일하다는 점을 주목할 가치가 있습니다.

5. 공개 가중치, 곧. Hugging Face와 ModelScope에 다음 주 공개 약속, 2026년 8월 초 현재 다운로드 불가.

2번부터 4번까지의 설정 세부 정보(복사/붙여넣기 가능한 Python 및 cURL 포함)는 Qwen 3.8 API 가이드에 있습니다.

이중 프로토콜 API 테스트

두 가지 다른 프로토콜 형태에서 동일한 모델이 응답한다는 것은 실용적인 테스트 질문을 야기합니다: 요청이 두 가지 모두에서 동일하게 작동하는가? 이때 API 클라이언트가 제 역할을 합니다. Apidog에서는 세 가지 지역 기본 URL을 환경으로 저장하고 요청을 편집하지 않고도 지역을 전환하며, 동일한 프롬프트를 OpenAI 호환 엔드포인트와 Anthropic 프로토콜 엔드포인트를 통해 동시에 보내고, SSE 스트림을 검사하여 최종 답변 전에 `reasoning_content`의 변화가 어떻게 도착하는지 확인할 수 있습니다. 후자는 xhigh 기본값이 실제로 얼마나 많은 사고 과정을 생성하는지 확인하는 데 유용합니다. 해당 토큰이 출력으로 계산되어 요금에 반영되기 때문입니다. 엔드포인트를 연결할 때 따라 하고 싶다면 Apidog를 무료로 다운로드하세요. 동일한 작업 공간에서 `qwen3.8-max`를 `qwen3.7-max` 또는 `kimi-k3`와 동일한 프롬프트로 A/B 테스트하여 워크로드를 확정하기 전에 쉽게 비교할 수 있습니다.

Qwen 3.8-Max의 라인업 내 위치

더 넓은 제품군을 살펴보면, Qwen 3.8-Max는 이제 Qwen 3.7-Max 및 플러스 등급 모델 위에 위치하며, 최고의 Qwen 모델 가이드는 어떤 등급이 어떤 워크로드에 적합한지 다룹니다. 간단히 요약하자면: 멀티모달 및 에이전트 기능을 최대로 활용해야 할 때는 3.8-Max가 최적의 선택이며, 프로모션 기간 동안 50% 할인된 3.7-Max는 가성비 플래그십 역할을 합니다. 플러스 모델은 일상적인 작업을 위한 저렴한 일꾼으로 남아 있습니다.

자주 묻는 질문

Qwen 3.8은 오픈 소스인가요?

아직 아니지만, 곧 공개됩니다. Alibaba는 2026년 8월 초 출시 시점에서 "다음 주"에 Hugging Face와 ModelScope에 가중치를 공개할 것이라고 약속했으며, 이는 최초의 오픈 가중치 Max급 Qwen이 될 것입니다. 이 글을 쓰는 시점에는 아직 다운로드할 수 없습니다. 그때까지는 API 또는 Qwen Chat을 통해 접근할 수 있습니다. 무료 접근 방법은 Qwen 3.8을 무료로 사용하는 방법을 참조하세요.

Qwen 3.8-Max의 가격은 얼마인가요?

100만 입력 토큰당 $2, 100만 출력 토큰당 $6이며, 전체 1M 컨텍스트에 걸쳐 단일 요금으로 적용됩니다. 캐시 적중은 입력 요금의 10%로 청구됩니다. '사고 토큰'은 출력으로 계산되며, 기본 추론 노력은 xhigh이므로, 추론 집약적인 작업의 경우 가격표보다 높은 예산을 책정해야 합니다.

Qwen 3.8-Max가 Kimi K3보다 좋은가요?

아직 직접적인 일대일 평가는 없습니다. 두 공급업체 모두 자체 표를 발표했습니다. 이론적으로 Qwen 3.8-Max는 더 작고(2.4T/활성 95B 대 2.8T/104B), K3가 텍스트 전용인 반면 멀티모달이며, 출력 가격이 더 저렴합니다($6 대 $15). K3의 현재 이점은 가중치가 이미 공개되어 있다는 점입니다.

Claude Code에서 Qwen 3.8-Max를 사용할 수 있나요?

네, 가능합니다. Alibaba는 공식 구성을 발표했습니다: `ANTHROPIC_BASE_URL`을 Anthropic 호환 DashScope 엔드포인트로 지정하고 `ANTHROPIC_MODEL=qwen3.8-max`로 설정하세요. Codex, Qoder, Qwen Code, OpenClaw도 공식 구성이 있습니다.

다음 단계

Qwen 3.8-Max는 단순한 언론 공개가 아닌, 진정한 플래그십 출시입니다: 세 가지 API 지역에서의 정식 출시, 공개된 가격, 승패를 모두 보여주는 완전한 (공급업체 실행) 벤치마크 표, 그리고 며칠 내에 공개될 오픈 가중치까지. 솔직히 말해 핵심 코딩에서 Fable 5를 왕좌에서 끌어내리지는 못했지만, 여러 에이전트 항목에서 Opus 4.8을 능가하고, 문서 및 멀티모달 작업에서 앞서며, 이 모든 것을 $2/$6의 가격으로 제공합니다.

현명한 방법은 다른 사람의 표를 참고하기보다 자신의 워크로드에 직접 테스트해보는 것입니다. 무료 할당량을 받고, 두 가지 프로토콜 엔드포인트를 연결한 다음, 실제로 사용하는 프롬프트로 출력을 비교해보세요. API 설정 가이드부터 시작하고, 가중치가 예정대로 공개되었는지 8월 10일경 다시 확인해보세요.

버튼

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요