2026년 여름 중국 프론티어 모델 출시 흐름을 추적하며 Qwen3.8-Max를 프로덕션 API에 넣을지, 오픈 가중치를 기다릴지, Kimi K3·DeepSeek V4를 우선할지 판단해야 하는 개발자를 위해, 본문은 타임라인·핵심 스펙·횡단 비교·투명성 쟁점 네 축으로 정리합니다. 핵심 결론: 8월 3일 GA 시점 가중치는 미공개이며, 모든 벤치마크는 Alibaba 자체 테스트 하네스 기반입니다.
타임라인: 출시된 것과 아직 없는 것
- 7월 16일: Moonshot AI, Kimi K3(2.8T MoE) 공개.
- 7월 19일: Qwen3.8-Max 프리뷰, 정가의 10%, 활성 파라미터 미공개.
- 7월 27일: Kimi K3 Hugging Face 오픈 가중치 공개.
- 7월 31일: DeepSeek V4-Flash, 파라미터 증가 없이 V4-Pro 초과.
- 8월 3일: Qwen3.8-Max GA, 「千问办公」Agent 동시 출시. 알리바바 주가 약 7% 상승.
- 다음 주(8월 10일 전후 예상): Qwen3.8-Max·Qwen3.8-27B 가중치 예정, 저장소 없음.
Arena Text Arena(8월 1일 스냅샷) #5, 1496점(Preliminary). 상위 8위 중 유일한 비-Anthropic 모델이나, 점수는 벤더 자체 측정입니다.
Alibaba가 공개한 수치
| 항목 | Qwen3.8-Max |
|---|---|
| 총/활성 파라미터 | 2.4T / 95B |
| 아키텍처 | 희소 MoE + 하이브리드 어텐션 |
| 컨텍스트 | 100만 토큰 |
| API 가격 | 입력 $2 / 출력 $6 (100만 토큰) |
| Arena 텍스트 | #5, 1496점(Preliminary) |
| 오픈 가중치 | 「다음 주」 예정, 미공개 |
2.4조 파라미터의 의미: MoE와 장기 에이전트
총 2.4T 대비 토큰당 활성 95B만 사용합니다. 추론 비용은 활성 수에 비례하므로 Claude Opus 5($5/$25)·Fable 5($10/$50)보다 낮은 $2/$6이 가능합니다. reasoning_effort는 low/medium/xhigh 3단계이며 enable_thinking 또는 Anthropic 호환 reasoning.effort로 지정합니다.
- API 호환(OpenAI/Anthropic)을 확인합니다.
- 작업별 reasoning_effort로 토큰 비용을 제어합니다.
- 로컬 배포는 Qwen3.8-27B 오픈 가중치를 기다립니다.
- 자체 워크로드로 A/B 테스트를 수행합니다.
- Hugging Face 저장소와 라이선스를 확인합니다.
- 이미 공개된 Kimi K3·DeepSeek V4를 베이스라인으로 삼습니다.
Qwen3.8-Max vs Kimi K3 vs DeepSeek V4 vs Claude
| 모델 | 가격(입/출) | 오픈 가중치 | 독립 벤치 |
|---|---|---|---|
| Qwen3.8-Max | $2 / $6 | 미공개(예정) | 없음 |
| Kimi K3 | $3 / $15 | 7월 27일 공개 | Artificial Analysis ≈ 57.11 |
| DeepSeek V4-Flash | 미완전 공개 | 공개됨 | V4-Pro 9벤치 초과 |
| Claude Fable 5 | $10 / $50 | 폐쇄 | Arena 텍스트 #1 |
독립 블라인드 테스트(269파일 설계 작업)에서 Kimi K3 83점, Qwen3.8-Max 프리뷰 80점으로 동급입니다. API 가격 맥락은 GPT-5.6 가격 인하 분석을 참고하세요.
검증 가능한 기술 정보와 출처
- MoE 효율: 2.4T 총 / 95B 활성(Alibaba 발표 자료).
- Arena: 8월 1일 스냅샷 #5, Preliminary 표기(Arena.ai).
- 독립 맹검: 83 vs 80(제3자 평가, Alibaba 비실행).
「오픈소스」라벨 문제
- GA 당일 Open-Source 표시, 가중치 저장소 미공개.
- 모든 벤치마크는 벤더 자체 실행.
- 프리뷰 기간 활성 파라미터·모델 카드 미공개.
FAQ
지금 오픈소스인가요?
아닙니다. API는 사용 가능하나 Hugging Face/ModelScope에 가중치가 없습니다. 「다음 주」 예정이나 확정일 없음.
Kimi K3와 비교하면?
독립 비교 83 대 80으로 동급. Kimi K3는 가중치 공개·제3자 점수 보유, Qwen3.8-Max는 API 가격·멀티모달 강점.
가중치 공개와 제3자 재현이 완료되기 전, Qwen3.8-27B 등 로컬 검증에는전용 Apple Silicon 실기가 재현성 측면에서 유리할 수 있습니다. VMSPIN 일 단위 클라우드 Mac mini는 MDM 자동 프로비저닝과 SSH+VNC 이중 접속을 제공합니다. Mac mini M4 렌탈 가이드와 요금 페이지도 함께 확인하세요.