2026년 여름 중국 프론티어 모델 출시 흐름을 추적하며 Qwen3.8-Max를 프로덕션 API에 넣을지, 오픈 가중치를 기다릴지, Kimi K3·DeepSeek V4를 우선할지 판단해야 하는 개발자를 위해, 본문은 타임라인·핵심 스펙·횡단 비교·투명성 쟁점 네 축으로 정리합니다. 핵심 결론: 8월 3일 GA 시점 가중치는 미공개이며, 모든 벤치마크는 Alibaba 자체 테스트 하네스 기반입니다.

타임라인: 출시된 것과 아직 없는 것

  • 7월 16일: Moonshot AI, Kimi K3(2.8T MoE) 공개.
  • 7월 19일: Qwen3.8-Max 프리뷰, 정가의 10%, 활성 파라미터 미공개.
  • 7월 27일: Kimi K3 Hugging Face 오픈 가중치 공개.
  • 7월 31일: DeepSeek V4-Flash, 파라미터 증가 없이 V4-Pro 초과.
  • 8월 3일: Qwen3.8-Max GA, 「千问办公」Agent 동시 출시. 알리바바 주가 약 7% 상승.
  • 다음 주(8월 10일 전후 예상): Qwen3.8-Max·Qwen3.8-27B 가중치 예정, 저장소 없음.

Arena Text Arena(8월 1일 스냅샷) #5, 1496점(Preliminary). 상위 8위 중 유일한 비-Anthropic 모델이나, 점수는 벤더 자체 측정입니다.

Alibaba가 공개한 수치

항목Qwen3.8-Max
총/활성 파라미터2.4T / 95B
아키텍처희소 MoE + 하이브리드 어텐션
컨텍스트100만 토큰
API 가격입력 $2 / 출력 $6 (100만 토큰)
Arena 텍스트#5, 1496점(Preliminary)
오픈 가중치「다음 주」 예정, 미공개

2.4조 파라미터의 의미: MoE와 장기 에이전트

총 2.4T 대비 토큰당 활성 95B만 사용합니다. 추론 비용은 활성 수에 비례하므로 Claude Opus 5($5/$25)·Fable 5($10/$50)보다 낮은 $2/$6이 가능합니다. reasoning_effort는 low/medium/xhigh 3단계이며 enable_thinking 또는 Anthropic 호환 reasoning.effort로 지정합니다.

  1. API 호환(OpenAI/Anthropic)을 확인합니다.
  2. 작업별 reasoning_effort로 토큰 비용을 제어합니다.
  3. 로컬 배포는 Qwen3.8-27B 오픈 가중치를 기다립니다.
  4. 자체 워크로드로 A/B 테스트를 수행합니다.
  5. Hugging Face 저장소와 라이선스를 확인합니다.
  6. 이미 공개된 Kimi K3·DeepSeek V4를 베이스라인으로 삼습니다.

Qwen3.8-Max vs Kimi K3 vs DeepSeek V4 vs Claude

모델가격(입/출)오픈 가중치독립 벤치
Qwen3.8-Max$2 / $6미공개(예정)없음
Kimi K3$3 / $157월 27일 공개Artificial Analysis ≈ 57.11
DeepSeek V4-Flash미완전 공개공개됨V4-Pro 9벤치 초과
Claude Fable 5$10 / $50폐쇄Arena 텍스트 #1

독립 블라인드 테스트(269파일 설계 작업)에서 Kimi K3 83점, Qwen3.8-Max 프리뷰 80점으로 동급입니다. API 가격 맥락은 GPT-5.6 가격 인하 분석을 참고하세요.

검증 가능한 기술 정보와 출처

  • MoE 효율: 2.4T 총 / 95B 활성(Alibaba 발표 자료).
  • Arena: 8월 1일 스냅샷 #5, Preliminary 표기(Arena.ai).
  • 독립 맹검: 83 vs 80(제3자 평가, Alibaba 비실행).

Arena.ai 공개 리더보드

Alibaba Cloud 공식 발표·요금

「오픈소스」라벨 문제

  1. GA 당일 Open-Source 표시, 가중치 저장소 미공개.
  2. 모든 벤치마크는 벤더 자체 실행.
  3. 프리뷰 기간 활성 파라미터·모델 카드 미공개.

FAQ

지금 오픈소스인가요?

아닙니다. API는 사용 가능하나 Hugging Face/ModelScope에 가중치가 없습니다. 「다음 주」 예정이나 확정일 없음.

Kimi K3와 비교하면?

독립 비교 83 대 80으로 동급. Kimi K3는 가중치 공개·제3자 점수 보유, Qwen3.8-Max는 API 가격·멀티모달 강점.

가중치 공개와 제3자 재현이 완료되기 전, Qwen3.8-27B 등 로컬 검증에는전용 Apple Silicon 실기가 재현성 측면에서 유리할 수 있습니다. VMSPIN 일 단위 클라우드 Mac mini는 MDM 자동 프로비저닝과 SSH+VNC 이중 접속을 제공합니다. Mac mini M4 렌탈 가이드요금 페이지도 함께 확인하세요.