2026년 여름 말 프론티어 모델 API 선정을 검토 중이라면 Grok 4.6 일정은 따로 주시할 가치가 있습니다. 머스크는 7월 28일 X에서 Vercel CEO 길레르모 라우치에게 답글하며, xAI가 8월 7일 전후 1.5조 파라미터 Grok 4.6을 공개하고 몇 주 뒤 2.1조 파라미터 Grok 4.7도 내놓을 것이라고 밝혔습니다——다만 xAI 공식은 벤치마크 점수와 가격을 아직 공개하지 않았습니다. 본문은 타임라인, 핵심 데이터, SFT/RL 강화 논리, 경쟁 비교, 논점 다섯 축으로 정리하며 「머스크 한 마디」 수준의 미확인 정보를 명시합니다.
개발자가 지금 Grok 4.6 일정을 주목해야 하는 이유
겉보기엔 대기업 PR 같지만, 현장 엔지니어링 팀에는 세 가지 직접적 함의가 있습니다.
- 선정 창이 압축됩니다: Grok 4.5는 7월 8일에 막 공개됐습니다. 8월 7일에 Grok 4.6이 이어지면 플래그십 모델의 「유효 선반 기간」이 한 달 안팎일 수 있습니다. 7월 Hugging Face 침해와 GPT-6 규제 경쟁이 겹치면 멀티모델 오케스트레이션 비용 모델을 매달 다시 짜야 합니다.
- 정보원이 극단적으로 단일합니다: 현재 Grok 4.6/4.7 파라미터 규모와 SFT/RL 강화 폭은 머스크의 X 답글 하나에 의존합니다. 동반 모델 카드는 없습니다——Grok 4.5 출시 때 15개 벤치마크를 동시에 낸 방식과 대조됩니다. 통합 전에는 「일정 지연 + 사양 변경」 버퍼를 확보해야 합니다.
- 오픈소스 충격은 이미 착지했습니다: Kimi K3는 7월 26일 2.8조 가중치를 완전 오픈소스화했고 Frontend Code Arena 프로그래밍 랭킹 1679점으로 1위에 올랐습니다. xAI가 Musk time 페이스로 프론티어 모델 세 개를 연속 투입하면 경쟁 초점은 「파라미터 규모」에서 토큰 효율과 에이전트 후학습 품질로 옮겨갑니다.
먼저 경계를 밝힙니다. 아래 Grok 4.6/4.7 일정과 파라미터는 머스크 7월 28일 X 게시물에서 나왔으며, xAI 공식 블로그와 제품 페이지는 아직 동기화되지 않았습니다. 업계에서 말하는 「Musk time」은 실제 공개가 예고보다 며칠에서 2주 늦어질 수 있음을 뜻합니다——공개 전에는 xAI 공식 채널을 기준으로 하세요.
타임라인: Grok 4.5에서 4.6, 4.7까지 얼마나 빠른가
| 날짜 | 사건 |
|---|---|
| 2026년 7월 8일 | xAI가 Grok 4.5 정식 공개. 코딩·에이전트 태스크 플래그십으로 포지셔닝, Cursor 협업·실제 개발자 세션 데이터 학습. 50만 토큰 컨텍스트, 가격 백만 토큰당 입력 $2/출력 $6 |
| 2026년 7월 16일 | Moonshot AI Kimi K3 호스팅 서비스 런치 |
| 2026년 7월 26일 | Kimi K3가 예정보다 하루 일찍 완전 오픈웨이트 공개. 2.8조 파라미터, 100만 토큰 컨텍스트 |
| 2026년 7월 28일 | 머스크가 라우치 답글로 Grok 4.6·4.7 로드맵과 대략적 일정 최초 공개. 같은 날 OpenAI·Anthropic 등 1,200명 이상 직원이 「Pacing the Frontier」 공개 서한에 연서 |
| 약 2026년 8월 7일(목표) | Grok 4.6 공개 예정. 1.5조 파라미터, SFT·RL 레이어 강화가 핵심 |
| 약 2026년 8월 말~9월 초(추정) | Grok 4.7 후속 예정. 2.1조 파라미터. 머스크는 추론 속도는 다소 느리나 4.6을 전면적으로 능가하고 토큰 효율도 높다고 밝혔습니다 |
핵심 데이터 일람과 경쟁 횡단 비교
아래 표는 Grok 시리즈와 동기 경쟁의 알려진 사양을 모았습니다. Grok 4.6과 Claude Fable 5.1 행은 예고 또는 소문에 기반하며 공식 벤치마크 비교가 아닙니다.
| 모델 | 공개/목표 시기 | 파라미터 규모 | 컨텍스트 | 가격(입력/출력, 백만 토큰당) | 상태 |
|---|---|---|---|---|---|
| Grok 4.5 | 2026년 7월 8일 | 미공개 | 50만 토큰 | $2 / $6 | 공개됨 |
| Grok 4.6(예고) | 약 8월 7일 | 1.5조 | 미공개 | 미공개 | 공식 예고, 미공개 |
| Grok 4.7(예고) | 약 8월 말~9월 초 | 2.1조 | 미공개 | 미공개 | 공식 예고, 미공개 |
| Kimi K3 | 2026년 7월 26일 오픈소스 | 2.8조(MoE) | 100만 토큰 | $0.30(캐시 히트)/$3(미히트) 입력, $15 출력 | 공개됨 |
| Claude Fable 5.1(소문) | 소문상 8월 | 미공개 | 미공개 | 소문상 Fable 5 유지($10/$50) | Anthropic 미확인 |
| GPT-5.6 Sol | 공개됨 | 미공개 | 미공개 | 미공개 | 공개됨 |
심층 분석: 업그레이드 초점은 「더 크게」가 아니라 「더 잘 배우기」
지도 미세조정(SFT)은 수동 라벨이나 엄선된 고품질 샘플로 모델 출력 습관을 교정합니다. 강화학습(RL)은 보상 신호로 다단계 에이전트 태스크에서 올바른 액션 시퀀스를 가르칩니다. 머스크는 Grok 4.6 강화 초점을 단순 파라미터 적층이 아니라 「SFT & RL」에 둔다고 강조했습니다——Grok 4.5 방식의 연장입니다. Grok 4.5는 Cursor 협업의 실제 개발자 세션 후학습으로 Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%를 기록했고, 동종 태스크 출력 토큰은 약 1.9만으로 Claude Opus 4.8의 약 6.7만을 크게 밑돕니다.
Grok 4.6의 1.5조 파라미터는 분명한 규모 도약이지만, 머스크가 Grok 4.7에 대해 한 「더 크다(2.1조)가 추론은 다소 느리다」는 표현은 xAI가 「더 강함」과 「더 빠름」을 다른 SKU로 나누고 한 모델로 모든 시나리오를 커버하지 않겠다는 뜻을 시사합니다. Grok 4.6 목표일은 Kimi K3 완전 오픈소스 약 10일 뒤입니다. 머스크는 Kimi K3 평가 글에 「인상적」이라 댓글을 달았고, 업계는 xAI 속도 가속이 OpenAI·Anthropic·중국 업체와의 경쟁 격화와 직결된다고 널리 해석합니다.
공개 전 개발자가 실행할 다섯 단계 확인 체크리스트
Grok 4.6 공식 모델 카드가 나오기 전 아래 절차로 통합 리스크를 관리하고 「예고 파라미터」를 프로덕션 의존에 쓰지 마세요.
- 정보원 계층을 고정합니다: 머스크 X 게시물은 「방향성 예고」, Grok 4.5 공식 모델 카드와 xAI 보도자료는 「검증된 베이스라인」으로 분리하고 SLA·비용 산정에 섞지 않습니다.
- 일정 버퍼를 설정합니다: Musk time 관례대로 8월 7일 목표에 7~14일 지연을 더하고, 핵심 릴리스 경로에 Grok 4.5 또는 Kimi K3 폴백을 준비합니다.
- 벤치마크만이 아니라 토큰 효율을 재계산합니다: Grok 4.5 강점은 에이전트 태스크 출력 토큰 절감입니다. 4.6이 같은 길을 가면 「지능 지수는 높지만 출력이 긴」 모델보다 API 청구가 낮을 수 있습니다——태스크당 토큰은 공식 공개 후 판단합니다.
- 평가 환경을 격리합니다: 신모델 프리뷰 기간엔 공유 샌드박스·로컬 벤치마크가 많아 상태 오염·자격 증명 잔류 위험이 커집니다. 민감 에이전트 체인은 리셋 가능한 격리 하드웨어에서 검증합니다.
- 8월 집중 공개를 추적합니다: 소문상 Claude Fable 5.1도 8월을 가리키며 Grok 4.6/4.7과 같은 달에 나오면 비교 평가는 동일 프롬프트 세트·동일 하드웨어로 고정해 주간 간 비교 불가를 피합니다.
논점과 주의할 세부 사항
- 일정은 제3자 미검증입니다: 유일한 정보원은 머스크 X 답글이며 xAI 공식은 아직 동기화하지 않았습니다. 일정은 앞당겨지거나 미뤄질 수 있습니다.
- 벤치마크와 가격이 모두 공백입니다: Grok 4.5 출시 때 상세 모델 카드와 달리 Grok 4.6에는 독립 평가나 공식 모델 카드가 없습니다.
- xAI 콘텐츠 안전 논란: 7월 xAI는 사용자가 Grok 안전 제한을 우회해 CSAM을 생성했다는 혐의로 소송을 냈습니다——AI 생성 딥페이크 관련 회사 최초의 사용자 소송입니다. Common Sense Media 1월 보고서는 Grok을 미성년자 보호에서 가장 열악한 AI 제품 중 하나로 평가했습니다——기술 역량 평가와는 별개지만 기업 보안·컴플라이언스 투자와 관련됩니다.
- 업계 「감속」 호소와의 어긋남: 7월 28일 머스크가 로드맵을 낸 같은 날 OpenAI와 Anthropic은 회사 명의로 「Pacing the Frontier」 공개 서한을 뒷받침했습니다. xAI는 서명자에 없으며 「감속을 외치며 가속한다」는 업계 분열은 계속 지켜볼 가치가 있습니다.
인용 가능한 핵심 데이터와 출처
- Grok 4.6 목표일: 약 2026년 8월 7일——머스크 7월 28일 X 답글 @rauchg. xAI 공식 공고가 아닙니다.
- Grok 4.6 파라미터 규모: 1.5조——위 단일 SNS 게시물. 제3자 미검증.
- Grok 4.5 가격: 백만 토큰당 입력 $2, 출력 $6. 컨텍스트 50만 토큰——xAI 공식 「Introducing Grok 4.5」와 모델 카드.
- Grok 4.5 에이전트 벤치마크: Terminal-Bench 2.1 83.3%, SWE-Bench Pro 64.7%. 출력 토큰 효율은 Opus 4.8 상회——xAI 모델 카드와 제3자 정리(eessel.ai, felloai.com 등).
파라미터, 가격, 벤치마크는 정식 공개 시 바뀔 수 있습니다. 공식 페이지를 기준으로 하세요. 검증 가능한 출처는 다음과 같습니다.
xAI 공식 블로그 「Introducing Grok 4.5」
xAI Grok 4.5 공식 모델 카드(media.x.ai)
Moonshot AI Kimi K3 오픈소스 저장소(GitHub)
The Verge(Pacing the Frontier 공개 서한 보도)
자주 묻는 질문
Grok 4.6은 구체적으로 언제 출시되나요?
머스크는 「대략 8월 7일」이라고 했지만 비공식 발언이며 xAI가 확인한 공개일이 아닙니다. 실제 시기는 앞당겨지거나 늦어질 수 있습니다.
Grok 4.6과 Grok 4.7의 차이는 무엇인가요?
Grok 4.6은 1.5조 파라미터로 SFT·RL 후학습 강화가 핵심입니다. Grok 4.7은 2.1조 파라미터로 4.6 공개 몇 주 뒤 이어질 전망입니다. 머스크는 역량은 4.6을 전면 상회하나 추론 속도는 다소 느리고 토큰 효율은 높다고 밝혔습니다.
Grok 4.6이 Kimi K3나 Claude Fable 5.1보다 강해질까요?
현재로선 판단할 수 없습니다. Grok 4.6에는 공개 벤치마크가 없고 Kimi K3는 실측 데이터가 있으며 일부 프로그래밍 랭킹에서 두드러집니다. Claude Fable 5.1은 Anthropic이 공식 확인하지 않았습니다. 셋의 직접 비교는 아직 불가합니다.
Grok 4.6 가격은 어느 정도일까요?
공식 미발표입니다. Grok 4.5 가격(입력 $2/출력 $6, 백만 토큰당)을 대략적 참고로 쓸 수 있으나 신세대에서는 조정될 수 있습니다. 정식 발표를 반드시 기준으로 하세요.
일반 사용자는 어디서 Grok 4.6을 쓸 수 있게 될까요?
Grok 4.5 배포 경로로 보면 먼저 Grok Build, xAI 공식 API·콘솔에 올라간 뒤 서드파티로 단계 확대될 가능성이 큽니다. 구체적 진입점은 정식 공지를 기다려야 합니다.
프론티어 모델 공개 밀도가 높아질수록 로컬·공유 환경에서 멀티모델 에이전트 평가를 돌릴 때 상태 오염, 자격 증명 잔류, 의도치 않은 횡이동 위험도 커집니다. 모델을 바꿀 때마다 환경을 다시 깔기는 시간이 들고 재현도 어렵습니다. Grok과 오픈소스 모델 비교 테스트를 격리하려면 언제든 리셋 가능하고 머신 전용이며 SSH·VNC 이중 접근이 되는 Apple Silicon 물리 호스트가 필요합니다. VMSPIN 일 단위 클라우드 Mac mini가 더 안정적인 선택입니다. 장기 컴퓨팅 비용은 구매 vs 렌탈 손익분기점 산출도 참고하세요. Grok 4.6이 8월 7일에 착지할지는 미지수지만 실험 환경까지 일정에 걸 필요는 없습니다.