Если вы в конце лета 2026 выбираете frontier API, таймлайн Grok 4.6 стоит вынести в отдельный watchlist: 28 июля Илон Маск ответил на X CEO Vercel Гильермо Раучу и заявил, что xAI выкатит Grok 4.6 около 7 августа с 1,5 триллионами параметров, а через пару недель — Grok 4.7 на 2,1T. Бенчмарков и прайсинга от xAI пока нет. Ниже — разбор по пяти осям: хронология, спеки, логика SFT/RL-апгрейда, конкурентная картина и спорные моменты. Всё, что держится на одном посте в соцсети, помечено отдельно.

Почему инженерам нужно следить за часами Grok 4.6 прямо сейчас

На бумаге это executive PR, но для engineering-команд бьёт по трём фронтам:

  • Окно выбора сжимается: Grok 4.5 вышел 8 июля; если 4.6 приземлится 7 августа, полезный shelf life флагмана — месяц. На фоне июльского взлома Hugging Face и регуляторной гонки вокруг GPT-6 cost model мульти-модельной оркестрации придётся пересчитывать ежемесячно.
  • Источник данных — один твит: параметры и SFT/RL-обещания для Grok 4.6/4.7 идут из единственного ответа Маска — без model card, в отличие от релиза Grok 4.5 с 15 бенчмарками. Интеграции должны закладывать date slip и смену спек.
  • Open-weight удар уже случился: Kimi K3 26 июля выложил полные веса — 2,8T params, 1M context — и набрал 1679 баллов в Frontend Code Arena. Если xAI за ~два месяца выкатит три frontier-модели, гонка смещается с raw scale на token efficiency и качество agent post-training.

Граница сразу: даты и параметры Grok 4.6/4.7 ниже — из X-поста Маска от 28 июля. Блог и продуктовые страницы xAI их не подтвердили. «Musk time» исторически сдвигается на дни–недели — перед продакшн-зависимостями сверяйтесь с официальными каналами xAI.

Таймлайн: от Grok 4.5 через 4.6 к 4.7

ДатаСобытие
8 июля 2026xAI релизит Grok 4.5 для coding и agentic work: co-training с Cursor на реальных dev-сессиях; контекст 500K; $2/$6 за миллион input/output tokens
16 июля 2026Kimi K3 от Moonshot AI выходит как hosted service
26 июля 2026Полный open-weight релиз Kimi K3 — 2,8T params, 1M context
28 июля 2026Маск публикует roadmap Grok 4.6/4.7 в ответ Раучу; в тот же день 1200+ сотрудников OpenAI, Anthropic и других лабов выпускают открытое письмо «Pacing the Frontier»
~7 августа 2026 (цель)Планируется Grok 4.6 — 1,5T params, фокус на SFT/RL upgrade
~конец авг.–начало сент. 2026 (оценка)Планируется Grok 4.7 — 2,1T params; Маск: лучше 4.6 по всем метрикам, кроме чуть более медленного serving, с лучшей token efficiency

Спеки и конкурентное сравнение

Строки Grok 4.6 и Claude Fable 5.1 — pre-release claims: полезны для тайминга и позиционирования, не для head-to-head бенчмарков.

МодельДатаПараметрыКонтекстЦена (in/out за 1M tokens)Статус
Grok 4.58 июл. 2026Не раскрыто500K$2 / $6В проде
Grok 4.6 (анонс)~7 авг.1,5TНе раскрытоНе раскрытоТолько твит, не вышел
Grok 4.7 (анонс)~конец авг.–нач. сент.2,1TНе раскрытоНе раскрытоТолько твит, не вышел
Kimi K326 июл. open-weight2,8T (MoE)1M$0,30 (cache hit) / $3 (miss) in, $15 outВ проде
Claude Fable 5.1 (слух)Слух: августНе раскрытоНе раскрытоСлух: уровень Fable 5 ($10/$50)Anthropic не подтвердил
GPT-5.6 SolВ продеНе раскрытоНе раскрытоНе раскрытоВ проде

Почему xAI давит на post-training, а не только на scale

Supervised fine-tuning (SFT) шлифует поведение на кураторских примерах; reinforcement learning (RL) учит правильным multi-step action sequences в agentic tasks. Фрейминг Маска про «significantly improved SFT & RL» продолжает playbook Grok 4.5: co-training на реальных Cursor dev-сессиях дал Terminal-Bench 2.1 — 83,3% и SWE-Bench Pro — 64,7%, при ~15 954 output tokens на SWE-Bench Pro task против 67 020 у Opus 4.8 — разрыв в эффективности 4,2×.

Скачок до 1,5T у Grok 4.6 — реальный scale-up, но framing Grok 4.7 — больше (2,1T), «лучше по всем фронтам, кроме чуть более медленного serving» — намекает на два SKU с разными latency/quality trade-offs, а не один universal model. Цель ~7 августа попадает почти через 10 дней после open-weight шока Kimi K3; Маск прокомментировал бенчмарки K3 словом «impressive», и большинство аналитиков читает сжатый cadence xAI как прямой ответ на OpenAI, Anthropic и китайские лабы.

Пятиступенчатый pre-release чеклист для разработчиков

Пока Grok 4.6 не вышел с официальной model card, не превращайте preview-спеки в продакшн-зависимости:

  1. Тегируйте уровни источников: X-пост Маска — directional; официальная model card Grok 4.5 — verified baseline. Не смешивать в SLA и cost models.
  2. Буферьте дату: +7–14 дней к 7 августу под «Musk time»; держите Grok 4.5 или Kimi K3 как fallback на критических release paths.
  3. Пересчитывайте token efficiency, а не только leaderboard rank: Grok 4.5 выигрывает меньшим числом output tokens на agent task; если 4.6 продолжит этот путь, счёт может быть ниже, чем у «умнее, но болтливее» конкурентов — ждите per-task token disclosures.
  4. Изолируйте eval-среды: preview-периоды часто означают shared sandboxes или локальные бенчмарки — растут state pollution и credential residue; чувствительные agent chains нуждаются в resettable dedicated hardware.
  5. Следите за августовским кластером релизов: слухи про Claude Fable 5.1 тоже целятся в август; когда Grok 4.6/4.7 приземлятся в один месяц, фиксируйте один prompt set и одну hardware environment, чтобы cross-week сравнения оставались валидными.

На что смотреть, прежде чем доверять таймлайну

  • Пока один источник: ответ Маска на X — нет blog post, model card или product page от xAI.
  • Бенчмарки и прайсинг — пусто: в отличие от детальной launch card Grok 4.5, у 4.6 нет независимых evals и официальной документации.
  • Отдельный трек — safety-скандалы xAI: в июле 2026 xAI подала в суд на пользователя за alleged использование Grok для генерации CSAM — первый такой иск, неявно признающий, что safeguards обходятся. Отчёт Common Sense Media от января 2026 поставил Grok среди худших чатботов по child-safety — релевантно для enterprise vendor risk, не для raw capability scores.
  • Столкновение с industry split по pacing: 28 июля — в день roadmap Маска — OpenAI и Anthropic на корпоративном уровне поддержали «Pacing the Frontier»; xAI нет в списке подписантов — divergent release strategies на виду.

Цитируемые факты и источники

  • Целевая дата Grok 4.6: ~7 августа 2026 — ответ Маска @rauchg 28 июля, не официальный анонс xAI.
  • Параметры Grok 4.6: 1,5T — тот же единственный social post, не верифицирован третьими сторонами.
  • Цены Grok 4.5: $2/$6 за миллион input/output tokens; контекст 500K — xAI «Introducing Grok 4.5» и официальная model card.
  • Agent-бенчмарки Grok 4.5: Terminal-Bench 2.1 83,3%, SWE-Bench Pro 64,7%; output token efficiency vs Opus 4.8 — model card xAI и сторонние сводки (eesel.ai, felloai.com).

Параметры, цены и скоры могут измениться на launch. Сверяйтесь с официальными страницами. Источники:

Официальный блог xAI — Introducing Grok 4.5

Официальная model card Grok 4.5 (media.x.ai)

Open-weight репозиторий Kimi K3 Moonshot AI (GitHub)

The Verge — coverage письма «Pacing the Frontier»

Часто задаваемые вопросы

Когда именно выйдет Grok 4.6?

Маск сказал «около 7 августа 2026» в X-посте, но xAI официально дату не подтвердил. Считайте целью, которая может сдвинуться.

Чем Grok 4.6 отличается от Grok 4.7?

Grok 4.6 — 1,5T params с фокусом на SFT/RL post-training improvements. Grok 4.7, ожидаемый через несколько недель, — 2,1T model; Маск утверждает, что он обходит 4.6 по всем метрикам, кроме serving speed, с лучшей token efficiency.

Побьёт ли Grok 4.6 Kimi K3 или Claude Fable 5.1?

Рано судить. У Grok 4.6 нет опубликованных бенчмарков, у Kimi K3 есть verified third-party scores, Claude Fable 5.1 Anthropic официально не анонсировал.

Сколько будет стоить Grok 4.6?

Неизвестно. Grok 4.5 стартовал с $2 за миллион input tokens и $6 за output — разумный ориентир, но xAI прайсинг 4.6 не раскрыл.

Где можно будет использовать Grok 4.6?

По rollout Grok 4.5: сначала Grok Build, xAI API и xAI console, затем third-party integrations — для 4.6 пока не подтверждено.

Плотность релизов frontier-моделей растёт, а multi-model agent evals на ноутбуке или shared VM — это больше state pollution, credential residue и accidental lateral movement. Переустановка на каждый swap модели — медленно и плохо воспроизводится. Если нужен resettable dedicated Apple Silicon physical node с SSH и VNC для изолированного сравнения Grok vs open-weight, посуточная аренда облачного Mac mini от VMSPIN обычно безопаснее; для долгосрочной экономики см. нашу статью о точке окупаемости покупки и аренды. Приземлится ли Grok 4.6 7 августа — неизвестно; lab environment не обязан ставить на календарь.