Если вы в конце лета 2026 выбираете frontier API, таймлайн Grok 4.6 стоит вынести в отдельный watchlist: 28 июля Илон Маск ответил на X CEO Vercel Гильермо Раучу и заявил, что xAI выкатит Grok 4.6 около 7 августа с 1,5 триллионами параметров, а через пару недель — Grok 4.7 на 2,1T. Бенчмарков и прайсинга от xAI пока нет. Ниже — разбор по пяти осям: хронология, спеки, логика SFT/RL-апгрейда, конкурентная картина и спорные моменты. Всё, что держится на одном посте в соцсети, помечено отдельно.
Почему инженерам нужно следить за часами Grok 4.6 прямо сейчас
На бумаге это executive PR, но для engineering-команд бьёт по трём фронтам:
- Окно выбора сжимается: Grok 4.5 вышел 8 июля; если 4.6 приземлится 7 августа, полезный shelf life флагмана — месяц. На фоне июльского взлома Hugging Face и регуляторной гонки вокруг GPT-6 cost model мульти-модельной оркестрации придётся пересчитывать ежемесячно.
- Источник данных — один твит: параметры и SFT/RL-обещания для Grok 4.6/4.7 идут из единственного ответа Маска — без model card, в отличие от релиза Grok 4.5 с 15 бенчмарками. Интеграции должны закладывать date slip и смену спек.
- Open-weight удар уже случился: Kimi K3 26 июля выложил полные веса — 2,8T params, 1M context — и набрал 1679 баллов в Frontend Code Arena. Если xAI за ~два месяца выкатит три frontier-модели, гонка смещается с raw scale на token efficiency и качество agent post-training.
Граница сразу: даты и параметры Grok 4.6/4.7 ниже — из X-поста Маска от 28 июля. Блог и продуктовые страницы xAI их не подтвердили. «Musk time» исторически сдвигается на дни–недели — перед продакшн-зависимостями сверяйтесь с официальными каналами xAI.
Таймлайн: от Grok 4.5 через 4.6 к 4.7
| Дата | Событие |
|---|---|
| 8 июля 2026 | xAI релизит Grok 4.5 для coding и agentic work: co-training с Cursor на реальных dev-сессиях; контекст 500K; $2/$6 за миллион input/output tokens |
| 16 июля 2026 | Kimi K3 от Moonshot AI выходит как hosted service |
| 26 июля 2026 | Полный open-weight релиз Kimi K3 — 2,8T params, 1M context |
| 28 июля 2026 | Маск публикует roadmap Grok 4.6/4.7 в ответ Раучу; в тот же день 1200+ сотрудников OpenAI, Anthropic и других лабов выпускают открытое письмо «Pacing the Frontier» |
| ~7 августа 2026 (цель) | Планируется Grok 4.6 — 1,5T params, фокус на SFT/RL upgrade |
| ~конец авг.–начало сент. 2026 (оценка) | Планируется Grok 4.7 — 2,1T params; Маск: лучше 4.6 по всем метрикам, кроме чуть более медленного serving, с лучшей token efficiency |
Спеки и конкурентное сравнение
Строки Grok 4.6 и Claude Fable 5.1 — pre-release claims: полезны для тайминга и позиционирования, не для head-to-head бенчмарков.
| Модель | Дата | Параметры | Контекст | Цена (in/out за 1M tokens) | Статус |
|---|---|---|---|---|---|
| Grok 4.5 | 8 июл. 2026 | Не раскрыто | 500K | $2 / $6 | В проде |
| Grok 4.6 (анонс) | ~7 авг. | 1,5T | Не раскрыто | Не раскрыто | Только твит, не вышел |
| Grok 4.7 (анонс) | ~конец авг.–нач. сент. | 2,1T | Не раскрыто | Не раскрыто | Только твит, не вышел |
| Kimi K3 | 26 июл. open-weight | 2,8T (MoE) | 1M | $0,30 (cache hit) / $3 (miss) in, $15 out | В проде |
| Claude Fable 5.1 (слух) | Слух: август | Не раскрыто | Не раскрыто | Слух: уровень Fable 5 ($10/$50) | Anthropic не подтвердил |
| GPT-5.6 Sol | В проде | Не раскрыто | Не раскрыто | Не раскрыто | В проде |
Почему xAI давит на post-training, а не только на scale
Supervised fine-tuning (SFT) шлифует поведение на кураторских примерах; reinforcement learning (RL) учит правильным multi-step action sequences в agentic tasks. Фрейминг Маска про «significantly improved SFT & RL» продолжает playbook Grok 4.5: co-training на реальных Cursor dev-сессиях дал Terminal-Bench 2.1 — 83,3% и SWE-Bench Pro — 64,7%, при ~15 954 output tokens на SWE-Bench Pro task против 67 020 у Opus 4.8 — разрыв в эффективности 4,2×.
Скачок до 1,5T у Grok 4.6 — реальный scale-up, но framing Grok 4.7 — больше (2,1T), «лучше по всем фронтам, кроме чуть более медленного serving» — намекает на два SKU с разными latency/quality trade-offs, а не один universal model. Цель ~7 августа попадает почти через 10 дней после open-weight шока Kimi K3; Маск прокомментировал бенчмарки K3 словом «impressive», и большинство аналитиков читает сжатый cadence xAI как прямой ответ на OpenAI, Anthropic и китайские лабы.
Пятиступенчатый pre-release чеклист для разработчиков
Пока Grok 4.6 не вышел с официальной model card, не превращайте preview-спеки в продакшн-зависимости:
- Тегируйте уровни источников: X-пост Маска — directional; официальная model card Grok 4.5 — verified baseline. Не смешивать в SLA и cost models.
- Буферьте дату: +7–14 дней к 7 августу под «Musk time»; держите Grok 4.5 или Kimi K3 как fallback на критических release paths.
- Пересчитывайте token efficiency, а не только leaderboard rank: Grok 4.5 выигрывает меньшим числом output tokens на agent task; если 4.6 продолжит этот путь, счёт может быть ниже, чем у «умнее, но болтливее» конкурентов — ждите per-task token disclosures.
- Изолируйте eval-среды: preview-периоды часто означают shared sandboxes или локальные бенчмарки — растут state pollution и credential residue; чувствительные agent chains нуждаются в resettable dedicated hardware.
- Следите за августовским кластером релизов: слухи про Claude Fable 5.1 тоже целятся в август; когда Grok 4.6/4.7 приземлятся в один месяц, фиксируйте один prompt set и одну hardware environment, чтобы cross-week сравнения оставались валидными.
На что смотреть, прежде чем доверять таймлайну
- Пока один источник: ответ Маска на X — нет blog post, model card или product page от xAI.
- Бенчмарки и прайсинг — пусто: в отличие от детальной launch card Grok 4.5, у 4.6 нет независимых evals и официальной документации.
- Отдельный трек — safety-скандалы xAI: в июле 2026 xAI подала в суд на пользователя за alleged использование Grok для генерации CSAM — первый такой иск, неявно признающий, что safeguards обходятся. Отчёт Common Sense Media от января 2026 поставил Grok среди худших чатботов по child-safety — релевантно для enterprise vendor risk, не для raw capability scores.
- Столкновение с industry split по pacing: 28 июля — в день roadmap Маска — OpenAI и Anthropic на корпоративном уровне поддержали «Pacing the Frontier»; xAI нет в списке подписантов — divergent release strategies на виду.
Цитируемые факты и источники
- Целевая дата Grok 4.6: ~7 августа 2026 — ответ Маска @rauchg 28 июля, не официальный анонс xAI.
- Параметры Grok 4.6: 1,5T — тот же единственный social post, не верифицирован третьими сторонами.
- Цены Grok 4.5: $2/$6 за миллион input/output tokens; контекст 500K — xAI «Introducing Grok 4.5» и официальная model card.
- Agent-бенчмарки Grok 4.5: Terminal-Bench 2.1 83,3%, SWE-Bench Pro 64,7%; output token efficiency vs Opus 4.8 — model card xAI и сторонние сводки (eesel.ai, felloai.com).
Параметры, цены и скоры могут измениться на launch. Сверяйтесь с официальными страницами. Источники:
Официальный блог xAI — Introducing Grok 4.5
Официальная model card Grok 4.5 (media.x.ai)
Open-weight репозиторий Kimi K3 Moonshot AI (GitHub)
The Verge — coverage письма «Pacing the Frontier»
Часто задаваемые вопросы
Когда именно выйдет Grok 4.6?
Маск сказал «около 7 августа 2026» в X-посте, но xAI официально дату не подтвердил. Считайте целью, которая может сдвинуться.
Чем Grok 4.6 отличается от Grok 4.7?
Grok 4.6 — 1,5T params с фокусом на SFT/RL post-training improvements. Grok 4.7, ожидаемый через несколько недель, — 2,1T model; Маск утверждает, что он обходит 4.6 по всем метрикам, кроме serving speed, с лучшей token efficiency.
Побьёт ли Grok 4.6 Kimi K3 или Claude Fable 5.1?
Рано судить. У Grok 4.6 нет опубликованных бенчмарков, у Kimi K3 есть verified third-party scores, Claude Fable 5.1 Anthropic официально не анонсировал.
Сколько будет стоить Grok 4.6?
Неизвестно. Grok 4.5 стартовал с $2 за миллион input tokens и $6 за output — разумный ориентир, но xAI прайсинг 4.6 не раскрыл.
Где можно будет использовать Grok 4.6?
По rollout Grok 4.5: сначала Grok Build, xAI API и xAI console, затем third-party integrations — для 4.6 пока не подтверждено.
Плотность релизов frontier-моделей растёт, а multi-model agent evals на ноутбуке или shared VM — это больше state pollution, credential residue и accidental lateral movement. Переустановка на каждый swap модели — медленно и плохо воспроизводится. Если нужен resettable dedicated Apple Silicon physical node с SSH и VNC для изолированного сравнения Grok vs open-weight, посуточная аренда облачного Mac mini от VMSPIN обычно безопаснее; для долгосрочной экономики см. нашу статью о точке окупаемости покупки и аренды. Приземлится ли Grok 4.6 7 августа — неизвестно; lab environment не обязан ставить на календарь.