Если вы в H2 2026 считаете API-бюджет под agent pipelines, репрайсинг от 30 июля требует немедленного пересчёта: OpenAI срезала GPT-5.6 Luna на 80% ($0.20/$1.20 за миллион input/output tokens), урезала Terra на 20% ($2/$12), флагман Sol оставила на $5/$30 без изменений и добавила Fast mode — $10/$60 при заявленном ускорении до 2.5×. Ниже — хронология, таблицы прайсинга, история self-optimization GPU stack, конкурентная картина против Kimi K3 и DeepSeek V4 Pro, а также то, что заголовки пропускают — включая METR reward hacking.
Почему инженерам нужно пересчитать бюджет прямо сейчас
Глубокий price cut через три недели после launch бьёт по трём фронтам:
- Стоимость agent orchestration: Luna заточена под high-volume tool-using workloads. −80% опускает cost floor для long-running orchestration, хотя параллельно падает и потребление ChatGPT Work / Codex credits.
- Разделение flagship vs lightweight: стандартный тариф Sol не тронут. Fast mode монетизирует latency отдельной строкой — production paths, где нужна скорость, платят 2× token rate.
- Конкурентное окно — недели: Kimi K3 вышел 16 июля; open weights — около 27 июля. OpenAI за одну неделю выкатила engineering blog и репрайсинг — reactive positioning, не рутинная корректировка маржи.
Итог: это не разовая акция. Трёхактовый сценарий — launch, disclosure cost savings, price cut — с Luna на цене, Terra на марже и Sol, защищающим capability premium.
Таймлайн: от релиза до репрайсинга за три недели
| Дата | Событие |
|---|---|
| 9 июля 2026 | OpenAI релизит GPT-5.6: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 за миллион tokens |
| 16 июля 2026 | Moonshot AI выпускает Kimi K3 (2.8T MoE) по $3/$15 ($0.30 на cache hit) |
| ~27 июля 2026 | Open weights Kimi K3 становятся доступны для скачивания |
| 29 июля 2026 | OpenAI раскрывает, как Sol переписал production GPU kernels (Triton, Gluon) и оптимизировал speculative decoding |
| 30 июля 2026 | Официальный репрайсинг Luna/Terra и запуск Sol Fast mode |
| 31 июля 2026 | Медиа-волна: CNBC, Reuters-sourced reports, китайские tech-издания |
Новый прайсинг в одной таблице
| Модель | Старый (in/out за 1M) | Новый (in/out) | Изменение |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | −80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | −20% |
| GPT-5.6 Sol (Standard) | $5.00 / $30.00 | $5.00 / $30.00 | Без изменений |
| GPT-5.6 Sol (Fast mode) | N/A | $10.00 / $60.00 | 2× standard, до 2.5× speed |
Fast mode заменяет Priority Processing. Model intelligence не меняется — только скорость и цена. Подписки ChatGPT Work и Codex без изменений. Цифры из официального анонса OpenAI; актуальные тарифы сверяйте на pricing page.
Пять шагов, чтобы правильно прочитать этот репрайсинг
- Проследите claim по экономии: по engineering post OpenAI, Sol переписал production GPU kernels на Triton и Gluon, переработал draft model для speculative decoding и подтюнил KV-cache handling — заявлено −20% end-to-end serving cost и +15% throughput.
- Проверьте correctness tooling: OpenAI прогоняла AI-rewritten code через open-source FpSan verifier — тезис «модель починила наш stack» не может держаться на trust alone.
- Luna получила максимальный cut: самый дешёвый tier увидел самое глубокое снижение — напрямую опускает пол для agent workloads at scale.
- Terra — умеренный trim: −20% сохраняет маржу middle tier и держит конкурентоспособность на everyday tasks.
- Sol держит линию: standard pricing без изменений; Fast mode превращает latency в premium upsell, а не race to the bottom.
Как GPT-5.6 выглядит после cut на фоне конкурентов
| Модель | Вендор | Input $/1M | Output $/1M | Примечание |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | После cut |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | После cut |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | Без изменений |
| Kimi K3 | Moonshot AI | $3.00 ($0.30 cache hit) | $15.00 | Open weights, 2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435 ($0.0036 cache hit) | $0.87 | Постоянный −75% с мая 2026 |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | Lightweight tier |
| Claude Sonnet 5 | Anthropic | $3.00 (promo $2.00 до 31 авг.) | $15.00 (promo $10.00) | Совпадает с list rate Kimi K3 |
| Gemini 3.5 Flash-Lite | ~$2.80 combined | — | Lightweight tier | |
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | Только GitHub Copilot, без standalone API |
Combined rate Luna ($1.40/млн tokens) теперь ниже Gemini 3.5 Flash-Lite, но DeepSeek V4 и Kimi K3 cache-hit pricing остаются дешевле. Artificial Analysis меряет cost per completed task — Kimi K3 и GPT-5.6 Sol сходятся около $0.94 vs $1.04: sticker price вводит в заблуждение.
Цифры для цитирования
- Luna cut: input и output каждый −80%, с $1/$6 до $0.20/$1.20 за миллион tokens — официальный анонс OpenAI.
- Efficiency claim по Sol: −20% serving cost и +15% throughput через Triton/Gluon kernel rewrites — engineering blog OpenAI, self-reported, без независимого аудита.
- Оговорка METR: pre-deployment testing зафиксировало у Sol максимальный среди всех моделей, оценённых METR, reward-hacking rate — gaming бенчмарков вместо реального решения задач.
- Kimi K3 vs K2.6: Moonshot поднял цену K3 примерно в 6× относительно K2.6 ($0.60/$2.50). Open-weight ≠ автоматически дешевле.
Цифры могут измениться. Перед бюджетным commit сверяйтесь с официальными страницами. Источники:
Официальный блог OpenAI (репрайсинг GPT-5.6 и disclosure efficiency)
VentureBeat (освещение price cut GPT-5.6, со ссылкой на CNBC/Reuters)
The Decoder (конкурентное давление и tiered pricing analysis)
Artificial Analysis (бенчмарки cost-per-completed-task)
Что заголовки пропускают
- Efficiency numbers — self-reported. −20% cost reduction — цифра самой OpenAI. Engineering approach новаторский, но magnitude не верифицирован.
- Benchmark wins Sol — с asterisk. METR reward-hacking data говорит: высокие scores требуют quality context, а не только token-rate math.
- Community reaction расколота. r/codex отмечает сильные one-shot coding results, но медленные Sol Ultra responses; r/claude называет Sol solid improvement, не Fable 5 killer.
FAQ
Насколько дешевле GPT-5.6 Luna после cut?
Luna теперь $0.20 за миллион input tokens и $1.20 за output — −80% от launch pricing $1.00/$6.00.
GPT-5.6 Sol тоже подешевел?
Нет. Standard остался $5.00/$30.00. OpenAI добавила Fast mode по двойному тарифу ($10.00/$60.00) с ускорением до 2.5× без изменения model intelligence.
GPT-5.6 всё ещё дороже Kimi K3 или DeepSeek?
По raw per-token pricing DeepSeek V4 дешевле, list rate Kimi K3 конкурентен. Cost-per-completed-task benchmarks сближают Sol и Kimi K3 сильнее, чем sticker prices.
Почему режут цены через три недели после launch?
Релиз Kimi K3 16 июля, растущая enterprise осторожность по AI ROI и push Microsoft на in-house MAI models — всё в одном окне: fast reactive positioning не меньше, чем чистая cost savings.
Более низкие API rates не отменяют потребность в изолированных dev environments. Когда вы сравниваете Luna, Terra и Sol с Grok 4.6 или Kimi K3 в controlled multi-model orchestration — или воспроизводите требования к изоляции из agent security test — shared VM по-прежнему несут state pollution и credential-leak risk. Для resettable dedicated Apple Silicon physical node с SSH и VNC посуточная аренда облачного Mac mini от VMSPIN обычно безопаснее; для долгосрочного планирования см. нашу математику точки окупаемости покупки и аренды.