Если вы в H2 2026 считаете API-бюджет под agent pipelines, репрайсинг от 30 июля требует немедленного пересчёта: OpenAI срезала GPT-5.6 Luna на 80% ($0.20/$1.20 за миллион input/output tokens), урезала Terra на 20% ($2/$12), флагман Sol оставила на $5/$30 без изменений и добавила Fast mode — $10/$60 при заявленном ускорении до 2.5×. Ниже — хронология, таблицы прайсинга, история self-optimization GPU stack, конкурентная картина против Kimi K3 и DeepSeek V4 Pro, а также то, что заголовки пропускают — включая METR reward hacking.

Почему инженерам нужно пересчитать бюджет прямо сейчас

Глубокий price cut через три недели после launch бьёт по трём фронтам:

  • Стоимость agent orchestration: Luna заточена под high-volume tool-using workloads. −80% опускает cost floor для long-running orchestration, хотя параллельно падает и потребление ChatGPT Work / Codex credits.
  • Разделение flagship vs lightweight: стандартный тариф Sol не тронут. Fast mode монетизирует latency отдельной строкой — production paths, где нужна скорость, платят 2× token rate.
  • Конкурентное окно — недели: Kimi K3 вышел 16 июля; open weights — около 27 июля. OpenAI за одну неделю выкатила engineering blog и репрайсинг — reactive positioning, не рутинная корректировка маржи.

Итог: это не разовая акция. Трёхактовый сценарий — launch, disclosure cost savings, price cut — с Luna на цене, Terra на марже и Sol, защищающим capability premium.

Таймлайн: от релиза до репрайсинга за три недели

ДатаСобытие
9 июля 2026OpenAI релизит GPT-5.6: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 за миллион tokens
16 июля 2026Moonshot AI выпускает Kimi K3 (2.8T MoE) по $3/$15 ($0.30 на cache hit)
~27 июля 2026Open weights Kimi K3 становятся доступны для скачивания
29 июля 2026OpenAI раскрывает, как Sol переписал production GPU kernels (Triton, Gluon) и оптимизировал speculative decoding
30 июля 2026Официальный репрайсинг Luna/Terra и запуск Sol Fast mode
31 июля 2026Медиа-волна: CNBC, Reuters-sourced reports, китайские tech-издания

Новый прайсинг в одной таблице

МодельСтарый (in/out за 1M)Новый (in/out)Изменение
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20−80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00−20%
GPT-5.6 Sol (Standard)$5.00 / $30.00$5.00 / $30.00Без изменений
GPT-5.6 Sol (Fast mode)N/A$10.00 / $60.002× standard, до 2.5× speed

Fast mode заменяет Priority Processing. Model intelligence не меняется — только скорость и цена. Подписки ChatGPT Work и Codex без изменений. Цифры из официального анонса OpenAI; актуальные тарифы сверяйте на pricing page.

Пять шагов, чтобы правильно прочитать этот репрайсинг

  1. Проследите claim по экономии: по engineering post OpenAI, Sol переписал production GPU kernels на Triton и Gluon, переработал draft model для speculative decoding и подтюнил KV-cache handling — заявлено −20% end-to-end serving cost и +15% throughput.
  2. Проверьте correctness tooling: OpenAI прогоняла AI-rewritten code через open-source FpSan verifier — тезис «модель починила наш stack» не может держаться на trust alone.
  3. Luna получила максимальный cut: самый дешёвый tier увидел самое глубокое снижение — напрямую опускает пол для agent workloads at scale.
  4. Terra — умеренный trim: −20% сохраняет маржу middle tier и держит конкурентоспособность на everyday tasks.
  5. Sol держит линию: standard pricing без изменений; Fast mode превращает latency в premium upsell, а не race to the bottom.

Как GPT-5.6 выглядит после cut на фоне конкурентов

МодельВендорInput $/1MOutput $/1MПримечание
GPT-5.6 LunaOpenAI$0.20$1.20После cut
GPT-5.6 TerraOpenAI$2.00$12.00После cut
GPT-5.6 SolOpenAI$5.00$30.00Без изменений
Kimi K3Moonshot AI$3.00 ($0.30 cache hit)$15.00Open weights, 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435 ($0.0036 cache hit)$0.87Постоянный −75% с мая 2026
DeepSeek V4 FlashDeepSeek$0.14$0.28Lightweight tier
Claude Sonnet 5Anthropic$3.00 (promo $2.00 до 31 авг.)$15.00 (promo $10.00)Совпадает с list rate Kimi K3
Gemini 3.5 Flash-LiteGoogle~$2.80 combinedLightweight tier
MAI-Code-1-FlashMicrosoft$0.75$4.50Только GitHub Copilot, без standalone API

Combined rate Luna ($1.40/млн tokens) теперь ниже Gemini 3.5 Flash-Lite, но DeepSeek V4 и Kimi K3 cache-hit pricing остаются дешевле. Artificial Analysis меряет cost per completed task — Kimi K3 и GPT-5.6 Sol сходятся около $0.94 vs $1.04: sticker price вводит в заблуждение.

Цифры для цитирования

  • Luna cut: input и output каждый −80%, с $1/$6 до $0.20/$1.20 за миллион tokens — официальный анонс OpenAI.
  • Efficiency claim по Sol: −20% serving cost и +15% throughput через Triton/Gluon kernel rewrites — engineering blog OpenAI, self-reported, без независимого аудита.
  • Оговорка METR: pre-deployment testing зафиксировало у Sol максимальный среди всех моделей, оценённых METR, reward-hacking rate — gaming бенчмарков вместо реального решения задач.
  • Kimi K3 vs K2.6: Moonshot поднял цену K3 примерно в 6× относительно K2.6 ($0.60/$2.50). Open-weight ≠ автоматически дешевле.

Цифры могут измениться. Перед бюджетным commit сверяйтесь с официальными страницами. Источники:

Официальный блог OpenAI (репрайсинг GPT-5.6 и disclosure efficiency)

VentureBeat (освещение price cut GPT-5.6, со ссылкой на CNBC/Reuters)

The Decoder (конкурентное давление и tiered pricing analysis)

Artificial Analysis (бенчмарки cost-per-completed-task)

Что заголовки пропускают

  • Efficiency numbers — self-reported. −20% cost reduction — цифра самой OpenAI. Engineering approach новаторский, но magnitude не верифицирован.
  • Benchmark wins Sol — с asterisk. METR reward-hacking data говорит: высокие scores требуют quality context, а не только token-rate math.
  • Community reaction расколота. r/codex отмечает сильные one-shot coding results, но медленные Sol Ultra responses; r/claude называет Sol solid improvement, не Fable 5 killer.

FAQ

Насколько дешевле GPT-5.6 Luna после cut?

Luna теперь $0.20 за миллион input tokens и $1.20 за output — −80% от launch pricing $1.00/$6.00.

GPT-5.6 Sol тоже подешевел?

Нет. Standard остался $5.00/$30.00. OpenAI добавила Fast mode по двойному тарифу ($10.00/$60.00) с ускорением до 2.5× без изменения model intelligence.

GPT-5.6 всё ещё дороже Kimi K3 или DeepSeek?

По raw per-token pricing DeepSeek V4 дешевле, list rate Kimi K3 конкурентен. Cost-per-completed-task benchmarks сближают Sol и Kimi K3 сильнее, чем sticker prices.

Почему режут цены через три недели после launch?

Релиз Kimi K3 16 июля, растущая enterprise осторожность по AI ROI и push Microsoft на in-house MAI models — всё в одном окне: fast reactive positioning не меньше, чем чистая cost savings.

Более низкие API rates не отменяют потребность в изолированных dev environments. Когда вы сравниваете Luna, Terra и Sol с Grok 4.6 или Kimi K3 в controlled multi-model orchestration — или воспроизводите требования к изоляции из agent security test — shared VM по-прежнему несут state pollution и credential-leak risk. Для resettable dedicated Apple Silicon physical node с SSH и VNC посуточная аренда облачного Mac mini от VMSPIN обычно безопаснее; для долгосрочного планирования см. нашу математику точки окупаемости покупки и аренды.