> · · 6 мин

GPT-5.6 выходит для всех: Terra отдаёт уровень GPT-5.5 за полцены, а за запись кеша OpenAI теперь берёт деньги

GPT-5.6 выходит для всех: Terra отдаёт уровень GPT-5.5 за полцены, а за запись кеша OpenAI теперь берёт деньги

Месяц назад OpenAI показала GPT-5.6 и тут же заперла её за списком из двадцати «доверенных партнёров» — так потребовало правительство США. Ставки на Polymarket на публичный релиз прыгали от 83% к 18% и обратно. Вчера всё закончилось: Минторг дал добро, а Альтман написал в X «GPT-5.6 sol launches thursday! happy building». Четверг — это сегодня.

TL;DR: С 9 июля GPT-5.6 Sol ($5/$30), Terra ($2.50/$15) и Luna ($1/$6) открываются всем в API, Codex и ChatGPT. Terra даёт уровень GPT-5.5 за полцены. Впервые у OpenAI появилась плата за запись кеша: 1.25x от input-цены. И это первый релиз фронтир-модели, дату которого фактически назначило государство.

Что именно выходит 9 июля?

Три модели: Sol — флагман для сложного ризонинга и агентских задач, Terra — рабочая лошадка с производительностью «на уровне GPT-5.5 вдвое дешевле» (формулировка OpenAI), Luna — быстрый бюджетник. Плюс два режима, которых раньше не было: reasoning effort max и ultra — последний поднимает субагентов для параллельной работы над задачей.

Заодно OpenAI сменила систему имён: цифра означает поколение, а Sol/Terra/Luna — постоянные тиры, которые будут обновляться каждый своим темпом. Тибо Соттио, глава Codex, подтвердил, что Sol Ultra появится в Codex. На Terminal-Bench 2.1 OpenAI заявляет 88.8% у Sol и 91.9% у Sol Ultra против 88.0% у Claude Mythos 5. Числа вендорские, независимых прогонов пока нет, а в сносках OpenAI сама признаёт, что латентности «пересчитаны» с закрытого alpha-API.

Сколько стоят Sol, Terra и Luna?

За миллион токенов (input / output):

  • Sol — $5 / $30. Ровно цена GPT-5.5: апгрейд бесплатный.
  • Sol Fast mode — $12.50 / $75, до 750 токенов в секунду на кластерах Cerebras (с июля, сначала избранным клиентам).
  • Terra — $2.50 / $15. Ровно цена GPT-5.4.
  • Luna — $1 / $6. Новый тир между GPT-5.4 mini ($0.75/$4.50) и Terra.

Расклад прозрачный: Sol и Terra стоят ровно как GPT-5.5 и GPT-5.4, но сильнее. Держаться за старые модели незачем, и их деприкейшн — вопрос времени. GPT-4o и первые GPT-5 уже исчезли со страницы цен OpenAI, так что механика знакомая.

Почему кеш теперь платный?

Впервые у OpenAI запись в кеш стоит денег: 1.25x от обычной input-цены. Раньше automatic prompt caching был бесплатным на запись, платили только за чтение (10% цены). Взамен дают предсказуемость: явные cache breakpoints и гарантированные 30 минут жизни кеша — раньше кеш жил считаные минуты и мог исчезнуть под нагрузкой.

Это модель Anthropic, скопированная почти под кальку: у Claude запись тоже 1.25x, чтение 10%. Для чат-приложений с редкими повторными запросами это подорожание на ровном месте. Для агентов с плотными циклами тул-коллов — наоборот, выигрыш, потому что 30-минутный TTL переживает долгие паузы между шагами. Считать надо на своём трафике, и до миграции, а не после.

Anthropic ответила за сутки до запуска

Вчера же Anthropic продлила промо-доступ к Fable 5 до 12 июля: до 50% недельных лимитов подписки без доплаты. Промо должно было закончиться 7-го — мы разбирали эту историю, и уже тогда продление выглядело подготовкой к чужому релизу. Теперь понятно, к какому именно.

У этой гонки есть второй слой — государственный. Fable 5 в июне попала под экспортный контроль и пропала на три недели, GPT-5.6 месяц просидела в «превью для двадцати компаний», и обе вышли только после одобрения Вашингтона. OpenAI прямо пишет, что не хочет, чтобы такой процесс стал нормой. Но прецедент создан дважды за месяц: дату релиза фронтир-модели теперь согласовывают.

Подводные камни

  • Платный кеш распространяется на все будущие модели. Формулировка OpenAI: «для GPT-5.6 и последующих». Пайплайны с большим числом уникальных промптов (RAG с длинными документами, батч-обработка) получат до +25% к input-счёту без единого изменения в коде.
  • Fast mode стоит 2.5x. 750 ток/с звучит сказочно, но $75 за миллион output — дороже Fable 5 ($50). Скорость продаётся как отдельный премиум-тир.
  • Бенчмарки вендорские, с оговорками мелким шрифтом. Харнесс ExploitBench принадлежит OpenAI, латентности пересчитаны с alpha-API, а реальные результаты «may vary substantially» — это цитата из их собственных сносок.
  • «Launches Thursday» не значит «всё и сразу». В превью доступ приходил волнами; глобальный rollout в ChatGPT обещан «starting July 9». Пустой пикер утром — это нормально, вечером проверьте ещё раз.

Альтернативы

  • Claude Sonnet 5 — $2/$10 до 31 августа (потом $3/$15), 1M контекста. Дешевле Terra, но новый токенизатор ест примерно на 30% больше токенов, и для кириллицы это больнее всего.
  • Claude Fable 5 — $10/$50, до 12 июля внутри подписок. Главный соперник Sol по агентике, но вдвое дороже и с жёсткими safety-классификаторами, которые иногда режут легитимные задачи.
  • DeepSeek V4-Pro — $0.435/$0.87, open weights, 1M контекста. На порядок дешевле; для некритичных агентских задач вопрос «зачем платить $30 за output» звучит всё громче.
  • Gemini 3.5 Pro — обещана «в июле» с 2M контекста, но Google уже сорвал июньский срок, так что закладываться на неё рано.

Вердикт

Сидишь на GPT-5.5 — мигрируй на Terra: тот же уровень за полцены, единственная обязательная проверка — кеш-экономика на твоём трафике. Sol бери на сложную агентику, но подожди независимых бенчей, вендорским цифрам про «побили Mythos 5» верить пока рано. Luna интересна ценой, только между ней и open-weights моделями вроде GLM-5.2 и DeepSeek V4 конкуренция жёстче, чем кажется OpenAI.

Как попробовать

  1. Проверь страницу цен OpenAI — модели появятся там в течение дня.
  2. В Codex CLI набери /model — Sol, Terra и Luna уже засветились в пикере превью-сборок.
  3. Прогони обычный пайплайн на Terra параллельно с GPT-5.5 и сравни счёт с учётом новой цены кеш-записи.
  4. Для длинных агентских цепочек попробуй режим ultra, когда Sol Ultra доедет до Codex.
  5. Детали — в анонсе OpenAI и system card.
$ ls ./related/

Похожие статьи

deepseek-v4-flash-0731-verbosity.md
DeepSeek V4 Flash: №3 по интеллекту и последнее место по знаниям. Один чекпоинт, два индекса, 210 млн токенов
> · 8 мин

DeepSeek V4 Flash: №3 по интеллекту и последнее место по знаниям. Один чекпоинт, два индекса, 210 млн токенов

У Artificial Analysis DeepSeek V4 Flash 0731 — третье место по интеллекту из 101 модели и первое по цене кеш-хита. У BenchLM та же модель в категории «знания» стоит на 55-м месте из 55. Оба индекса корректны. Разбираем, почему так выходит, куда уходят деньги при прайсе $0,14 за миллион и какие циркулирующие бенчмарки относятся к апрельскому превью, а не к новому чекпоинту.

ai llm benchmarks deepseek
qwen-38-max-launch.md
> · 8 мин

Qwen3.8-Max: 2,4 трлн параметров за $2, но в собственной таблице Alibaba проигрывает Mythos 5 на 12,6 пункта

Alibaba выпустила Qwen3.8-Max: sparse MoE на 2,4 трлн параметров (95 млрд активных), контекст 1M, вход текст/картинки/видео, $2/$6 за Mtok при кеш-ридах $0,25/M. Открытые веса обещаны «на следующей неделе» и пока не вышли. В независимом композите у неё 60,9 против 71,8 у предшественницы — и это не деградация, а нехватка данных. Разбираем, как не попасться на оба числа.

ai llm benchmarks qwen
fake-sqlite-cves-llm-slop.md
Шесть критических CVE в SQLite выдумала LLM. Одной дали 10.0, а функции из отчёта не существует
> · 8 мин

Шесть критических CVE в SQLite выдумала LLM. Одной дали 10.0, а функции из отчёта не существует

Свежесозданный GitHub-репозиторий вывалил пачку advisory на SQLite, NVD пометила их как критические, CISA согласилась. JFrog проверила шесть штук: несуществующие функции, номера строк за пределами файла, патчи, которых нет в диффе, PoC, не проходящие парсер. MITRE отклонила всю пачку из 50+ CVE. Разбираем, как выдумка получает 9.8, и чек-лист проверки любой CVE за пять минут.

ai llm security cve
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe