> · · обновлено · 5 мин

На чём кодить в июле 2026: расклад моделей по цене и задаче, когда флагманы дорожают каждую неделю

На чём кодить в июле 2026: расклад моделей по цене и задаче, когда флагманы дорожают каждую неделю

За последнюю неделю ландшафт перетряхнуло: Sonnet 5 стал дефолтом и получил хитрый токенизатор, Fable 5 доживает в подписках последние дни (с 12 июля — только кредиты по $10/$50), GPT-5.6 висит в закрытом превью, а локальные модели вроде Laguna XS 2.1 внезапно дышат в спину облачным. Легко запутаться и переплатить. Собрал практический расклад: что реально выбрать под задачу и бюджет, без маркетинга.

TL;DR: Единственной «лучшей модели» нет — есть роутинг-таблица под задачу. Рутина и высокий объём → Sonnet 5 ($2/$10 до 31 августа) или Haiku 4.5. Сложное с длинной автономией → Opus 4.8 ($5/$25). Гигантский контекст и многодневные сессии → Fable 5 ($10/$50, в подписках до 12 июля, дальше кредиты). Чувствительный код → локальный Laguna XS 2.1 или GLM-5.2. GPT-5.6 (Terra $2.50/$15) — мощно, но пока превью для избранных.

Сначала про ловушку «цены на бумаге»

Прайс за миллион токенов больше не говорит о реальной стоимости. Две причины. Первая — токенизатор: Sonnet 5 считает тот же текст в 1.0–1.35× больше токенов, сильнее всего на коде и неанглийских языках. «Неизменная» ставка $3/$15 в реальности бьёт дороже. Вторая — effort × автономность: агент на высоком effort с 15 tool-вызовами прожигает в разы больше, чем простой запрос-ответ, при той же модели. Поэтому мерять надо не cost per token, а cost per completed task. Модель с более высокой ставкой, которая доходит до результата за меньше шагов, часто выходит дешевле.

Расклад по задачам

Рутина, высокий объём, простые агенты. Классификация, извлечение, генерация по чёткой инструкции, real-time чат.

  • Claude Sonnet 5 — $2/$10 до 31 августа, потом $3/$15. Близко к Opus 4.8 на агентных задачах, быстрый. Дефолт для большинства.
  • Claude Haiku 4.5 — $1/$5. Ещё дешевле там, где качество Sonnet избыточно.
  • GPT-5.6 Luna — $1/$6, самый дешёвый в семье OpenAI. Но пока превью.

Сложные многошаговые агенты, длинная автономия. Тяжёлый рефакторинг, брошенный легаси, задачи с хрупкими тулами и восстановлением после ошибок.

  • Claude Opus 4.8 — $5/$25. По сравнениям в агентных сценариях заметно лучше держит цель на длинном контексте и восстанавливается после сбоя тула, где Sonnet 5 может заспиралить. За надёжность длинных циклов платишь премию.
  • GPT-5.6 Sol — $5/$30, SOTA на Terminal-Bench 2.1 (91.9% в ultra-режиме). Но доступ — только ~20 партнёрам под госнадзором.

Гигантский контекст, многодневные сессии. Кросс-модульные миграции, многодневный ресёрч, где промежуточную когерентность не восстановить из чекпоинтов.

  • Claude Fable 5 — $10/$50, 1M контекст, 128K output. Самая мощная публичная модель Anthropic. В подписках Pro/Max/Team только до 12 июля, дальше — usage credits вне плана. Дорого; берите строго под то, где реально нужен миллион токенов.

Чувствительный код, приватность, офлайн. NDA, госзаказ, «ничего не должно уходить с машины».

  • Laguna XS 2.1 (Poolside) — 33B MoE, крутится на Mac с 36 ГБ RAM, 70.9% на SWE-bench Verified. Локально бесплатно, по API $0.10/$0.20. Западная лаба.
  • GLM-5.2 / Qwen3.6 — сильные open-weight модели; Qwen3.6 обходит Laguna по бенчам, но это китайские модели — для части энтерпрайза стоп-фактор.

Мультимодалка и большой контекст по средней цене.

  • Gemini 3.1 Pro — $3.50/$10.50, нативная мультимодальность и большое окно. Хорош там, где нужны картинки/видео в контуре.

Как читать эту таблицу на практике

Не выбирайте одну модель на всё — стройте роутинг. Дешёвая модель на извлечение и классификацию, средняя на исполнение по спеке, дорогая — только на архитектурные решения и тяжёлую отладку. Логируйте, какая модель ответила на каждый запрос, и считайте стоимость завершённой задачи, а не токена. Это единственный способ не переплатить в мире, где флагман дорожает быстрее, чем вы успеваете переверстать пайплайн.

Подводные камни

  • Токенизаторный налог невидим в прайсе. Sonnet 5 и Opus 4.7+ считают токены плотнее. Если ваши промпты на русском и в коде — закладывайте верхнюю границу 1.35× к «официальной» ставке.
  • Даты подорожаний уже в календаре. Sonnet 5 дешевеет только до 31 августа, дальше +50%. Fable уходит из подписок в кредиты 12 июля. Планируйте пересчёт экономики под эти даты.
  • Превью ≠ доступ. GPT-5.6 звучит убедительно на бенчмарках, но купить Sol/Terra/Luna обычному разработчику пока нельзя — только ~20 партнёров. Не стройте продовый выбор на модели, которой у вас нет.
  • Open-weight бенчмарки — от вендора. Цифры Laguna и Qwen — их собственные прогоны. Верифицируйте на своей задаче, а не по релизным графикам.

Альтернативы стратегии «одна модель»

  • Роутер под задачу (Sonnet/Opus/Fable по типу запроса) — максимум экономии, минимум переплаты, но нужно логировать и мерять cost per task.
  • Один флагман на всё (например, только Opus 4.8) — проще в поддержке, дороже на рутине, где хватило бы Haiku/Sonnet.
  • Локальный стек (Laguna/GLM + open-source агент) — ноль счетов за токены и полный контроль над данными, но своё железо и потолок по качеству ниже фронтира.

Вердикт

Если не хотите думать — начните с Sonnet 5 как рабочей лошадки и эскалируйте на Opus 4.8, когда задача заслуживает премии; Fable держите строго под 1M-контекст. Если считаете деньги всерьёз — стройте роутинг и меряйте cost per completed task, а не per token: именно там прячется реальная экономия. А если код не должен покидать машину — локальный Laguna XS 2.1 сейчас достаточно хорош, чтобы закрыть большую часть кодинга без единого счёта за токены.

Как выбрать под себя

  1. Разбейте свои задачи на три корзины: рутина / сложное / гигантский контекст
  2. Назначьте базовую модель на каждую: Sonnet 5 → Opus 4.8 → Fable 5 (или локальный Laguna, если важна приватность)
  3. Включите prompt caching на стабильном контексте и лимит токенов на ход — экономит на любой модели
  4. Прогоните типовую задачу на двух кандидатах и сравните cost per completed task, а не цену за токен
  5. Поставьте напоминание на 25 августа (конец интро-цены Sonnet 5) и следите за публичным релизом GPT-5.6 — расклад скоро сдвинется
$ ls ./related/

Похожие статьи

codex-cli-147-skills-import.md
Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу
> · 7 мин

Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу

Codex CLI 0.147.0 импортирует скиллы, которыми управляет Cursor, синхронизирует диалоги Claude и Cursor без дублей и добавляет флаг --approve-for-me с автоматически проверяемыми одобрениями. Плюс поддержка финальной спеки MCP 2026-07-28 и десяток правок песочницы. Команды export наружу по-прежнему нет.

ai cursor agents codex
openai-astra-critical-cyber.md
OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена
> · 7 мин

OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена

OpenAI объявила, что предварительные замеры Astra не позволяют исключить уровень Critical по кибербезопасности в её собственном Preparedness Framework. Это первый такой случай: все прежние модели, включая GPT-5.6 Sol, проходили уровнем ниже. Активности, не дотягивающие до усиленных требований, приостановлены, а мониторы теперь читают цепочку размышлений.

ai llm openai security
databricks-ai-coding-costs.md
Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8
> · 8 мин

Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8

Соучредитель Databricks с коллегами описал четыре рычага снижения расходов на агентный кодинг: тюнинг харнесса и кеша дал почти минус 50% токенов, роутер между моделями минус 30% средней цены задачи. Самое неприятное в статье: Stripe отказалась выдавать разработчикам Opus 4.7, а Databricks увидела рост стоимости при переходе с Opus 4.8 на Opus 5.

ai agents llm developer-tools
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe