> · · 6 мин

Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md

Codex теперь рулится голосом, а мультипапочный проект читает только один AGENTS.md

Голосовое управление в редакторах обычно заканчивается диктовкой: наговорил комментарий, он вставился, всё. OpenAI 23 июля выкатила другое: режим, в котором ты голосом не диктуешь текст, а раздаёшь задачи и спрашиваешь о статусе работ, идущих в других тредах. Плюс к этому в десктопном приложении починили давнюю боль: проект наконец может состоять больше чем из одной папки.

TL;DR: Обновление 26.715 приносит ChatGPT Voice на macOS и Windows: голосом можно запускать, проверять и корректировать задачи в Chat, Work и Codex. На macOS включается Screen context — модель видит снимок активного окна. Локальные проекты теперь собираются из нескольких папок, но AGENTS.md, скиллы и config.toml читаются только из основной. Двумя днями раньше вышел Codex CLI 0.145.0, где /import перетаскивает настройки из Cursor и Claude Code, а мультиагентный режим V2 объявлен стабильным.

Что делает ChatGPT Voice в десктопном приложении

Голосовой режим работает поверх full-duplex модели GPT-Live и работает не диктофоном, а пультом. Начинаешь чат или задачу голосом, а дальше просишь запустить, проверить или подправить работу в других тредах — включая задачи Codex.

Практически это выглядит так: пока Codex молотит рефакторинг в одном треде, ты голосом спрашиваешь, на каком он шаге, и говоришь ему заодно прогнать тесты в другом проекте. Руки при этом заняты чем-то ещё. Разница с обычной диктовкой в том, что модель не превращает речь в текст промпта, а исполняет её как управляющие команды над уже запущенными работами.

На macOS отдельно включается Screen context — режим, где ассистент получает снимок активного окна. Это закрывает главную дыру голосового интерфейса: не нужно словами описывать, что у тебя на экране.

Голос доступен на планах Plus, Pro, Business, Edu и Enterprise — в десктопном приложении и через Remote на iOS. На бесплатном тарифе его нет.

Мы писали про GPT-Live в июле как про анонс с листом ожидания. Вот он и доехал до продукта — правда, пока как фича приложения, а не как открытый разработчикам API.

Как работают мультипапочные проекты и где ловушка

Локальный проект в десктопном приложении теперь может включать несколько связанных папок: меню проекта → Edit project → добавить папки и выбрать основную. Ловушка в слове «основную».

Новые чаты, операции с git и автоматический поиск AGENTS.md, скиллов и config.toml идут только от основной папки. Вторичные папки остаются доступными для поиска по файлам, чтения и редактирования — но своей конфигурацией они не управляют.

Для монорепы это неважно. А вот для типичного расклада «фронт в одном репозитории, бэк в другом» это значит, что AGENTS.md бэкенда агент проигнорирует, если основной назначен фронт. Правила, которые ты аккуратно писал под второй проект, просто не подхватятся, и понять это по поведению агента сложнее, чем хотелось бы. Совет простой: назначай основной ту папку, чьи конвенции важнее, а критичные правила из второй продублируй в основной AGENTS.md.

Что приехало в Codex CLI 0.145.0

Релиз от 21 июля — тот случай, когда в CLI интереснее, чем в GUI. Три вещи стоят внимания.

/import теперь переносит чужие конфиги. Команда мигрирует настройки, MCP-серверы, плагины, сессии, команды и проектные memories из Cursor и Claude Code. Это ровно тот барьер, который держал людей на текущем инструменте: не жалко подписки, жалко полдня на перенос обвязки. Теперь перенос — одна команда:

npm install -g @openai/codex@0.145.0
codex
# внутри сессии
/import

Мультиагентный режим V2 объявлен стабильным. С настраиваемыми моделями для субагентов, уровнями рассуждения, конкурентностью и восстановлением ролей. То есть можно раздать дешёвую модель субагентам, а дорогую оставить координатору — и это больше не эксперимент. Настройки объединены под ключом agents. Отдельно в релиз завезли предупреждение: если выбрать Ultra-уровень рассуждения при высокой конкурентности субагентов, интерфейс скажет, что расход полетит быстро. Полезная мелочь, которую обычно узнают по счёту.

Экспериментальная постраничная история тредов с быстрым возобновлением, поиском, сохранёнными именами, поддержкой субагентов и memories. Для тех, у кого сессии живут неделями, это заметнее любого прироста на бенчмарке.

Подводные камни

  • Screen context только на macOS. На Windows голос есть, «покажи, что у меня на экране» — нет. Для команды на смешанном парке машин это означает два разных воркфлоу.
  • Основная папка забирает себе всю конфигурацию. AGENTS.md, скиллы и config.toml вторичных папок игнорируются. Это не баг, это описанное поведение, но оно тихое: агент просто не будет знать про твои правила.
  • Голос — не для опенспейса и не для бесплатного тарифа. Full-duplex означает, что модель слушает непрерывно; в шумном помещении это работает хуже, чем в демо. И на Free его нет вообще.
  • Голосом легче согласиться, чем прочитать. Управление работами через речь снижает трение — включая трение перед подтверждением действия. Если у агента включены авто-подтверждения команд, голосовой интерфейс делает опасный сценарий ещё удобнее. Прямо сейчас это стоит держать в голове вместе с атакой Agent Data Injection.
  • Аудио-стек OpenAI под деприкейтом. 20 июля объявлено, что легаси-семейства audio, realtime и транскрипции выключат 20 января 2027: gpt-realtime уедет на gpt-realtime-2.1, gpt-audio и gpt-4o-audio — на gpt-audio-1.5. Если ты строил свой голосовой интерфейс на этих моделях, сроки уже идут.
  • GPT-Live всё ещё не отдали в API. Голос в продукте есть, возможности повторить его у себя — пока нет.

Альтернативы

  • Claude Code с голосовым вводом через сторонние инструменты — диктовка вместо управления: наговариваешь промпт, дальше всё как обычно. Гибче по моделям, но координировать несколько тредов голосом не выйдет.
  • Локальные связки на Whisper и открытых TTS — вроде Voicebox, про который мы писали: всё на твоей машине, никакой подписки и утечки аудио, но full-duplex и понимания контекста экрана нет.
  • Codex CLI без GUI — если голос не нужен, вся ценность релиза достаётся из терминала: /import, стабильный мультиагентный режим и история тредов работают там же.

Вердикт

Ставить обновление стоит ради двух вещей, и голос среди них не первый: /import в CLI 0.145.0 снимает главный барьер миграции с Cursor и Claude Code, а стабильный мультиагентный V2 позволяет наконец разнести дорогую и дешёвую модели по ролям. Голосовой режим бери, если работаешь один в тихой комнате на маке — там Screen context превращает его из игрушки в рабочий инструмент. В опенспейсе или на Windows он останется демо. А мультипапочные проекты включай только после того, как решишь, чей AGENTS.md победит.

Как попробовать

  1. Обнови десктопное приложение до 26.715 и включи голосовой режим в новом чате. На macOS сразу включи Screen context, иначе половина смысла теряется.
  2. Попробуй самый показательный сценарий: запусти долгую задачу в Codex, перейди в другой тред и голосом спроси, на каком она шаге.
  3. Собери мультипапочный проект: меню проекта → Edit project → добавь вторую папку → назначь основную. Сразу проверь, читается ли нужный AGENTS.md.
  4. Поставь CLI: npm install -g @openai/codex@0.145.0, запусти /import и посмотри, что подтянулось из Cursor или Claude Code — сессии и MCP-серверы переезжают тоже.
  5. Если гоняешь субагентов, задай им отдельную модель через настройки agents и проследи за расходом первые пару прогонов: предупреждение про Ultra и высокую конкурентность там появилось не просто так.
  6. Полный список изменений — в чейнджлоге Codex.
$ ls ./related/

Похожие статьи

codex-cli-147-skills-import.md
Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу
> · 7 мин

Codex CLI 0.147 забирает скиллы прямо из Cursor и умеет сам себе одобрять команды. В том же релизе ужесточают песочницу

Codex CLI 0.147.0 импортирует скиллы, которыми управляет Cursor, синхронизирует диалоги Claude и Cursor без дублей и добавляет флаг --approve-for-me с автоматически проверяемыми одобрениями. Плюс поддержка финальной спеки MCP 2026-07-28 и десяток правок песочницы. Команды export наружу по-прежнему нет.

ai cursor agents codex
openai-astra-critical-cyber.md
OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена
> · 7 мин

OpenAI не может исключить, что её будущая модель находит 0-day сама. Часть работ по Astra остановлена

OpenAI объявила, что предварительные замеры Astra не позволяют исключить уровень Critical по кибербезопасности в её собственном Preparedness Framework. Это первый такой случай: все прежние модели, включая GPT-5.6 Sol, проходили уровнем ниже. Активности, не дотягивающие до усиленных требований, приостановлены, а мониторы теперь читают цепочку размышлений.

ai llm openai security
databricks-ai-coding-costs.md
Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8
> · 8 мин

Databricks выложила свою математику расходов на кодинг-агентов: минус 50% токенов от тюнинга харнесса, а Opus 5 вышел дороже Opus 4.8

Соучредитель Databricks с коллегами описал четыре рычага снижения расходов на агентный кодинг: тюнинг харнесса и кеша дал почти минус 50% токенов, роутер между моделями минус 30% средней цены задачи. Самое неприятное в статье: Stripe отказалась выдавать разработчикам Opus 4.7, а Databricks увидела рост стоимости при переходе с Opus 4.8 на Opus 5.

ai agents llm developer-tools
subscribe.sh

$ cat /dev/blog/updates

> Свежие заметки о программировании,

> DevOps и AI — прямо в мессенджер

./subscribe