Claude агенты и Codex перестают плодить сессии: 34% токенов уходило впустую
Новость сложная для адаптации: заголовок H1 «Claude и Codex прекращают поддержку агентов» прямо противоречит содержанию оригинала. Источник описывает не прекращение поддержки агентов, а переход от модели «каждый раз поднимать нового сабагента» к модели «переиспользовать уже открытые сессии». Это эволюция, а не отказ. Тем не менее H1 задан, я его не дублирую, но в теле излагаю факт точно.

Anthropic и OpenAI одновременно обновили инструменты для параллельной работы ИИ-агентов: Claude Code получил межсессионные сообщения и форки бесед, а Codex CLI с версии 0.149.0 добавил команду codex queue, и теперь уже открытые сессии принимают задания без запуска новых исполнителей.
Раньше каждая параллельная задача требовала нового сабагента (ИИ-агент с отдельным контекстным окном, выполняющий одну задачу), который заново загружал проект, сжигал токены (единицы текста, за которые платит пользователь) и терял кэш. Теперь живые сессии обмениваются данными напрямую, и конкретные замеры показывают, где именно утекали деньги.
Оба обновления вышли на фоне растущих жалоб разработчиков на стоимость координации между агентами. В HTTP-замере Claude Code версии 2.1.234 небольшой проверяющий сабагент на модели Haiku получил 20 993 входных токена на первом же ходе, из которых 7 133 (34%) составляла автоматически добавленная память из файла MEMORY.md. По сути, треть бюджета уходила ещё до начала полезной работы. Об этих цифрах и новых механизмах сообщает оригинальный разбор, на который опирается эта новость.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Межсессионные сообщения и форки бесед в Claude Code | Версия 2.1.234+ | Anthropic | Стоимость не раскрыта, тарификация по токенам |
Команда codex queue и codex agents в Codex CLI |
Версия 0.149.0 | OpenAI | Стоимость не раскрыта |
Инструменты list_threads, read_thread, send_message_to_thread в Codex Desktop |
Доступность зависит от версии приложения | OpenAI | Стоимость не раскрыта |
Сколько токенов сжигала старая схема?
Сабагент (исполнитель с отдельным контекстным окном) работает так: основной агент формулирует задание, передаёт контекст, ждёт результат и встраивает его обратно. Если задача мелкая, накладные расходы на координацию обходятся дороже самого исправления.
Конкретные потери из замеров:
- 34% входных токенов на старте сабагента Claude Code занимала автоматическая память MEMORY.md (7 133 из 20 993 токенов, HTTP-замер версии 2.1.234)
- Около 30 000 токенов статического контекста на старте каждого сабагента: инструкции, схемы инструментов, правила проекта и описание окружения (телеметрия на 95 сессиях и 1 777 сабагентах)
- 84% результата не доходило до вызывающей стороны: в зафиксированном баге (issue #81838) из 151 652 символов ответа сабагента вызывающая сторона получала только 24 353 (около 16%), потому что длинный ответ резался на сообщения и отдавалось лишь последнее
- Медианный простой при ожидании вложенного агента составлял около 9 минут при TTL кэша 5 минут, что приводило к подтверждённым потерям кэша в рассмотренной группе эпизодов
Отдельный случай с экспериментальными Agent Teams в версии 2.1.39 показал 42 226 вызовов readMailbox, 4 296 ответов «file not found», 23 запуска участников (из них продуктивных восемь) и примерно 2 часа 24 минуты работы командой, после чего ведущий агент добил оставшееся один за 18 минут. Это баг-репорт конкретной конфигурации, а не закон продукта.
Что пришло на замену?
Три операции вместо запуска нового исполнителя: прочитать соседний разговор, отправить ему сообщение, положить готовые данные в его историю.
В Codex CLI 0.149.0:
- Команда
codex queueотправляет сообщение в уже существующую локальную или удалённую сессию - Команда
codex agentsищет, запускает и управляет задачами
В Codex Desktop появились инструменты list_threads, read_thread и send_message_to_thread. Сессия слева находит соседний тред, отправляет инструкцию и забирает результат. Доступность зависит от среды и версии приложения.
В Claude Code добавлен форк (ответвление) текущей беседы. Форк наследует историю, системный промпт (начальная инструкция, задающая поведение модели) и инструменты, а первый запрос может использовать кэш родителя. Новому исполнителю не нужно заново объяснять проект.
В Codex MultiAgent V2 можно выбрать, сколько истории отдать новому исполнителю: от пустого контекста до полного форка, который наследует тип агента, модель и параметр reasoning effort родителя. По умолчанию передаётся всё.
Через app-server данные можно класть прямо в историю треда: если один чат уже разобрался в бэкенде, а второй занимается клиентом, их связывают без повторного объяснения проекта.
Как попробовать?
- Обновите Codex CLI до версии 0.149.0 или выше и проверьте доступность команды
codex queue(набравcodex queue --helpв терминале) - В Claude Code убедитесь, что версия не ниже 2.1.234, и попробуйте форкнуть текущую беседу: форк унаследует контекст и кэш
- В Codex Desktop проверьте наличие инструментов
list_threadsиsend_message_to_thread(доступность зависит от версии приложения)
Есть ли аналоги в России?
В российских ИИ-инструментах (YandexGPT, GigaChat от Сбера) агентный режим с параллельными сессиями на момент публикации не реализован. Обе платформы работают в формате одного диалога без возможности связать несколько бесед между собой.
| Возможность | Claude Code / Codex | YandexGPT / GigaChat |
|---|---|---|
| Параллельные агентные сессии | Да, с межсессионным обменом | Нет |
| Форк беседы с наследованием контекста | Да (Claude Code, Codex V2) | Нет |
| Отправка сообщения в соседнюю сессию | Да (codex queue, send_message_to_thread) |
Нет |
Для авторов из РФ, работающих с кодом, пока единственный путь к этим функциям лежит через прямой доступ к API Anthropic или OpenAI (с учётом ограничений на оплату и доступ из РФ).
Цифры из замеров впечатляют неприятно: треть бюджета на автоматическую память при старте, 84% результата теряется при возврате, двухчасовая командная работа заменяется восемнадцатиминутной одиночной. По моим наблюдениям, большинство авторов и маркетологов, использующих Claude агенты для работы с контентом, вообще не отслеживают, сколько токенов уходит на координацию между сабагентами.
Оговорка: все приведённые цифры потерь получены на конкретных конфигурациях и версиях. Между часто запускаемыми однотипными агентами переиспользование кэша, наоборот, работало.
Что сделать сегодня: если вы платите за Claude Code или Codex API и запускаете больше одного агента на проект, проверьте версию инструмента и переключитесь на межсессионные сообщения вместо запуска новых сабагентов. Экономия может быть заметной.
Что делать с этим прямо сейчас, по ролям
Автору Дзена. Если вы используете Claude агенты для подготовки контента (исследование темы в одном чате, написание в другом), новая механика форков позволяет не объяснять проект каждому новому «помощнику» заново. Это экономит и время, и деньги на токенах.
Маркетологу. Следите за расходами при агентной работе. 34% входных токенов на автоматическую память при каждом запуске нового исполнителя напрямую раздувают бюджет на ИИ-инструменты. Новые команды в Codex CLI помогают этого избежать.
Предпринимателю из РФ. Прямой доступ к Claude Code и Codex из России ограничен. Если ваша команда уже работает через API с обходными решениями, обновление до актуальных версий окупится на задачах, где раньше приходилось поднимать нескольких сабагентов.
Частые вопросы
Сабагенты совсем исчезли из Claude Code и Codex?
Нет. Механизм spawn_agent (создание нового исполнителя) никуда не делся. Появилась альтернатива: вместо запуска нового сабагента можно отправить задание в уже работающую сессию. Это не замена, а дополнительный вариант, который экономит на повторной загрузке контекста.
Насколько реально сэкономить на токенах с новой схемой?
По замерам, каждый новый сабагент Claude Code загружал около 30 000 токенов статического контекста на старте. Если задача не требует свежего исполнителя, межсессионное сообщение этот расход убирает. Точная экономия зависит от количества параллельных задач и размера проекта.
Работает ли codex queue с удалёнными сессиями?
Да. Согласно официальному changelog версии 0.149.0, codex queue отправляет сообщения как в локальные, так и в удалённые сессии.
Обновления пока доступны только через CLI и API, а не через массовые интерфейсы, так что большинству авторов имеет смысл дождаться упрощённого доступа или хотя бы проверить, не переплачивают ли они за лишних сабагентов прямо сейчас.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Баги нейросетей прошли 4 зелёных теста: как нейросеть спрятала ошибку в чужом поле
Почему это важно Четыре релиза прошли автоматические тесты с зелёным статусом, но нейросеть незаметно переместила данные в чужое поле, и ошибка попала в…

Google намеренно оставила ошибки в данных: зачем «грязные» датасеты машинного обучения работают лучше чистых
Компания Google недавно выложила набор данных для обучения модели, в котором намеренно оставила процент ошибок, и это вызвало дискуссию среди разработчиков:…

Что такое робототехника за пределами демороликов: пять барьеров до робота в каждом доме
Робототехника переживает бум обещаний, но между демо-роликами и реальным роботом, которого можно купить домой, лежит пропасть из нерешённых инженерных задач, и…
Комментарии