Что такое ИИ-агент Exa: API тратит до 3 часов на запрос и стоит до $100
Exa второго июня открыла доступ к Agent Ultra, самому ресурсоёмкому режиму своего API для ИИ-агентов, который тратит до трёх часов на один запрос и, по данным компании, обыгрывает конкурентов на четырёх бенчмарках.
Впервые API для агентного поиска продаётся с помётром «до исчерпания»: система сама решает, сколько подзадач создать и сколько источников прочесать, а платите вы только за фактически потраченные ресурсы, от одного до ста долларов за запрос.
До сих пор глубокий поиск по тысячам источников требовал ручной работы аналитика или цепочки промптов. Exa предлагает закрытый API, который берёт задачу целиком, разбивает её на подзадачи, раздаёт их параллельным подагентам и возвращает структурированный результат со ссылками. Об этом компания сообщила в своём официальном запуске, на который ссылается обзор MarkTechPost.
Что такое ИИ-агент в контексте Exa? Это программа, которая сама планирует шаги, ищет информацию в интернете и собирает ответ, а не просто генерирует текст по одному промпту.
| Показатель | Значение | Источник |
|---|---|---|
| Бенчмарки с лучшим результатом | 4 из 4 (WANDR, DeepSearchQA, WideSearch, Company Find-All) | Пост Exa о запуске |
| WANDR: отрыв от Opus 5.5 | +12,6 % (9,1 абсолютных пункта), при вдвое меньшей стоимости за задачу | Пост Exa о запуске |
| DeepSearchQA: отрыв от Perplexity | +4,7 %, стоимость на 46 % ниже, чем у GPT-6 Astra | Пост Exa о запуске |
| WideSearch: отрыв от Perplexity | +5,2 %, самая низкая стоимость за задачу среди четырёх систем | Пост Exa о запуске |
| Company Find-All: отрыв от Opus 5.5 | +1 579 %, самая низкая стоимость за найденную сущность | Пост Exa о запуске |
| Типичное время выполнения | Около 30 минут, потолок 3 часа | Документация Exa |
| Стоимость одного запуска | До 20 долларов по умолчанию, настраивается от 1 до 100 долларов | Документация Exa |
| Независимая проверка результатов | Отсутствует, все замеры от вендора | Пост Exa о запуске |
Как устроен замер?
Exa сравнила Agent Ultra с тремя конкурентами: Opus 5.5, GPT-6 Astra и Perplexity Agent. Каждый запускался в максимальном режиме усилий.
Четыре бенчмарка проверяют разное:
- WANDR (500 задач на глубокий и широкий сбор данных, разработан Perplexity, открытый фреймворк). Exa использовала тот же оценочный код, но подставила свой поисковый инструмент и модель gpt-6-luna в качестве судьи.
- DeepSearchQA (900 промптов на многошаговый поиск, разработан Google DeepMind).
- WideSearch (широкий сбор информации по теме).
- Company Find-All (поиск всех компаний, соответствующих заданным критериям).
Exa проверила до 200 задач на WANDR и DeepSearchQA и до 100 задач на WideSearch и Company Find-All. Количество оценённых задач различается между провайдерами.
Важный нюанс: приведённые проценты относительные, а не абсолютные. На WANDR разница с Opus 5.5 составляет 9,1 абсолютных пункта, что выглядит скромнее, чем «+12,6 %».
Что обнаружили?
- Agent Ultra показал лучший результат на всех четырёх бенчмарках по сравнению с Opus 5.5, GPT-6 Astra и Perplexity Agent (по данным Exa).
- На задаче Company Find-All отрыв от Opus 5.5 составил +1 579 %. Это самая впечатляющая цифра, но она объясняется тем, что Opus 5.5, вероятно, не заточен под полный перебор сущностей, а Ultra, по документации, «работает до исчерпания».
- Стоимость за задачу у Ultra оказалась ниже, чем у GPT-6 Astra, на 46 % на DeepSearchQA, а на WideSearch Ultra стоил дешевле всех четырёх систем.
- Режим Ultra оркестрирует (распределяет работу между) параллельными подагентами: для сложных шагов подключает «тяжёлые» модели, для простых использует быстрые. Какие именно модели под капотом, Exa не раскрывает.
Все результаты заявлены самой Exa и пока не воспроизведены независимо. Компания честно указывает это в своём посте. Выборка неполная: на каждом бенчмарке оценено от 100 до 200 задач, а не весь набор. Бенчмарк WANDR разработан Perplexity, но Exa изменила транспортную логику и подставила другую модель-судью, что может влиять на сопоставимость. Модель закрытая, с открытыми весами не распространяется и не может быть развёрнута локально.
Что это значит для вас?
Для тех, кто работает с контентом, маркетингом или бизнесом в России и СНГ, новость сводится к простому вопросу: стоит ли платить до 20 долларов за один поисковый запрос?
-
Авторам Дзена и копирайтерам. Agent Ultra заточен под задачи, которые вручную занимают часы: собрать все компании в нише, найти все научные статьи по технике, проверить факты по сотням источников. Если вы пишете обзорные материалы или исследуете тему для лонгрида, один запрос за 5-10 долларов может сэкономить рабочий день. Но для ежедневных коротких текстов это избыточно и дорого.
-
Маркетологам и B2B-командам. Exa прямо называет целевую аудиторию: построение списков компаний, обогащение данных, проверка контрагентов по публичным реестрам и судебным документам. Для российских финсервисов и компаний, которым нужна проверка KYC (идентификация клиента по открытым источникам), это может заменить дорогие локальные исследования, при условии, что API работает с русскоязычными источниками. Этого Exa пока не подтвердила.
-
Предпринимателям в РФ. API доступен через стандартный эндпоинт Exa, ограничений по странам компания не заявляет. Оплата по факту потребления. Но учитывайте: модель закрытая, данные уходят на серверы Exa, а для работы с конфиденциальными документами это может быть неприемлемо.
Цифры Exa выглядят сильно, особенно +1 579 % на Company Find-All. Но я бы не торопился менять рабочие инструменты до независимой проверки. Вендор тестирует сам себя, выбирает бенчмарки и модель-судью. Это не подлог, но и не доказательство.
Что действительно интересно: модель «плати за усилие, а не за токены». Вы ставите потолок в 5 или 50 долларов, а система сама решает, сколько подагентов запустить. Для сложных исследовательских задач, построить карту рынка, собрать все патенты по теме, проверить 200 контрагентов, это может оказаться дешевле, чем час работы аналитика. Проверить легко: зайдите в Exa API Playground и сравните результат с тем, что выдаёт Perplexity Pro на том же запросе.
Exa предлагает протестировать Ultra в своём Playground бесплатно, без привязки карты на первые запросы. Для тех, кому нужен глубокий автоматический поиск по англоязычным источникам, это конкретный инструмент, который можно проверить за полчаса.
По данным MarkTechPost.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Лаборатории подменяют определение AGI нейросетей, чтобы объявить победу раньше срока
Microsoft второго июня запустила Project Solara, операционную систему, где ИИ-агенты заменяют привычные приложения, и впервые отдала управление машине, а не…

Почему нет приложения Huawei Health в Google Play и чем его заменяет Google Health
Google Health на этой неделе начал раскатывать набор функций Health Guardian в одноимённом приложении, и владельцы Pixel Watch 3, 4 и 5 получили бесплатный…
Liquid AI ускорила видео-языковые модели в 3 раза на обычном Mac без потери качества
Liquid AI выпустила модель-черновик DSpark для своей видео-языковой модели LFM2.5-VL-3B, которая ускоряет генерацию текста по изображениям до трёх раз на…
Комментарии