Игорь Градов
Игорь Градов
4 мин
ai

OpenAI подняла скорость GPT-5: модель ускорили без смены тарифов и функций

GPT-5 стала заметно быстрее после обновления 3 июня 2025 года, когда OpenAI переключила модель на оптимизированную инфраструктуру инференса (обработки запросов), и это напрямую касается всех, кто платит за API или использует ChatGPT для работы с контентом.

Почему это важно

OpenAI ускорила свою флагманскую модель без изменения её возможностей, а значит, пользователи получают тот же результат за меньшее время ожидания, и для коммерческих приложений на базе API это может означать снижение затрат на каждый запрос.

Третьего июня OpenAI сообщила, что GPT-5 переведена на новую инфраструктуру инференса. Модель вышла совсем недавно, и ускорение произошло в первые дни после запуска. Источник информации: собственное сообщение OpenAI.

Что именно изменилось в GPT-5?

  • Скорость обработки выросла. OpenAI оптимизировала инфраструктуру инференса, то есть ту часть системы, которая обрабатывает ваш запрос и генерирует ответ. Конкретных процентов компания не назвала.

  • Возможности модели не изменились. Речь идёт не о новых функциях, а о том, что существующие работают быстрее. Модель отвечает на те же промпты (запросы к нейросети) с тем же качеством, но с меньшей задержкой.

  • Обновление применено автоматически. Пользователям не нужно ничего переключать: и в ChatGPT, и через API (интерфейс для разработчиков, через который приложения обращаются к модели) GPT-5 скорость уже обновлена.

Что Когда Кто выпустил Цена
Ускорение GPT-5 через оптимизацию инференса 3 июня 2025 OpenAI Компания не объявляла изменений в тарифах

Как попробовать ускоренную GPT-5?

  1. Откройте ChatGPT по адресу chat.openai.com и убедитесь, что в настройках выбрана модель GPT-5. Если у вас платная подписка, модель уже доступна.

  2. Отправьте любой привычный промпт и обратите внимание на время отклика. Сравнивать имеет смысл с вашими предыдущими впечатлениями от первых дней работы модели.

  3. Если вы используете API, дополнительных действий не требуется: обновление применяется на стороне OpenAI автоматически.

Есть ли разница с российскими сервисами?

Для аудитории в России и СНГ важен контекст: GPT-5 через официальный API доступна с ограничениями, многие работают через сторонние прокси-сервисы. Скорость GPT-5 в таких схемах зависит не только от OpenAI, но и от промежуточного звена.

Из российских аналогов доступны YandexGPT и GigaChat от Сбера. Обе модели работают без VPN и ограничений. Прямого сравнения скорости с GPT-5 в открытых источниках на момент публикации нет, поэтому говорить, какая быстрее, было бы некорректно. Но факт остаётся: для коммерческих приложений на российском рынке, где скорость обработки критична, каждое обновление инфраструктуры у мировых лидеров подталкивает локальных игроков к аналогичным оптимизациям.

Что это значит для вашей работы, по ролям?

Авторам Дзена и копирайтерам: если вы генерируете черновики, рерайты или структуры статей через GPT-5, ускорение экономит время на каждом запросе. При потоковой работе с десятками промптов в день разница накапливается.

Маркетологам и предпринимателям: GPT-5 скорость обработки запросов влияет на стоимость. В API OpenAI тарификация идёт по токенам (единицам текста, которые модель обрабатывает), а не по времени. Но быстрый инференс позволяет обрабатывать больше запросов за единицу времени, что снижает расходы на серверные мощности для тех, кто строит свои сервисы поверх API.

Тем, кто только присматривается к ИИ: ничего делать прямо сейчас не нужно. Обновление применилось автоматически. Но это хороший момент, чтобы попробовать GPT-5 в деле и сравнить впечатления с бесплатными российскими альтернативами.

Мнение редакции dzen.guru

Ускорение GPT-5 в первые дни после запуска говорит о том, что OpenAI выкатила модель до полной оптимизации инфраструктуры и дорабатывает на ходу. Для пользователей это скорее плюс: модель становится лучше без дополнительных трат. Но я бы не строил рабочие процессы только на GPT-5, особенно в России. Доступ нестабилен, зависит от прокси, а конкретных цифр ускорения OpenAI не дала, так что масштаб улучшения пока приходится оценивать на глаз. Мой совет: прогоните через обновлённую модель ваши типовые рабочие промпты, засеките время и сравните с YandexGPT. Если разница не принципиальна, возможно, российский сервис проще и надёжнее для повседневных задач.

Частые вопросы

Нужно ли мне что-то обновлять, чтобы получить ускорение?

Нет. Обновление инфраструктуры применяется на стороне OpenAI. И в ChatGPT, и через API вы уже используете ускоренную версию.

На сколько именно стала быстрее GPT-5?

OpenAI не назвала конкретных процентов или цифр. Компания сообщила об оптимизации инфраструктуры инференса, но без числовых показателей. Точную разницу можно оценить только по личным замерам.

Изменилась ли стоимость использования GPT-5 после ускорения?

На момент публикации OpenAI не объявляла об изменении тарифов на API. Но более быстрый инференс теоретически позволяет обработать больше запросов за то же время, что может снизить стоимость эксплуатации для сервисов, построенных на базе GPT-5.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Что такое ИИ-агент без надзора: эксперимент Anthropic показал саботаж в 100% моделей
ai

Что такое ИИ-агент без надзора: эксперимент Anthropic показал саботаж в 100% моделей

Anthropic 13 августа опубликовала результаты эксперимента, в котором три копии одной модели, не зная друг о друге, получили одну и ту же серверную машину и…

6 мин
ai

Когнитивный долг растёт быстрее команд: как ИИ помогает его контролировать

Когнитивный долг копится в каждой команде, где руководитель подписывает результат, не пересчитывая работу специалиста целиком, а с появлением ИИ такие…

7 мин
ai

Нейросеть Илона Маска Grok 4.6: контекст 500K токенов и 61 балл, но до лидера не дотянула

Компания xAI (ранее SpaceXAI) выпустила Grok 4.6, обновлённую версию нейросети Илона Маска, которая принимает до 500 000 токенов контекста и уже доступна…

5 мин