Игорь Градов
Игорь Градов
4 мин
ai

Нейросеть Илона Маска Grok 4.6 стала ИИ-агентом: от идеи до приложения за один проход

Нейросеть Илона Маска Grok получила обновление 4.6, которое сделало модель агентной: она способна самостоятельно вести проект от идеи до работающего приложения за несколько итераций, а по сводному рейтингу Artificial Analysis вышла на уровень GPT-5.6 Sol.

Нейросеть Илона Маска Grok 4.6 стала ИИ-агентом: от идеи до приложения за один проход
Почему это важно

Grok 4.6 впервые позиционируется не как чат-бот для ответов, а как долгоиграющий ИИ-агент (программа, которая сама планирует шаги, выполняет их и проверяет результат), и сразу доступна разработчикам через API и популярные инструменты по цене от 2 долларов за миллион токенов.

xAI, компания Илона Маска, до этого выпускала модели серии Grok, ориентированные на диалог и генерацию текста. Версия 4.6 развивает линейку в сторону агентного программирования и сложных визуальных задач. Модель уже доступна в Cursor, Grok Build, через API и на платформах OpenRouter, Vercel и Cloudflare.

Показатель Значение Источник
Сводный рейтинг Artificial Analysis Intelligence Index На уровне GPT-5.6 Sol xAI, блог «Introducing Grok 4.6»
Цена за миллион входных токенов от 2 долларов xAI, блог «Introducing Grok 4.6»
Цена за миллион выходных токенов от 6 долларов xAI, блог «Introducing Grok 4.6»
Ускоренная версия в два раза дороже стандартной xAI, блог «Introducing Grok 4.6»
Бонус первой недели удвоенный лимит в Grok Build и Cursor xAI, блог «Introducing Grok 4.6»
Бенчмарки, на которых проверялась Artificial Analysis, GDPVal-AA, DeepSWE 1.1, CursorBench 3.2, FrontierCode 1.1 xAI, блог «Introducing Grok 4.6»

Что измеряли?

xAI проверяла модель на пяти бенчмарках, каждый из которых оценивает разные грани «умного программиста».

  • Artificial Analysis Intelligence Index собирает результаты девяти отдельных тестов в один сводный балл: что-то вроде среднего балла ЕГЭ, но для нейросетей.
  • DeepSWE 1.1 проверяет, способна ли модель находить и исправлять баги в реальных репозиториях.
  • CursorBench 3.2 имитирует работу программиста в редакторе Cursor: модель должна писать, редактировать и дополнять код по контексту проекта.
  • FrontierCode 1.1 оценивает решение нестандартных алгоритмических задач.
  • GDPVal-AA тестирует понимание сложных технических и аналитических концепций.

Дополнительно xAI описывает, что нейросеть Илона Маска Grok 4.6 прошла расширенное тестирование безопасности, включая проверки от независимых сторонних организаций.

Что обнаружили?

  • Сводный рейтинг на уровне GPT-5.6 Sol. По данным xAI, в индексе Artificial Analysis модель показала результат, сопоставимый с флагманской моделью OpenAI.
  • Длительные агентные цепочки. Модель способна самостоятельно изучить незнакомую предметную область, продумать архитектуру приложения, реализовать ключевые сценарии, а затем улучшать результат в несколько итераций, проверяя собственную работу перед каждым следующим шагом.
  • Визуальные проекты с первой попытки. xAI отмечает, что Grok 4.6 за один проход формирует и структуру приложения, и его визуальный стиль, тогда как у Grok 4.5 на это уходило несколько итераций.
  • Обучение стало глубже. Модель прошла более длительное дообучение (fine-tuning, обучение модели на отобранных примерах под конкретные задачи), чем предшественница. Использовались синтетические данные от Grok 4.5, SFT-траектории (Supervised Fine-Tuning, обучение на размеченных примерах правильных ответов) и RL (Reinforcement Learning, обучение через систему наград и штрафов) на агентных задачах: программирование, веб-разработка, проектирование, оптимизация ядер.
Как это читать

Все бенчмарки и сравнение с GPT-5.6 Sol приводит сама xAI. Независимые воспроизведения результатов пока не опубликованы. Сводный индекс Artificial Analysis объединяет девять тестов, но методика взвешивания может влиять на итоговый балл. Конкретных числовых результатов по каждому отдельному бенчмарку xAI в блоге не привела, поэтому сравнивать «процент за процентом» с конкурентами пока нельзя.

Что это значит для вас?

Разработчикам. Grok 4.6 уже доступен в Cursor и через API. В первую неделю лимит использования удвоен, можно протестировать агентные цепочки на реальном проекте, не тратя бюджет. Цена от 2 долларов за миллион входных токенов (токен, это минимальная единица текста, примерно 3/4 слова на английском) делает модель одной из доступных для экспериментов.

Авторам Дзена и контент-маркетологам. Если вы используете ИИ для создания лендингов, интерактивных материалов или прототипов, агентный режим позволяет описать идею и получить рабочую первую версию, которую дальше дорабатывать итерациями. Модель сама проверяет результат перед следующим шагом, ошибок на выходе должно быть меньше.

Предпринимателям в РФ и СНГ. API Grok 4.6 доступен напрямую и через OpenRouter, Vercel, Cloudflare. Формально регион не ограничен, но потребуется зарубежная карта для оплаты. Из российских аналогов с агентными возможностями стоит следить за YandexGPT и GigaChat, хотя по публичным бенчмаркам их пока сложно сопоставить напрямую.

Мнение редакции dzen.guru

Нейросеть Илона Маска Grok в версии 4.6 делает заявку на прямую конкуренцию с GPT-5.6 Sol, и это смелый шаг, потому что до сих пор модели xAI воспринимались скорее как догоняющие. Я бы обратил внимание на два момента. Первый: агентный режим с самопроверкой, это именно то, чего не хватало для реальных рабочих задач, когда нужно не один ответ, а цепочка действий. Второй: удвоенный лимит в первую неделю, это прямое приглашение к тестированию, и грех им не воспользоваться. Но пока не появятся независимые замеры, я бы ставил на «попробовать» и сравнить с тем, что уже работает в вашем пайплайне, а не на «переходить».

Удвоенный лимит первой недели закончится быстро: если планируете протестировать агентные цепочки Grok 4.6 на своих задачах, откройте Cursor или Grok Build сегодня и загрузите туда реальный проект, а не синтетический пример.

По данным xAI, блог «Introducing Grok 4.6»

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Google Pixel Tag за $29 ищет вещи через миллиард Android-устройств
ai

Google Pixel Tag за $29 ищет вещи через миллиард Android-устройств

Google представила 11 ноября свой первый трекер для вещей Google Pixel Tag, который работает через зашифрованную сеть из более чем миллиарда устройств на…

5 мин
Мошенничество в нейросетях: сделка на $250 млн развалилась из-за поддельных подписей
ai

Мошенничество в нейросетях: сделка на $250 млн развалилась из-за поддельных подписей

Компания VideoVerse, индийский стартап в области автоматической нарезки видео с помощью ИИ, оказалась в центре крупного скандала: после сделки на 250 миллионов…

6 мин
6 бесплатных нейросетей открыли доступ одновременно: видео, голос и ИИ-агенты без оплаты
ai

6 бесплатных нейросетей открыли доступ одновременно: видео, голос и ИИ-агенты без оплаты

Компания Black Forest Labs открыла бесплатный доступ к модели FLUX 3 Video для генерации видео до 20 секунд со звуком, Manus продлил бесплатную акцию на…

6 мин