6 000 взломанных нейросетей на Hugging Face: Baseten строит открытый стандарт AI Safety
Компания Baseten в среду запустила Base Labs и партнёрство с Hugging Face и Goodfire AI, чтобы создать открытый стандарт безопасности для моделей с открытыми весами, на фоне того как число «взломанных» моделей на Hugging Face перевалило за шесть тысяч.

Впервые крупный провайдер инференса предлагает встраивать защиту в открытые модели на этапе обучения и развёртывания, а не прикручивать её постфактум, и это может стать шаблоном для всех, кто публикует или использует опенсорс-модели.
Baseten, провайдер инференса (запуск и обслуживание нейросетей в продакшене), объявил о создании исследовательского подразделения Base Labs и партнёрстве с платформой Hugging Face и стартапом Goodfire AI. По данным самой компании, цель проекта выстроить инфраструктуру оценки и мониторинга безопасности для моделей с открытыми весами (open weights, когда параметры модели доступны для скачивания и модификации). Источник новости: публикация Baseten и её партнёров.
| Параметр | Значение |
|---|---|
| Кто | Baseten (Base Labs), Hugging Face, Goodfire AI |
| Сумма последнего раунда Baseten | 1,5 млрд долларов (Series F, июнь) |
| Оценка Baseten после раунда | 13 млрд долларов |
| Последний раунд Goodfire AI | 150 млн долларов (Series B, лид B Capital) |
| Тип события | Запуск исследовательского подразделения и партнёрства |
Что на самом деле произошло?
Base Labs, исследовательское крыло, которое Baseten выделил в отдельную структуру в этом году, будет разрабатывать и публиковать методы обучения и мониторинга открытых моделей. Ключевое слово здесь «открытые»: речь не о закрытых моделях вроде GPT или Claude, а о тех, чьи веса можно скачать, изменить и запустить у себя.
Проблема, которую партнёрство пытается решить, называется абилитерация (abliteration). Это техника, позволяющая снять встроенные ограничения безопасности с открытой модели. По данным Hugging Face, на платформе уже размещено более 6 000 абилитерированных моделей, то есть моделей, у которых удалены защитные фильтры.
Baseten позиционирует будущий стандарт как прозрачный и встроенный в процесс обучения и развёртывания моделей. Не «заплатка поверх готового продукта», а часть архитектуры с самого начала.
Детали технической реализации партнёрства пока не раскрыты. Однако роли участников просматриваются: Goodfire AI специализируется на интерпретируемости, то есть на том, чтобы объяснять, как именно модель принимает решения (открывать так называемый «чёрный ящик»). Именно эта компания, по логике анонса, отвечает за часть «встроить безопасность внутрь модели».
Мы считаем, что открытость является преимуществом для безопасности ИИ. Открытость даёт больше видимости в поведение моделей и, что важнее всего, больше возможностей превратить исследования безопасности в действенные и прозрачные механизмы контроля, чем закрытые модели. : Baseten (публикация в X)
Почему рынку стоит обратить внимание?
Сам масштаб финансирования участников говорит о серьёзности ставки. Baseten после раунда Series F на 1,5 млрд долларов оценивается в 13 млрд долларов, по данным компании. Goodfire AI привлёк 150 млн долларов Series B. Это не академический проект, а инфраструктурная инициатива от компаний с ресурсами для масштабирования.
Инициатива появляется в момент, когда дискуссия о безопасности открытых моделей обострилась. Шесть тысяч абилитерированных моделей на одной только платформе Hugging Face означают, что любой желающий может скачать «разблокированную» нейросеть без каких-либо фильтров. До сих пор ответственность за безопасность открытых моделей лежала на тех, кто их создавал, но не на тех, кто их размещал или обслуживал.
Baseten делает заявку на то, чтобы провайдер инференса тоже нёс ответственность за безопасность. Это новая позиция для рынка.
Компания также объявила открытый призыв к разработчикам присоединиться к созданию стандарта, что потенциально превращает проект из корпоративного в экосистемный.
Что это значит для вас?
Авторам Дзена и копирайтерам. Тема ai safety нейросети становится практической, а не теоретической. Если вы пишете об ИИ, стоит разобраться в термине «абилитерация»: это когда у открытой модели убирают защитные ограничения, и она начинает отвечать на любые запросы без фильтров. Понимание этого термина отличает эксперта от поверхностного автора.
Маркетологам и предпринимателям. Если ваш продукт использует открытую модель, задайте поставщику вопрос: встроена ли безопасность в модель или добавлена поверх? Разница принципиальна: «заплатку» можно снять, встроенную защиту снять сложнее.
Для работающих в РФ и СНГ. Партнёрство пока не имеет прямого российского аналога. Из доступных в РФ платформ для работы с открытыми моделями можно назвать собственные решения «Яндекса» и «Сбера», но стандарт безопасности открытых моделей как отдельный проект в русскоязычном пространстве пока не оформлен. Следить за методологией Base Labs стоит уже сейчас: если стандарт станет общепринятым, он повлияет и на модели, которые используются в российских сервисах.
Мне нравится сама постановка задачи: безопасность как часть архитектуры, а не как маркетинговый пресс-релиз. Но пока нет ни одного технического документа, ни спецификации, ни метрики. Есть партнёрство трёх хорошо профинансированных компаний и открытый призыв к разработчикам. Это начало, не результат. На мой взгляд, главная ценность для русскоязычного ИИ-сообщества в том, что тема ai safety нейросети наконец получает инфраструктурное оформление. Шесть тысяч моделей без фильтров на Hugging Face это не абстрактная угроза, а конкретная проблема для каждого, кто встраивает открытую модель в свой продукт. Рекомендую подписаться на обновления Base Labs и дождаться первых публикаций с методологией, прежде чем делать выводы о практической пользе.
Baseten открыл приём заявок от разработчиков, и это, пожалуй, самый конкретный шаг, который можно сделать прямо сейчас: если вы работаете с открытыми моделями, стоит следить за первыми публикациями Base Labs и проверить, не используете ли вы одну из тех шести тысяч моделей без защиты.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Pinterest встроил нейросеть для дизайна интерьера: пины можно примерить на фото комнаты
Почему это важно Pinterest впервые встроил генеративный ИИ прямо в основной продукт: теперь можно сфотографировать свою комнату и увидеть, как в ней будет…

FAA вложит $875 млн в применение ИИ в авиации: платформа SMART заменит ручную аналитику диспетчеров
Федеральное управление гражданской авиации США (FAA) объявило о запуске SMART, облачной платформы на основе искусственного интеллекта стоимостью 875 миллионов…

Безопасность ИИ расколола Кремниевую долину: кто получит контроль над моделями
Безопасность искусственного интеллекта стала главным предметом публичного спора между крупнейшими технологическими компаниями мира, и в июне 2025 года…
Комментарии