Игорь Градов
Игорь Градов
6 мин
ai

Current AI собрала $400 млн на открытый искусственный интеллект для исчезающих языков

Некоммерческая организация Current AI, основанная в феврале 2025 года и получившая 400 миллионов долларов от правительства Франции, фондов и технологических компаний, строит открытый искусственный интеллект, который работает на языках, забытых корпоративными моделями.

Current AI собрала $400 млн на открытый искусственный интеллект для исчезающих языков
Почему это важно

Половина разговорных языков мира на грани исчезновения, а крупнейшие модели обучены преимущественно на английском. Current AI впервые собирает государственные деньги, филантропию и опенсорс в одну структуру, чтобы дать языковым сообществам ИИ-инструменты, которые они контролируют сами.

Current AI появилась в феврале 2025 года. Организацию основал Мартин Тисне, а в январе к команде присоединилась Айя Бдейр, ранее отвечавшая за стратегию ИИ в Mozilla и основавшая образовательную компанию littleBits. Бдейр описывает модель как «государственно-частное партнёрство»: правительства, компании и фонды финансируют технологии в общественных интересах. Об этом она рассказала в интервью TechCrunch.

Показатель Значение Источник
Общий объём привлечённого финансирования 400 млн долларов TechCrunch, интервью с CEO
Стартовый взнос правительства Франции 100 млн долларов TechCrunch, интервью с CEO
Сумма первого раунда грантов 3,2 млн долларов TechCrunch, интервью с CEO
Число организаций-грантополучателей 4 TechCrunch, интервью с CEO
Число языков в устройстве Suno Sutra 22 индийских языка TechCrunch, интервью с CEO
Число участников разработки Alpha Chat 10 организаций TechCrunch, интервью с CEO
Срок сборки чат-бота Alpha Chat 7 недель TechCrunch, интервью с CEO

Что именно делает Current AI?

Открытый искусственный интеллект в понимании Current AI отличается от «открытых весов» (open weights), которые публикуют Meta или Mistral. Здесь речь не просто о доступности кода, а о том, кто владеет данными и кто решает, на каких языках и культурах модель обучается.

Организация работает по трём направлениям:

  • Устройства без интернета. На саммите India AI в феврале Current AI совместно с Bhashini, языковым подразделением правительства Индии, представила Suno Sutra (на хинди «слушающие хроники»). Это карманное устройство, которое запускает ИИ на 22 индийских языках офлайн. Код устройства открыт для разработчиков.
  • Гранты языковым проектам. В мае организация распределила 3,2 миллиона долларов между четырьмя командами в Кении, Ливане и бразильской Амазонии.
  • Открытый чат-бот. В июне на саммите AI for Good в Женеве запущен Alpha Chat, собранный за семь недель десятью организациями, включая Hugging Face, Mozilla и MIT Media Lab. Каждый участник принёс свой элемент: языковую модель, инструменты безопасности, вычислительные мощности.

Параллельно Current AI договорилась с токийским стартапом Sakana AI, который занимается тем, что называет «суверенным ИИ» (Sovereign AI, модели, адаптированные под язык и культуру конкретной страны). Вместе они планируют собрать открытый стек для поддержки японского языка и сообществ Глобального Юга.

Что обнаружили грантовые проекты?

Первый раунд грантов показал четыре разных подхода к одной проблеме:

  • Masakhane (Кения) собирает наборы обучающих данных (training data, тексты и записи, на которых учится модель) на более чем 50 африканских языках для медицины, сельского хозяйства и образования.
  • Institute for Worldmaking (Ливан) оцифровывает арабское культурное наследие в формат, понятный машине, причём контроль над базами остаётся у сообществ, а не у технологических компаний.
  • Portal sem Porteiras (Бразилия) разрабатывает офлайн-инструменты ИИ совместно с коренными народами Амазонии. Данные не покидают территорию общины.
  • African Internet Rights Alliance (Кения) создаёт аудиторские инструменты, чтобы проверять, как ИИ-системы работают на континенте.

Ни один из проектов пока не решил вопрос владения данными окончательно. Бдейр считает это осознанным выбором: «Каждый из них встроил вопрос в свою работу, вместо того чтобы принять привычную схему, где сложность становится оправданием для того, чтобы правительство или технологическая компания решали за всех», сказала она TechCrunch.

Зачем корпорации делают многоязычные модели, а Current AI делает иначе?

Большие технологические компании создают многоязычные модели, чтобы расширить свой рынок, без учёта согласия и контекста. Для языков коренных народов миссионерские переводы Библии становятся обучающими данными до того, как общины установят какие-либо правила. : Айя Бдейр, CEO Current AI, в интервью TechCrunch

Бдейр настаивает: язык для ИИ не равен способности переводить. «Язык, это то, как знания, традиции, память и идентичность передаются из поколения в поколение. Когда технология не говорит на вашем языке, она не может нести и вашу культуру», объяснила она.

Модель Current AI предполагает, что данные хранятся локально, эксперты из сообществ привлекаются до начала разработки, а протоколы согласия (consent protocols, правила, по которым община может остановить процесс на любом этапе) вписаны в саму инженерную цепочку.

Как это читать

Грантовый бюджет в 3,2 миллиона долларов на четыре организации невелик по меркам отрасли. Бдейр признаёт это, но возражает: «Масштаб не всегда мерило. Это парадигма большого бизнеса». Общий заявленный фонд в 400 миллионов включает взносы правительства Франции, Ford Foundation, MacArthur Foundation, DeepMind и Salesforce, но TechCrunch описывает их как «committed funding», то есть обязательства, а не перечисленные средства. Сколько уже на счетах, источник не уточняет. Результаты грантовых проектов тоже пока не измерены: все четыре находятся на ранней стадии.

Что это значит для вас?

Авторам Дзена и копирайтерам. Если вы пишете на русском для аудитории в СНГ, проблема англоязычного крена моделей вам знакома: промпты на английском дают лучший результат, русскоязычные данные в обучающих выборках представлены слабее. Проекты вроде Current AI пока сфокусированы на языках Индии, Африки и Амазонии. Но сам механизм, открытые наборы данных плюс локальное хранение, применим к любому языковому сообществу, включая русскоязычное.

Маркетологам. Следите за Alpha Chat и открытым стеком, который Current AI собирает с Sakana AI. Если эти инструменты выйдут на уровень рабочего продукта, появится бесплатная альтернатива корпоративным API для мультиязычных кампаний, без привязки к ценовой политике OpenAI или Google.

Предпринимателям в РФ и СНГ. Прямого присутствия Current AI в России нет. Из доступных в РФ решений с поддержкой русского языка: YandexGPT, GigaChat, а также открытые модели на Hugging Face с русскоязычными дообучениями. Но код Suno Sutra и Alpha Chat открыт. Если вы работаете с офлайн-сценариями (регионы без стабильного интернета, полевые задачи), архитектура карманного устройства на 22 языка заслуживает изучения как прототип.

Мнение редакции dzen.guru

Current AI пока больше манифест, чем продукт. Семинедельный чат-бот и карманное устройство на хакатоне далеки от того, чтобы конкурировать с ChatGPT или Claude. Но интересен не результат, а структура: некоммерческая организация с государственными деньгами, которая пишет протоколы согласия до того, как собирает данные. Для русскоязычного сообщества здесь конкретный урок: пока мы обсуждаем, какая закрытая модель лучше понимает русский, кто-то уже строит инфраструктуру, в которой 50 африканских языков получат датасеты раньше, чем их получит русский. Если вам важно, чтобы открытый искусственный интеллект учитывал русский язык и славянские культуры, сейчас подходящий момент следить за грантовыми раундами Current AI и предлагать свои проекты.

Конкретный шаг: зайдите на GitHub-репозиторий Alpha Chat и Suno Sutra, посмотрите на архитектуру. Если у вас есть проект, связанный с русскоязычными данными для открытых моделей, следующий грантовый раунд Current AI может оказаться ближе, чем кажется.

По данным TechCrunch

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Алгоритм проверил, кто написал «Золотой телёнок»: Булгаков близок, но не автор
ai

Алгоритм проверил, кто написал «Золотой телёнок»: Булгаков близок, но не автор

Лид сформулирован, проверяю: «Русский разработчик усовершенствовал классический стилометрический алгоритм Бёрроуза, добавив морфологию русского языка и…

7 мин
ИИ-агенты в российских компаниях: 13 проектов с реальными цифрами экономии
ai

ИИ-агенты в российских компаниях: 13 проектов с реальными цифрами экономии

Российские компании уже передают ИИ-агентам часть рутины, и публичные цифры показывают, где экономия реальна, а где пока только заявлена. Почему это важно…

6 мин
Обучение нейросети с нуля на текстах Warhammer 40K: бесплатный гайд с кодом на Хабре
ai

Обучение нейросети с нуля на текстах Warhammer 40K: бесплатный гайд с кодом на Хабре

Почему это важно Русскоязычный практический разбор того, как собрать и предобучить собственную языковую модель с нуля, от токенизатора до запуска, появляется…

5 мин