Нейросети для перевода: младшая Gemini Flash оказалась точнее флагманской Pro
Компания Google, разработчик Anthropic и OpenAI предоставили свои модели для открытого сравнения в конвейере BookTrans, и результаты перевёрнули привычную иерархию: младшая Gemini Flash оказалась точнее флагманской Pro, а способность сомневаться в собственном переводе обнаружилась только у одной модели из четырёх.
Тест на реальном романе впервые показал, что маркетинговый ранг модели (флагман, эконом) не совпадает с качеством литературного перевода, а выбирать нейросети для перевода нужно только по замеру на конкретной задаче.
Русскоязычный открытый конвейер BookTrans, о котором ранее рассказывали на Хабре, провёл детальное сравнение четырёх подписочных моделей на материале научно-фантастического романа Стивена Бакстера «Timelike Infinity» (цикл Xeelee Sequence), перевод с английского на русский. Участвовали Gemini 3.7 Flash и Gemini 3.1 Pro от Google, Claude Opus 5 от Anthropic и GPT-5.6 Sol от OpenAI. Качество измеряли двумя способами: подсчётом правок, предложенных другой моделью-судьёй, и ручным чтением всех четырёх переводов рядом с оригиналом.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Сравнительный тест нейросетей для перевода в конвейере BookTrans | Июль 2026 (публикация результатов) | BookTrans (открытая модель, опенсорс) | Бесплатно (конвейер), модели по подписке у Google, Anthropic, OpenAI |
Младшая Gemini обошла флагманскую: как это вышло?
- Flash дешевле и точнее. На прозе (около 100 абзацев одной главы) судья Claude Opus насчитал у Flash 40 правок, у Pro 74. Картина повторилась у всех трёх судей: Flash стабильно чище.
- Диалоги тоже за Flash. 41 правка против 57 у Pro.
- Цензура мешает Pro. Чувствительную сцену переводили трижды: Flash прошёл все три раза без отказа, Pro справился только один раз из трёх.
- Pro выдаёт кальки и канцелярит. В тесте зафиксированы формулировки вроде «триггеры ностальгии» и «глаза почувствовали слезливость и боль», лишние местоимения, орфографические промахи. Flash, напротив, предлагал живые находки: «росчерк пикселей» для bolt of pixels, «щемяще-синий серп Земли».
- Поколение важнее ранга. Flash 3.7 вышла в июле 2026, Pro 3.1 в январе 2026. Более новая «младшая» модель переросла старую «старшую», хотя маркетинговая лестница об этом не сообщает.
Кто лучший переводчик, редактор и сверщик?
Идеальной модели тест не выявил. Сильные стороны распределились между тремя моделями.
- Живой русский язык: Claude Opus 5. Читается как проза, а не как перевод. «Людей раздавили», «Они себя переделали».
- Верность оригиналу: GPT-5.6 Sol. Единственный восстановил повреждённое OCR-место (склейку «sparkling.Qax Jasoft Parz» прочёл как титул «Посол при кваксах», что верно по сюжету) и сохранил авторский образ.
- Чистота черновика: Gemini 3.7 Flash. Минимум правок у всех судей, ровный результат, не зависящий от «вкуса» проверяющего.
- Аутсайдер: Gemini 3.1 Pro. Кальки, канцелярит, цензурные отказы.
Только одна модель умеет сомневаться?
Конвейер BookTrans устроен по ролям: переводчик, редактор (ему оригинал не показывают, чтобы не тянул кальки), сверщик (видит и оригинал, и перевод, и замечания редактора).
Сверщик (verifier) решает: ошибся автор книги или переводчик. Если ошибся автор, текст не трогают, а добавляют сноску «Прим. ред.». Если переводчик, исправляют перевод.
Ключевой вывод теста: модель, которая правит собственный перевод, слепа к своим ошибкам. Самоправка (когда одна и та же нейросеть переводит и редактирует) не работает. А заметить чушь и усомниться вслух, по данным BookTrans, способна только одна модель из четырёх. На этой разнице и держится вся иерархия ролей в конвейере.
Как попробовать?
- Откройте репозиторий BookTrans на GitHub (проект с открытым кодом, доступен бесплатно).
- Подключите API одной из моделей: Gemini Flash, Claude Opus или GPT Sol. Для каждой нужна подписка у соответствующего провайдера (Google, Anthropic, OpenAI).
- Загрузите текст на английском и запустите конвейер: он сам распределит роли (переводчик, редактор, сверщик) и выдаст результат в формате epub или fb2.
- Сравните результат вручную с оригиналом хотя бы на десятке абзацев: автоматический счёт правок полезен, но без ручного чтения ненадёжен.
Что с российскими нейросетями для перевода?
В тесте BookTrans участвовали только зарубежные модели. YandexGPT и GigaChat (от Сбера) в этом сравнении не замерялись, поэтому прямого сопоставления по литературному переводу нет.
Для читателей из РФ и СНГ это значит: если вы работаете с российскими нейросетями для перевода, ориентироваться на эти цифры напрямую нельзя. Но сам метод (дать нескольким моделям один и тот же фрагмент, посчитать правки и прочесть глазами) применим к любой модели, включая YandexGPT и GigaChat.
Что делать с этим прямо сейчас, по ролям?
Автору на Дзене. Если переводите или адаптируете зарубежные источники, не доверяйте одной модели. Дайте один фрагмент двум-трём нейросетям и сравните вручную. Flash дешевле и быстрее, но живой язык лучше у Claude Opus.
Маркетологу. При локализации лендингов, рассылок и карточек товаров проверяйте, не выдаёт ли модель кальки и канцелярит. Тест BookTrans показал, что «флагманская» подписка не гарантирует лучший результат.
Предпринимателю в РФ. Доступ к Gemini, Claude и GPT из России ограничен, часто нужен VPN или зарубежный аккаунт. Если это неудобно, протестируйте YandexGPT или GigaChat тем же методом: один текст, несколько моделей, ручная сверка.
Главное открытие этого теста для меня не в том, что Flash обошла Pro. А в том, что ни одна модель не справляется сразу со всеми ролями. Переводит лучше одна, редактирует другая, сомневается третья. Для автора Дзена это значит простую вещь: не ищите «лучшую нейросеть для перевода», ищите лучшую комбинацию. И обязательно читайте результат глазами. По моим наблюдениям, даже сильная модель пропускает собственные кальки, а заметить ошибку в чужом переводе ей проще, чем в своём. Сделайте сегодня одно: возьмите любой абзац на английском, прогоните через две доступные вам нейросети и сравните. Десять минут покажут больше, чем любой рейтинг.
Частые вопросы
Можно ли доверить нейросети перевод целой книги без редактуры человеком?
Нет. Тест BookTrans показал, что даже лучшая модель допускает ошибки, которые сама не замечает. Конвейер снижает нагрузку на человека, но финальная сверка остаётся за оператором. Галлюцинация (когда ИИ уверенно выдумывает то, чего не было) в переводе особенно опасна: модель может «исправить» авторскую ошибку, которую нужно было сохранить.
Какая модель лучше для перевода с английского на русский?
По данным BookTrans, универсального лидера нет. Gemini 3.7 Flash дала самый чистый черновик, Claude Opus 5 показала лучший русский язык, GPT-5.6 Sol оказалась точнее всех в передаче смысла оригинала. Выбирайте под задачу и проверяйте на своём тексте.
Работает ли BookTrans с российскими моделями?
BookTrans, конвейер с открытым кодом (опенсорс), и подключить к нему можно любую модель через API (программный интерфейс, через который приложения обмениваются данными). Российские модели в опубликованном тесте не участвовали, но технически ничто не мешает подключить YandexGPT или GigaChat и провести собственное сравнение тем же методом.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Нейросети и инвестиции: стартап Мурати просит $1 млрд при мультипликаторе 400x
Thinking Machines, стартап бывшего технического директора OpenAI Миры Мурати, ведёт переговоры о привлечении 1 миллиарда долларов при оценке компании не ниже…

166 000 нейронов мозга дрозофилы на карте: ИИ впервые сравнил нейросети мозга двух полов
Учёные из HHMI Janelia Research Campus, Google Research и международного научного консорциума впервые составили полную карту нейронных связей мозга и…

Галлюцинации нейросетей уже в 1980 судебных делах: как не стать следующим
Галлюцинации нейросетей (когда ИИ уверенно выдаёт выдуманные факты за настоящие) уже стоили юристам карьер, а компаниям сотен миллионов долларов, и в 2026 году…
Комментарии