Игорь Градов
Игорь Градов
6 мин
ai

CRM без бэкенда: замеры на слабом Android показали цену полной приватности

Компания-разработчик (имя автора в источнике не названо) выложила в открытый доступ результаты создания мобильной CRM без бэкенда, которая слушает звонки продавца, превращает речь в текст прямо на телефоне и не отправляет ни байта на сторонний сервер.

CRM без бэкенда: замеры на слабом Android показали цену полной приватности
Почему это важно

Разработчик опубликовал не маркетинговые обещания, а реальные замеры распознавания речи на слабом Android-смартфоне и список ловушек, в которые попадёт каждый, кто попробует держать данные локально.

Большинство CRM-систем работают через сервер: данные клиентов, записи разговоров, история переписки хранятся в облаке. Это удобно для синхронизации и аналитики, но означает, что голос собеседника на другом конце трубки уезжает на чужой сервер без его согласия. Автор проекта решил построить CRM без бэкенда (то есть без серверной части), где всё лежит только на телефоне владельца. Источник описывает конкретную цену такого решения в производительности и функциях.

Что Когда Кто выпустил Цена
Мобильная CRM без бэкенда с локальным распознаванием речи на Android Дата публикации не названа Независимый разработчик (имя не раскрыто) Не указана

Какие ограничения накладывает отказ от сервера?

Автор честно перечислил, чем пользователь платит за приватность:

  • Нет синхронизации между устройствами. Данные живут только на одном телефоне.
  • Нет автоматического восстановления. Если телефон сломался или утонул, записи пропадают.
  • Нет поиска за пределами памяти аппарата. Серверный поиск по всей истории невозможен.
  • Нет серверной аналитики. Разработчик не видит, как приложением пользуются, и не может улучшать продукт по данным.

Каждый из этих пунктов, по словам автора, решался бы бэкендом за неделю и обошёлся бы дешевле. Но тогда записи чужих разговоров лежали бы на стороннем сервере.

Как работает распознавание речи прямо на телефоне?

Транскрибация (превращение речи в текст) оказалась единственной по-настоящему тяжёлой частью. На сервере она стоила бы копейки. На телефоне за неё платит само устройство.

Автор специально взял для тестов не средний, а слабый смартфон: Samsung A17 с двумя мощными ядрами и шестью слабыми. Логика: худший случай покажет реальную картину, а не рекламную.

Замеры whisper.cpp (открытая модель для распознавания речи от OpenAI) на одной минуте русской речи дали три вывода:

  • Четыре потока не помогают. Сильных ядер всего два, остальные тормозят общую работу. Попытка занять все ядра делает результат хуже.
  • Модель base против small решает всё. Десятиминутный разговор base расшифровывает за шесть с половиной минут, small за семнадцать. Base работает быстрее реального времени, small медленнее. Разница между «к концу дня всё разобрано» и «очередь растёт быстрее, чем разгребается». По умолчанию стоит base.
  • Пик памяти составляет 699 мегабайт. Из них в Java-куче всего 23 мегабайта, остальное занимает нативная память модели. На телефоне с четырьмя гигабайтами оперативной памяти система начинает убивать фоновый процесс. Нужно минимум восемь гигабайт.

Автор отдельно подчеркнул: повтор теста на чистом телефоне без мессенджеров показал результат 0.50 вместо 0.65 (отношение времени расшифровки к длительности записи). В таблицу пошла худшая цифра, потому что у реального пользователя телефон не стерильный.

Три ловушки, которые не гуглятся заранее

Система сама отправляет файлы в облако. В манифесте Android есть флаг allowBackup, включённый по умолчанию. Он заставляет систему периодически копировать файлы приложения в облачный бэкап. Для заметочника это безобидно. Для приложения с записями чужих звонков это отмена всей локальной архитектуры одной строкой, которую разработчик не писал. Лечится добавлением android:allowBackup="false" в манифест.

Диагностика Android уверенно врёт. Система возвращает одинаковый ответ на два разных случая: «у приложения запрещены уведомления» и «этот пакет тебе не виден». Результат: приложение сообщает пользователю, что уведомления выключены, пользователь проверяет и видит, что включены. Лечится изменением порядка проверок: сначала убедиться, что пакет виден и установлен, потом трактовать разрешение.

Запись звонков фактически заблокирована. Источник обрывается на этом пункте словами «пришлось сдаться», что само по себе показательно: Google закрывает доступ к записи звонков для сторонних приложений, и обходного пути автор не нашёл.

Сравнение с доступными в России решениями

Полноценных аналогов CRM без бэкенда с локальным распознаванием речи на российском рынке нет. Облачные CRM-системы (amoCRM, Битрикс24) решают задачу карточки клиента и истории звонков, но все они серверные: данные хранятся в облаке, а распознавание речи идёт через внешние сервисы.

Для локального распознавания русской речи на Android можно использовать ту же модель whisper.cpp, которую применил автор. Встроенные голосовые движки от Google или Яндекса работают через сервер и не подходят для задачи «ни байта наружу».

Что делать с этим прямо сейчас, по ролям

Автору на Дзене. Замеры из этого проекта можно использовать как основу для обзоров локального распознавания речи. Тема приватности голосовых данных собирает аудиторию, потому что касается каждого, кто диктует тексты или записывает интервью на телефон.

Маркетологу и продавцу. Если ваши менеджеры забывают, кому что обещали, и теряют клиентов через две недели после звонка, идея CRM без бэкенда привлекательна. Но готового продукта для скачивания автор не предложил: это пока история разработки, а не готовый инструмент.

Предпринимателю в РФ. Главный практический вывод: на слабом Android-устройстве модель whisper.cpp base расшифровывает десять минут русской речи за шесть с половиной минут. Это значит, что локальное распознавание уже работоспособно для коротких звонков, но требует телефон с восемью гигабайтами оперативной памяти. На четырёх система убивает процесс.

Мнение редакции dzen.guru

Этот проект ценен не как готовый продукт, а как честный отчёт о том, сколько стоит приватность в реальных цифрах. Шесть с половиной минут на десятиминутный разговор и потеря половины функций, вот конкретная цена отказа от сервера. Для тех, кто работает с чужими голосовыми данными (запись интервью, расшифровка звонков клиентов), это полезный ориентир.

Оговорка: источник обрывается на третьей ловушке, автор и название приложения не раскрыты, готовой сборки для скачивания нет. Воспринимайте как инженерный дневник, а не как обзор продукта.

Если вы думаете о локальном распознавании речи для своих задач, попробуйте прогнать whisper.cpp на своём телефоне и сравните результат с замерами автора. Это займёт полчаса и покажет, готово ли ваше устройство к работе без облака.

Частые вопросы

Можно ли уже скачать эту CRM без бэкенда?

Автор не указал ни названия приложения, ни ссылки для скачивания. Публикация описывает процесс разработки и замеры производительности, а не готовый продукт в магазине приложений.

Будет ли whisper.cpp нормально работать на моём телефоне?

По замерам автора, для комфортной работы нужно минимум восемь гигабайт оперативной памяти. На четырёх система начинает убивать процесс распознавания. Модель base справляется быстрее реального времени на Samsung A17, это бюджетный аппарат с двумя мощными ядрами.

А что с качеством распознавания русской речи?

Автор выбрал модель base как компромисс между скоростью и качеством. Модель small даёт лучшее качество, но расшифровывает десять минут разговора за семнадцать, то есть медленнее реального времени. Переключатель между моделями есть в настройках.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Radeon для инференса нейросетей: почему TFLOPS без пропускной способности памяти не работают
ai

Radeon для инференса нейросетей: почему TFLOPS без пропускной способности памяти не работают

Запускать большие языковые модели на видеокартах AMD Radeon можно не хуже, чем на Nvidia, если понимать, как устроен инференс (применение уже обученной модели…

7 мин
GigaChat 2 Max обошёл Claude Opus 5 на 16 п.п.: память на связях важнее «ума» модели
ai

GigaChat 2 Max обошёл Claude Opus 5 на 16 п.п.: память на связях важнее «ума» модели

Компания «Интеграм» опубликовала сравнительный замер семи языковых моделей на задаче технической поддержки и показала, что система памяти на типизированных…

6 мин
LLM-агенты на дешёвых моделях обходятся втрое дороже: почему цена за токен врёт
ai

LLM-агенты на дешёвых моделях обходятся втрое дороже: почему цена за токен врёт

mini или Haiku, тоже начинает с правильного шага. Но на втором шаге она теряет контекст. Она не помнит, что именно нашла на первом шаге, и начинает…

5 мин