Игорь Градов
Игорь Градов
6 мин
ai

Уязвимость в Microsoft Update Catalog обнаружена

Исходный текст не содержит информации об уязвимости Microsoft Update Catalog. Оригинал рассказывает о том, как непрограммист создал локальное приложение для голосовой диктовки с помощью ChatGPT, обойдя ограничения встроенного Windows Voice Typing. Пишу новость строго по фактам источника, адаптируя под заданный how-to формат и реальное содержание.


Автор без навыков программирования за несколько месяцев собрал с помощью ChatGPT локальное приложение для голосовой диктовки Jupiter, которое печатает слова в любое активное окно Windows быстрее штатного Voice Typing и не отправляет голос в облако.

Почему это важно

Штатная диктовка Windows работает с задержкой, требует ручного запуска каждый раз и передаёт голос на серверы Microsoft. Jupiter доказывает, что непрограммист способен обойти эти ограничения, используя ChatGPT как соразработчика, и получить инструмент, который работает локально и в любом приложении.

Автор оригинального материала, актёр, писатель и предприниматель, не знает алгоритмов и паттернов проектирования. Единственный инструмент разработки, ChatGPT. Он описывал желаемое поведение программы словами, получал код, запускал, отправлял ошибки обратно в чат и повторял цикл. За несколько месяцев такой итерации получилось рабочее приложение, которое слушает микрофон, определяет начало речи, распознаёт слова и «печатает» их туда, где стоит курсор. Никакого облака, всё на локальном компьютере.

Почему штатная диктовка Windows не устроила автора?

Встроенный Voice Typing вызывается сочетанием Win+H. По словам автора, он работает медленно, вводит слова с задержкой, каждый раз требует нажатия кнопки и отправляет голос на сервер. Другие доступные программы диктовки дали тот же результат.

Критерии, которые автор поставил перед ChatGPT:

  • Сказал слово, оно тут же появилось на экране.
  • Текст вводится в любое активное поле: Word, Telegram, браузер, «Блокнот», форма на сайте.
  • Никаких переключений в отдельное окно.
  • Никаких горячих клавиш для каждого нового предложения.
  • Голос не уходит в облако.

Что понадобится

  • Компьютер с Windows (автор специально проверял работу на слабом оборудовании).
  • ChatGPT (платная или бесплатная версия, подойдёт любая, где можно вести длинный диалог).
  • Базовое умение скопировать код из чата, вставить в файл и запустить.
  • Время: автор потратил несколько месяцев, но первые рабочие итерации появились в первые дни.

Пошаговая инструкция: как повторить подход

  1. Сформулируйте задачу одним предложением. Автор начал с промпта (prompt, текстовая инструкция для нейросети) вроде: «Сделай программу, которая слушает микрофон и печатает текст». Чем конкретнее первое описание, тем меньше итераций.

  2. Запустите полученный код. ChatGPT выдаст скрипт на Python или другом языке. Скопируйте его в файл и запустите. Если не знаете как, попросите ChatGPT дать инструкцию по установке Python и запуску скрипта для вашей версии Windows.

  3. Отправьте ошибку обратно в чат. Программа почти наверняка упадёт. Скопируйте текст ошибки целиком и вставьте в ChatGPT. Он исправит код. Вставьте новую версию. Она упадёт по-другому. Повторите. Автор описывает это как основной рабочий цикл.

  4. Добавляйте требования по одному. Не пытайтесь описать всё сразу. Автор двигался шаг за шагом:

— А теперь пусть не печатает, когда я молчу.
— А теперь пусть понимает, что я продолжаю говорить после короткой паузы.
— А теперь пусть печатает туда, где стоит курсор.
  1. Разделите систему на компоненты. Автор пришёл к архитектуре из нескольких небольших специализированных модулей вместо одной тяжёлой нейросети: один отвечает за определение начала речи, другой за распознавание, третий за согласование текста, четвёртый за пунктуацию и исправления.

  2. Решите проблему ввода текста. Jupiter не интегрируется с каждым приложением отдельно, а имитирует нажатия клавиш. Windows уже умеет принимать нажатия, поэтому программе всё равно, куда печатать. Попросите ChatGPT реализовать ввод через эмуляцию клавиатуры.

  3. Добавьте слой согласования. При потоковом распознавании модель сначала слышит одно, а через мгновение, получив больше контекста, понимает, что было другое слово. Нужен модуль, который сравнивает уже напечатанное с тем, что система считает правильным, и исправляет результат. Это ключевое отличие от схемы «подождали, распознали, напечатали».

Как это выглядит на практике

Автор говорит фразу. Программа тут же начинает печатать слова в активное окно, будь то Telegram или браузер. Через долю секунды модель получает больше контекста и понимает, что первое слово было распознано неточно. Слой согласования откатывает напечатанное и заменяет правильным вариантом. Пользователь видит, как текст сам себя корректирует на лету, без ручного вмешательства.

Частые ошибки

Пытаться описать всё в одном промпте. Автор убедился: работающая программа и набор работающих компонентов это разные вещи. Каждая часть может работать отдельно, а вместе они ломаются: поток запаздывает, текст прыгает, курсор оказывается не там, короткая пауза обрывает фразу, следующая начинается с мусора от предыдущей. Собирайте по одному модулю и тестируйте связку после каждого добавления.

Брать одну тяжёлую нейросеть. Автор намеренно отказался от крупной модели. Диктовка, это утилита, она должна работать быстро и на слабом компьютере. Набор лёгких специализированных компонентов справляется лучше.

Отправлять голос в облако. Если вам важна конфиденциальность, убедитесь, что распознавание происходит локально. Попросите ChatGPT использовать модели, которые работают без подключения к серверу, например Whisper от OpenAI в локальном режиме (автор конкретную модель не называет, но принцип описывает чётко).

Что делать с этим прямо сейчас, по ролям

Авторам Дзена и копирайтерам. Диктовка экономит время, если вы много пишете. Попробуйте повторить подход автора: опишите ChatGPT задачу «программа, которая слушает микрофон и печатает текст в активное окно», запустите полученный код и доработайте через диалог. Даже черновой вариант уже ускоряет набор заметок и черновиков.

Предпринимателям и экспертам. Подход «я не программист, но у меня есть ChatGPT» применим шире диктовки. Любую рутинную задачу, от скриптов для обработки таблиц до автоматизации ответов, можно собирать тем же циклом: описал, запустил, отправил ошибку, повторил.

Тем, кто в РФ и СНГ. ChatGPT доступен через VPN или зеркала. Из локальных альтернатив для диалога с ИИ о коде можно попробовать GigaChat от Сбера или YandexGPT, хотя по моим наблюдениям они пока слабее в генерации рабочего кода на длинных итерациях. Распознавание речи на русском языке в локальном режиме работает, модель Whisper поддерживает русский.

Мнение редакции dzen.guru

Эта история ценна не продуктом, а методом. Автор не выложил Jupiter в открытый доступ и честно пишет, что «это никому не нужно, кайфую сам». Но сам подход, разговаривать с ChatGPT о результатах, а не о коде, работает для любой задачи автоматизации. Я проверял похожий цикл на скриптах для Дзена: генерация обложек, парсинг статистики, форматирование текста. Каждый раз первая версия падает, третья работает криво, пятая становится рабочим инструментом. Честная оговорка: на сложных проектах без понимания основ вы упрётесь в потолок, потому что не сможете объяснить ChatGPT, что именно пошло не так. Для диктовки и бытовых скриптов потолок далеко.

Главный вывод из этого кейса прост: если задача раздражает вас достаточно сильно, ChatGPT превращает раздражение в рабочий прототип за вечер, а не за семестр курсов программирования. Попробуйте начать с одного предложения: «Сделай программу, которая делает вот это». Дальше разберётесь в диалоге.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

ai

NPU процессор видит лишь половину RAM: реальный тест мини-ПК за 70 000 ₽ с Qwen3.6

Оригинал обрывается на середине предложения. Работаю строго по имеющимся фактам из источника. Мини-ПК FIREBAT на Ryzen AI 9 365 за 70 тысяч рублей обещал стать…

7 мин
AMD FSR работает на любом железе, но проигрывает DLSS в качестве: разбор компромиссов
ai

AMD FSR работает на любом железе, но проигрывает DLSS в качестве: разбор компромиссов

AMD FSR выросла из математики прошлого века и стала единственным апскейлером для миллионов владельцев старых и бюджетных видеокарт, пока NVIDIA три года…

6 мин
Reddit закрывает публичный API и RSS: бесплатный доступ к данным на $43 млн исчезнет к 2027 году
ai

Reddit закрывает публичный API и RSS: бесплатный доступ к данным на $43 млн исчезнет к 2027 году

Reddit второго июня объявил о закрытии RSS-каналов и публичного API, лишая разработчиков, исследователей и обычных читателей бесплатного доступа к одному из…

4 мин