Голосовой диктовщик для Windows с открытым кодом. Работает полностью локально. Бесплатная альтернатива Wispr Flow: всё крутится на вашем компьютере, без облака и подписок. Ничего не уходит в сеть.
Зажали горячую клавишу, сказали что хотели, отпустили. Чистый текст появляется там, где стоит курсор: в Cursor, VS Code, браузере, Telegram, Word, терминале. Где угодно.
На странице Releases два варианта.
Установщик OpenFlow_x64-setup.exe. Обычная установка, данные хранятся в %APPDATA%\OpenFlow.
Портативная версия OpenFlow-Portable-*-x64.zip. Распаковали и запустили OpenFlow.exe, никакой установки. Все данные (настройки, логи, модели) живут в папке data рядом с программой, так что её можно носить на флешке. Портативный режим включает файл portable.txt рядом с exe. Совет: кладите папку в короткий путь вроде C:\OpenFlow, глубокая вложенность мешает Windows скачать модель.
При первом запуске короткий мастер поможет выбрать микрофон и скачает модель распознавания (около 500 МБ, один раз). Дальше всё работает без интернета.
Зажмите Ctrl + Win, говорите, отпустите. Текст вставится туда, где курсор. Включить и выключить запись без удержания можно по Ctrl + Alt + D, обе комбинации меняются в настройках.
Если в компьютере есть видеокарта NVIDIA, распознавание идёт на ней и заметно быстрее. Если нет, всё честно работает на процессоре.
┌──────────────────────────────────────────────────────┐
│ Оболочка Tauri (Rust) │
│ трей · оверлей · настройки (React) │
│ глобальные хоткеи · вставка текста · активное окно │
└──────────────────────┬───────────────────────────────┘
│ JSON-RPC через stdio
┌──────────────────────▼───────────────────────────────┐
│ Движок на Python (sidecar) │
│ захват микрофона · VAD · faster-whisper (STT) │
│ RU/EN + смешанная речь · быстрая/умная очистка │
│ сниппеты · голосовые команды · личный словарь │
└──────────────────────────────────────────────────────┘
Распознанный текст проходит очистку. Быстрый режим работает по правилам: убирает слова-паразиты, чинит пробелы, заглавные буквы, точки и знаки вопроса, задержка почти нулевая. Умный режим полирует текст локальной языковой моделью через llama.cpp: пунктуация, форматирование, стиль. Он тоже полностью офлайн.
Рабочая альфа. Полный цикл диктовки живой: захват звука, VAD, faster-whisper, очистка, вставка в активное окно. Есть иконка в трее, постоянный оверлей, глобальный push-to-talk и окно настроек. Поддерживаются CUDA (int8) и CPU. Планы лежат в docs/ROADMAP.md.
| Путь | Что внутри |
|---|---|
apps/desktop/ |
Приложение Tauri: интерфейс на React и нативный слой на Rust |
core/openflow-engine/ |
Движок на Python: аудио, VAD, STT, очистка |
models/ |
Манифесты моделей и скрипты скачивания (веса в git не хранятся) |
plugins/ |
Примеры сниппетов и наборов команд |
scripts/ |
Настройка dev-окружения, бенчмарки, сборка портативной версии |
tests/ |
Тесты для Python и Rust |
docs/ |
Архитектура, роадмап, производительность, приватность |
cd core/openflow-engine
python -m venv .venv
.venv\Scripts\pip install -e .[dev]
.venv\Scripts\python -m openflow_engine --selftestВсё работает локально. Никакой телеметрии и никаких сетевых вызовов во время работы: модели скачиваются явно и один раз. Подробности в docs/PRIVACY.md.
MIT