Skip to content

pandaman77/openflow

Repository files navigation

OpenFlow

Голосовой диктовщик для Windows с открытым кодом. Работает полностью локально. Бесплатная альтернатива Wispr Flow: всё крутится на вашем компьютере, без облака и подписок. Ничего не уходит в сеть.

platform license local

Зажали горячую клавишу, сказали что хотели, отпустили. Чистый текст появляется там, где стоит курсор: в Cursor, VS Code, браузере, Telegram, Word, терминале. Где угодно.

Скачать

На странице Releases два варианта.

Установщик OpenFlow_x64-setup.exe. Обычная установка, данные хранятся в %APPDATA%\OpenFlow.

Портативная версия OpenFlow-Portable-*-x64.zip. Распаковали и запустили OpenFlow.exe, никакой установки. Все данные (настройки, логи, модели) живут в папке data рядом с программой, так что её можно носить на флешке. Портативный режим включает файл portable.txt рядом с exe. Совет: кладите папку в короткий путь вроде C:\OpenFlow, глубокая вложенность мешает Windows скачать модель.

При первом запуске короткий мастер поможет выбрать микрофон и скачает модель распознавания (около 500 МБ, один раз). Дальше всё работает без интернета.

Как пользоваться

Зажмите Ctrl + Win, говорите, отпустите. Текст вставится туда, где курсор. Включить и выключить запись без удержания можно по Ctrl + Alt + D, обе комбинации меняются в настройках.

Если в компьютере есть видеокарта NVIDIA, распознавание идёт на ней и заметно быстрее. Если нет, всё честно работает на процессоре.

Как это устроено

┌──────────────────────────────────────────────────────┐
│  Оболочка Tauri (Rust)                               │
│  трей · оверлей · настройки (React)                  │
│  глобальные хоткеи · вставка текста · активное окно  │
└──────────────────────┬───────────────────────────────┘
                       │ JSON-RPC через stdio
┌──────────────────────▼───────────────────────────────┐
│  Движок на Python (sidecar)                          │
│  захват микрофона · VAD · faster-whisper (STT)       │
│  RU/EN + смешанная речь · быстрая/умная очистка      │
│  сниппеты · голосовые команды · личный словарь       │
└──────────────────────────────────────────────────────┘

Распознанный текст проходит очистку. Быстрый режим работает по правилам: убирает слова-паразиты, чинит пробелы, заглавные буквы, точки и знаки вопроса, задержка почти нулевая. Умный режим полирует текст локальной языковой моделью через llama.cpp: пунктуация, форматирование, стиль. Он тоже полностью офлайн.

Статус

Рабочая альфа. Полный цикл диктовки живой: захват звука, VAD, faster-whisper, очистка, вставка в активное окно. Есть иконка в трее, постоянный оверлей, глобальный push-to-talk и окно настроек. Поддерживаются CUDA (int8) и CPU. Планы лежат в docs/ROADMAP.md.

Структура репозитория

Путь Что внутри
apps/desktop/ Приложение Tauri: интерфейс на React и нативный слой на Rust
core/openflow-engine/ Движок на Python: аудио, VAD, STT, очистка
models/ Манифесты моделей и скрипты скачивания (веса в git не хранятся)
plugins/ Примеры сниппетов и наборов команд
scripts/ Настройка dev-окружения, бенчмарки, сборка портативной версии
tests/ Тесты для Python и Rust
docs/ Архитектура, роадмап, производительность, приватность

Быстрый старт для разработчика

cd core/openflow-engine
python -m venv .venv
.venv\Scripts\pip install -e .[dev]
.venv\Scripts\python -m openflow_engine --selftest

Приватность

Всё работает локально. Никакой телеметрии и никаких сетевых вызовов во время работы: модели скачиваются явно и один раз. Подробности в docs/PRIVACY.md.

Лицензия

MIT

About

Локальный голосовой диктовщик для Windows. Бесплатная альтернатива Wispr Flow: распознавание речи полностью на вашем компьютере, без облака и подписок.

Topics

Resources

License

Contributing

Stars

2 stars

Watchers

0 watching

Forks

Packages

 
 
 

Contributors