RechFlow
Чистка текста

Умная чистка текста без Ollama: встроенный движок

3 мин чтения

Умную чистку — ту, что расставляет пунктуацию, склеивает обрывки и приводит фразу в порядок — раньше приходилось получать через отдельно установленную Ollama. С версии 0.5.4 модель может работать внутри самого RechFlow: ставить и запускать стороннее приложение не нужно.

Сначала: нужна ли она вам

Режим чистки выбирается в Настройки → Чистка:

  • Raw — текст ровно так, как его услышала модель распознавания;
  • Базовая — пунктуация, абзацы, списки, термины из словаря. Работает всегда и мгновенно, никакой языковой модели не требует;
  • Minimal и Normal — поверх базовой добавляют правку языковой моделью.

Языковая модель — и встроенная, и Ollama — нужна только для Minimal и Normal. Если вас устраивает «Базовая», дальше можно не читать: ничего скачивать не нужно.

Включение

Настройки → Чистка → «Движок умной чистки» → «Встроенная (без Ollama)».

Смена движка применяется после перезапуска ядра: закрытие окна крестиком только прячет RechFlow в трей. Выйдите через трей → «Выход» и запустите приложение заново.

При первом запуске с этим движком RechFlow сам скачает модель со своего сервера — около гигабайта, прогресс виден в приложении. Дальше она лежит на диске (%APPDATA%\Potok\models\llm) и сеть для чистки больше не нужна: текст обрабатывается на вашем компьютере и никуда не уходит.

Если автозагрузка не проходит

Гигабайт по рваному каналу доезжает не всегда. Тогда — ручной путь: страница rechflow.ru/components, блок «Модель чистки текста (Qwen2.5 1.5B)». Кнопка «Открыть в RechFlow» отдаёт файл приложению сама; либо «Скачать файл», а потом в Настройки → Компоненты нажать «Установить из файла» и выбрать скачанное.

Какую модель выбрать

В списке «Встроенная модель» их две.

Qwen2.5 1.5B — по умолчанию, и для встроенного движка это правильный выбор. Замер на восьмиядерном процессоре: загрузка около двух секунд, одна правка — около четырёх.

Qwen2.5 7B — точнее обращается с терминами, но встроенному движку её хватит только на видеокарте. На процессоре одна правка занимает около двадцати секунд, а у чистки бюджет — восемь: RechFlow не станет ждать дольше и вставит базовый результат. Брать её имеет смысл, если вы гоняете модель через Ollama на GPU.

Причина в том, что встроенный движок в текущей сборке считает процессором, даже когда видеокарта есть. GPU-ускорение остаётся за Ollama — она для этого и остаётся в списке движков.

Если чистка не сработала

Текст в любом случае будет вставлен: когда языковая модель недоступна, не загрузилась или не уложилась в бюджет, RechFlow отдаёт результат базовой чистки, а не сырую расшифровку и не пустоту. Это осознанное поведение — диктовка не должна теряться из-за модели.

Проверить, что происходит, можно по мелочам: терминология правится словарём и в базовом режиме, а вот перестроенные формулировки — признак того, что языковая модель отработала.

Отдельный тумблер «Прогрев LLM на старте» подгружает модель в память при запуске приложения. С ним первая за сеанс чистка не ждёт загрузки, без него — запуск RechFlow чуть быстрее.

Попробуйте голосом

Бесплатно, локально, без лимита слов. Windows 10/11 · бета · ~80 МБ

Скачать для Windows