RechFlow
Студия · диаризация

Разделение по спикерам

Диаризация размечает, кто и когда говорил в записи. Реплики разносятся по спикерам — интервью, круглый стол или совещание читаются как диалог, а не сплошной поток.

кто что сказална устройствередактор имён
Скачать для Windows
Windows 10/11
бета · ~80 МБ
▶ интервью.wav
↓ расшифровка на устройстве
Спикер 1Спикер 2DOCX
Что делает

Что даёт диаризация

👥

Реплики по спикерам

Каждый фрагмент подписан говорящим — текст читается как диалог с репликами.

Имена вместо «Спикер N»

Переименуйте спикеров один раз — имя подставится во всей расшифровке и в экспортах.

Слияние спикеров

Если один человек распознан как двое — объедините их в один клик.

С тайм-кодами

Смена говорящего привязана ко времени — удобно свериться с записью.

Как это работает

Как реплики расходятся по людям

1

Распознавание речи

Сначала запись превращается в текст с тайм-кодами.

2

Разделение голосов

Из звука считаются голосовые отпечатки и группируются: близкие по звучанию фрагменты относятся к одному человеку.

3

Сведение

Каждая реплика получает своего говорящего. Спикеров можно переименовать — имена уедут и в документ, и в субтитры.

Как это устроено

На устройстве

Диаризация считается локально на вашем ПК, отдельной моделью — запись не уходит в облако.

#

Число спикеров

Авто-определение или ручное указание, сколько человек в записи — меньше ошибочного дробления.

Без лимита минут

Длинные записи целиком, хоть на несколько часов. Нет платы за минуту и квоты на длительность файла.

Факты

Как это устроено и что настраивается

МетодГолосовые отпечатки участников и их кластеризация, затем совмещение с распознанным текстом по тайм-кодам.
Число говорящихМожно задать точно, если оно известно, либо оставить определение автоматическим.
Где считаетсяЦеликом на вашем компьютере, вместе с распознаванием.
Куда попадает результатВ текст, в DOCX и PDF, а также префиксом в субтитры SRT и VTT.
Длина записиДо 6 часов одним файлом. Платы за минуту и квоты на длительность нет.
Сколько занимаетНа видеокарте шесть часов записи расшифровываются примерно за 15–35 минут. На процессоре без видеокарты — часы: фича рассчитана на GPU.
Вопросы

Вопросы про разделение по спикерам

Это ответ на вопрос «кто и когда говорил». Распознавание речи превращает звук в текст, а диаризация делит этот текст на реплики конкретных людей.

Разметить спикеров

Бесплатно, локально. Windows 10/11 · бета · ~80 МБ

Скачать для Windows