Разделение по спикерам
Диаризация размечает, кто и когда говорил в записи. Реплики разносятся по спикерам — интервью, круглый стол или совещание читаются как диалог, а не сплошной поток.
бета · ~80 МБ
Что даёт диаризация
Реплики по спикерам
Каждый фрагмент подписан говорящим — текст читается как диалог с репликами.
Имена вместо «Спикер N»
Переименуйте спикеров один раз — имя подставится во всей расшифровке и в экспортах.
Слияние спикеров
Если один человек распознан как двое — объедините их в один клик.
С тайм-кодами
Смена говорящего привязана ко времени — удобно свериться с записью.
Как реплики расходятся по людям
Распознавание речи
Сначала запись превращается в текст с тайм-кодами.
Разделение голосов
Из звука считаются голосовые отпечатки и группируются: близкие по звучанию фрагменты относятся к одному человеку.
Сведение
Каждая реплика получает своего говорящего. Спикеров можно переименовать — имена уедут и в документ, и в субтитры.
Как это устроено
На устройстве
Диаризация считается локально на вашем ПК, отдельной моделью — запись не уходит в облако.
Число спикеров
Авто-определение или ручное указание, сколько человек в записи — меньше ошибочного дробления.
Без лимита минут
Длинные записи целиком, хоть на несколько часов. Нет платы за минуту и квоты на длительность файла.
Как это устроено и что настраивается
| Метод | Голосовые отпечатки участников и их кластеризация, затем совмещение с распознанным текстом по тайм-кодам. |
|---|---|
| Число говорящих | Можно задать точно, если оно известно, либо оставить определение автоматическим. |
| Где считается | Целиком на вашем компьютере, вместе с распознаванием. |
| Куда попадает результат | В текст, в DOCX и PDF, а также префиксом в субтитры SRT и VTT. |
| Длина записи | До 6 часов одним файлом. Платы за минуту и квоты на длительность нет. |
| Сколько занимает | На видеокарте шесть часов записи расшифровываются примерно за 15–35 минут. На процессоре без видеокарты — часы: фича рассчитана на GPU. |