Обновить

Комментарии 3

Для диаризации вы какой моделью пользуетесь? Там требуется токен или лицензионное соглашение?

В решении не готовый diarization pipeline вроде pyannote, а свой стек:
1. эмбеддинги спикеров — speechbrain/spkrec-ecapa-voxceleb (ECAPA-TDNN, 192-d);

2.кластеризация — UMAP + HDBSCAN + GMM.

для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.

Вчера только выложил https://habr.com/ru/articles/1066622/, там как раз говорил о планах распознавания интервью стейкхолдеров

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации