Comments 3
Для диаризации вы какой моделью пользуетесь? Там требуется токен или лицензионное соглашение?
В решении не готовый diarization pipeline вроде pyannote, а свой стек:
1. эмбеддинги спикеров — speechbrain/spkrec-ecapa-voxceleb (ECAPA-TDNN, 192-d);
2.кластеризация — UMAP + HDBSCAN + GMM.
для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.
Вчера только выложил https://habr.com/ru/articles/1066622/, там как раз говорил о планах распознавания интервью стейкхолдеров
Sign up to leave a comment.
AudioToText: управление требованиями через записи встреч