Хабр Курсы для всех
РЕКЛАМА
Практикум, Хекслет, SkyPro, авторские курсы — собрали всех и попросили скидки. Осталось выбрать!

Для диаризации вы какой моделью пользуетесь? Там требуется токен или лицензионное соглашение?
В решении не готовый diarization pipeline вроде pyannote, а свой стек:
1. эмбеддинги спикеров — speechbrain/spkrec-ecapa-voxceleb (ECAPA-TDNN, 192-d);
2.кластеризация — UMAP + HDBSCAN + GMM.
для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.
Вчера только выложил https://habr.com/ru/articles/1066622/, там как раз говорил о планах распознавания интервью стейкхолдеров
AudioToText: управление требованиями через записи встреч