Аналитик
Спасибо! 🤝
На github схема данных есть в доках.
В решении не готовый diarization pipeline вроде pyannote, а свой стек:1. эмбеддинги спикеров — speechbrain/spkrec-ecapa-voxceleb (ECAPA-TDNN, 192-d);
speechbrain/spkrec-ecapa-voxceleb
2.кластеризация — UMAP + HDBSCAN + GMM.для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.
Очень интересный и оригинальный подход взамен широко тиражируемого в агентских системах TextToSQL. 👍
Функцию вызова Cursor без привязки к IDE.
Спасибо! 🤝
На github схема данных есть в доках.
В решении не готовый diarization pipeline вроде pyannote, а свой стек:
1. эмбеддинги спикеров —
speechbrain/spkrec-ecapa-voxceleb(ECAPA-TDNN, 192-d);2.кластеризация — UMAP + HDBSCAN + GMM.
для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.
Очень интересный и оригинальный подход взамен широко тиражируемого в агентских системах TextToSQL. 👍
Функцию вызова Cursor без привязки к IDE.