Обновить
4
Иван Ерёменко@ivaneremenko

Аналитик

1
Подписчики
Отправить сообщение

Спасибо! 🤝

На github схема данных есть в доках.

В решении не готовый diarization pipeline вроде pyannote, а свой стек:
1. эмбеддинги спикеров — speechbrain/spkrec-ecapa-voxceleb (ECAPA-TDNN, 192-d);

2.кластеризация — UMAP + HDBSCAN + GMM.

для этой SpeechBrain-модели отдельный HF-токен и принятие лицензии не требуется.

Очень интересный и оригинальный подход взамен широко тиражируемого в агентских системах TextToSQL. 👍

Функцию вызова Cursor без привязки к IDE.

Информация

В рейтинге
Не участвует
Откуда
Краснодар, Краснодарский край, Россия
Дата рождения
Зарегистрирован
Активность

Специализация

Ученый по данным, BI-разработчик
Средний
От 300 000 ₽
SQL
Python
Английский язык
ООП
Git
Linux
Docker