Распознавание речи по спикерам в SaluteSpeech: от моделей и алгоритмов до production-оптимизаций

12 подписчиков

12+
12+

2 дня назад

ПожаловатьсяНарушение авторских прав

12 подписчиков

12+
12+

2 дня назад

ПожаловатьсяНарушение авторских прав
12+
12+

2 дня назад

Спикеры: Никита Ноев Выпускник ФКН ВШЭ. Более 5 лет в речевых технологиях. ML Engineer, Sber Михаил Кузьмин Выпускник магистратуры НГТУ и НГУ. В Sber — разработка высокопроизводительной runtimе инфраструктуры для ASR-платформы GigaPlatform. Senior ML Engineer, Sber В докладе подробно рассмотрим процесс разработки и интеграции пайплайна Speaker Diarization в систему распознавания речи: от постановки задачи до внедрения решения в промышленную эксплуатацию. Будут представлены применяемые модели и алгоритмы, а также опыт оптимизации пайплайна. Мы покажем, как сочетание алгоритмических эвристик и низкоуровневой инженерной оптимизации позволило существенно снизить латенси и обеспечить стабильную работу системы в production среде

Название:

Распознавание речи по спикерам в SaluteSpeech: от моделей и алгоритмов до production-оптимизаций

Категория:

Разное