Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузи резюме
описание
Команда синтеза речи создаёт перевод видео, аудиокниги и голос Алисы. Для обучения речевых моделей собирают большие массивы аудиоданных и текстов к ним.
задачи
Разрабатывать систему хранения больших объёмов данных и доступа к ним для ML-разработчиков
Эффективно хранить и быстро обрабатывать петабайты аудио
Улучшать пропускную способность пайплайнов сбора данных и масштабировать их для поддержки множества языков
Работать с разнородными источниками и строить процессы майнинга аудиоданных
Разрабатывать и применять ML-модели для детекции шума, музыки, языка, нескольких голосов, синтетической речи и несовпадения текста и аудио
Оценивать параметры данных, чтобы фильтровать их и повышать качество синтеза речи
требования
Писать на Python
Иметь опыт построения пайплайнов сбора данных для ML
Понимать, как работать с большими объёмами данных
Иметь практический опыт применения ML-моделей, желательно — их обучения
Быть мотивированным и готовым глубоко погружаться в область
Голосовой виртуальный помощник от Яндекса, понимающий речь и текст, отвечает на вопросы, управляет умным домом, ставит напоминания, играет музыку и помогает с ежедневными задачами