«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

2025-07-30T05:00:30Z — «Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании.

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в умных колонках и ТВ-станциях компании с голосовым помощником Алисой.

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в умных устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статья с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Источник:

РБК — «Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Все новости — Наука и технологии

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Читайте также:

Новая технология скрывает голос от автоматического трекинга и взлома

В России стала доступна модель распознавания речи на русском языке

Технология скроет ваш голос от цифрового шпионажа

"Яндекс" запустил сервис для быстрого синтеза уникального голоса

Разработчик усомнился, что нейросеть сможет выявлять драки на концертах