natapavlos (natapavlos) wrote,
natapavlos
natapavlos

Category:

Искусственный интеллект Google научится распознавать невнятную речь





Google стремится сделать системы распознавания речи доступными для всех, в том числе тех, кто страдает от нарушений дикции или плохо говорит по-английски. Модель обучения дополнили речью больных БАС и сэплами с сильным акцентом.

Люди с боковым амиотрофическим склерозом (БАС) часто имеют проблемы с дикцией. Это осложняет не только общение, но и использование систем распознавания речи, которые, как правило, обучаются на данных здоровых людей. Похожие трудности испытывают люди, которые говорят по-английски с сильным акцентом, отмечает Venture Beat.


Помочь таким людям может сервис Project Euphonia, который разрабатывают специалисты из Google. Чтобы настроить стандартный алгоритм на работу с «проблемными» пользователями, исследователи дополнили наборы данных небольшой выборкой, представляющей людей с БАС и акцентами. Так, выборка для людей с БАС состояла из 36 часов аудиозаписей, полученных от 67 пациентов. Выборку с акцентами составляли 20 часовых записей.

По словам исследователей, этого было достаточно, чтобы преодолеть дефицит данных. Дополненные модели распознавали речь людей с БАС и сильным акцентом на 62% и 35% соответственно.

В дальнейшем в Google намерены расширить тренировочные наборы данных, чтобы довести алгоритм до совершенства.
Subscribe
Buy for 20 tokens
colonelcassad очень любит хвалить сталинскую индустриализацию... И вот зашел я к нему в блог и увидел такое: https://colonelcassad.livejournal.com/5488423.html Ну действительно, зачем России промышленные предприятия? У нас же есть нефть, газ - будем их продавать, а сами станем…
  • Post a new comment

    Error

    Anonymous comments are disabled in this journal

    default userpic
  • 0 comments