Искусственный интеллект научился грамотно распознавать речь среди шума

МЕНЮ

Искусственный интеллект
Поиск
Регистрация на сайте
Помощь проекту

ТЕМЫ

Новости ИИ

Искусственный интеллект
Голосовой помощник
Городские сумасшедшие
ИИ в медицине
ИИ проекты
Искусственные нейросети
Слежка за людьми
Угроза ИИ

Разработка ИИ

ИИ теория
Компьютерные науки
Машинное обуч. (Ошибки)
Машинное обучение
Машинный перевод
Реализация ИИ
Реализация нейросетей
Создание беспилотных авто
Трезво про ИИ
Философия ИИ

Внедрение ИИ

Big data
Генетические алгоритмы
Капсульные нейросети
Основы нейронных сетей
Распознавание лиц
Распознавание образов
Распознавание речи
Техническое зрение
Чат-боты

Работа разума и сознание

Изучение сна
Изучение сознания
Психология
Работа головного мозга
Работа памяти
Работа разума

Модель мозга

Модель мозга

Робототехника, БПЛА

Беспилотные автомобили
БПЛА
Робототехника

Трансгуманизм

Трансгуманизм

Обработка текста

Анализ социальных сетей
Компьютерная лингвистика
Лингвистика
Поисковые алгоритмы

Теория эволюции

Головной мозг
Нейронные сети
Поведение животных
Теория эволюции

Дополненная реальность

Виртулаьная реальность
Дополненная реальность

Железо

Интернет вещей
Квантовые компьютеры
Нейронные процессоры
облачные вычисления
Суперкомпьютеры

Киберугрозы

Кибербезопасность

Научный мир

Методы исследования
Наука и образование
Семинары

ИТ индустрия

ИТ-гиганты
Новости ит

Разработка ПО

Разработка ПО
Теория алгоритмов

Теория информации

Кластеризация

Математика

Актуальная математика
Статистика
Теория вероятности
Теория информации
Теория хаоса

Цифровая экономика

Технология блокчейн
Цифровая экономика

Авторизация

RSS

RSS новости

2017-06-13 09:39

искусственный интеллект, алгоритмы распознавания речи, распознавание образов

Виртуальные ассистенты и системы распознавания голоса достаточно хорошо научились «узнавать» то, что им говорит человек, и выполнять его команды.

Но для корректной работы тех же Siri и Cortana посторонний шум может стать большой проблемой. Справиться с этой технической недоработкой могут помочь эксперты компании Mitsubishi Electric, которые представили новую технологию выделения речи одного человека из общего шума.

Технология японской компании получила название Deep Clustering, функционирование которой построено на принципах машинного изучения. Искусственный интеллект для начала научился самостоятельно выделять речь одного человека из общего потока различных звуков и шумов. Нейронная сеть разделяет входящие аудиоданные на различные элементы и анализирует каждый в отдельности, после чего уже может обрабатывать голос человека. Подобная работа наблюдается и при «присоединении» двух и более собеседников.

В ходе демонстрации технологии японской компании система смогла успешно разделить речь двух человек, говорящих в один микрофон одно и то же предложение на разных языках. Вся обработка производилась в режиме реального времени, а задержка не превышала трех секунд. Точность распознавания составила 90 процентов, а когда в микрофон начали говорить три человека, процент «попадания» упал до 80, что тоже является хорошим результатом. Как рассказывают авторы проекта Энтони Ветро и Йохеи Окато,

«В отличие от выделения речи из фоновых шумов, выделение речи одного человека из «голосового» шума говорящих одновременно людей является сложнейшей задачей, так как у звуков голоса разных людей имеется масса особенностей. В большинстве систем задача разделения голоса решается при помощи установки двух или большего количества микрофонов, но в случае использования всего одного микрофона, с задачей разделения голоса может справиться только искусственный интеллект. Использовать эту технологию можно там, где требуется высокая точность распознавания голосовых сообщений. Например, в системах голосового управления автомобилями, лифтами, бытовыми и прочими электронными устройствами».

Источник: it-news.club



		Искусственный интеллект научился грамотно распознавать речь среди шума
МЕНЮ Искусственный интеллект Поиск Регистрация на сайте Помощь проекту ТЕМЫ Новости ИИ Искусственный интеллект Голосовой помощник Городские сумасшедшие ИИ в медицине ИИ проекты Искусственные нейросети Слежка за людьми Угроза ИИ Разработка ИИ ИИ теория Компьютерные науки Машинное обуч. (Ошибки) Машинное обучение Машинный перевод Реализация ИИ Реализация нейросетей Создание беспилотных авто Трезво про ИИ Философия ИИ Внедрение ИИ Big data Генетические алгоритмы Капсульные нейросети Основы нейронных сетей Распознавание лиц Распознавание образов Распознавание речи Техническое зрение Чат-боты Работа разума и сознание Изучение сна Изучение сознания Психология Работа головного мозга Работа памяти Работа разума Модель мозга Модель мозга Робототехника, БПЛА Беспилотные автомобили БПЛА Робототехника Трансгуманизм Трансгуманизм Обработка текста Анализ социальных сетей Компьютерная лингвистика Лингвистика Поисковые алгоритмы Теория эволюции Головной мозг Нейронные сети Поведение животных Теория эволюции Дополненная реальность Виртулаьная реальность Дополненная реальность Железо Интернет вещей Квантовые компьютеры Нейронные процессоры облачные вычисления Суперкомпьютеры Киберугрозы Кибербезопасность Научный мир Методы исследования Наука и образование Семинары ИТ индустрия ИТ-гиганты Новости ит Разработка ПО Разработка ПО Теория алгоритмов Теория информации Кластеризация Математика Актуальная математика Статистика Теория вероятности Теория информации Теория хаоса Цифровая экономика Технология блокчейн Цифровая экономика Авторизация RSS RSS новости		2017-06-13 09:39 искусственный интеллект, алгоритмы распознавания речи, распознавание образов Виртуальные ассистенты и системы распознавания голоса достаточно хорошо научились «узнавать» то, что им говорит человек, и выполнять его команды. Но для корректной работы тех же Siri и Cortana посторонний шум может стать большой проблемой. Справиться с этой технической недоработкой могут помочь эксперты компании Mitsubishi Electric, которые представили новую технологию выделения речи одного человека из общего шума. Технология японской компании получила название Deep Clustering, функционирование которой построено на принципах машинного изучения. Искусственный интеллект для начала научился самостоятельно выделять речь одного человека из общего потока различных звуков и шумов. Нейронная сеть разделяет входящие аудиоданные на различные элементы и анализирует каждый в отдельности, после чего уже может обрабатывать голос человека. Подобная работа наблюдается и при «присоединении» двух и более собеседников. В ходе демонстрации технологии японской компании система смогла успешно разделить речь двух человек, говорящих в один микрофон одно и то же предложение на разных языках. Вся обработка производилась в режиме реального времени, а задержка не превышала трех секунд. Точность распознавания составила 90 процентов, а когда в микрофон начали говорить три человека, процент «попадания» упал до 80, что тоже является хорошим результатом. Как рассказывают авторы проекта Энтони Ветро и Йохеи Окато, «В отличие от выделения речи из фоновых шумов, выделение речи одного человека из «голосового» шума говорящих одновременно людей является сложнейшей задачей, так как у звуков голоса разных людей имеется масса особенностей. В большинстве систем задача разделения голоса решается при помощи установки двух или большего количества микрофонов, но в случае использования всего одного микрофона, с задачей разделения голоса может справиться только искусственный интеллект. Использовать эту технологию можно там, где требуется высокая точность распознавания голосовых сообщений. Например, в системах голосового управления автомобилями, лифтами, бытовыми и прочими электронными устройствами». Источник: it-news.club Комментарии:

Искусственный интеллект научился грамотно распознавать речь среди шума

Комментарии: