Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > C/C++: Мультимедия, OpenGL/DirectX > Расспознавание голосовых команд


Автор: atavinta 31.1.2008, 14:22
Надо реализовать распознавание речевых команд для управления автоматизированными модулями, каждый из которых имеет собственный набор команд Кроме того, один из модулей должен понимать произношение имен собственных, произвольно регистрируемых с клавиатур других компьютеров. Предположим в сетевой космической леталке союзник зарегистрировал свой космокрейсер под именем "глория". Я говорю в микрофон "связь глория" и должен получить чат с командиром этого корабля.

Автор: seth 31.1.2008, 14:43
майкрософт что то такое делает... названия точного не помню... и то там на английском помоему...

Автор: FelikZ 3.2.2008, 17:48
atavinta, ммм а в чем проблемо собственно?
без специального оборудования 100% результат из звука в цифровом виде получить НЕ возможно...

Автор: atavinta 5.2.2008, 11:52
Пусть не 100%, но в принципе работать должно. При неувереннои расспознавании допускается выполнение не той команды, которая признесена или невыполнение вообще ничего. Но номинально в списке должны присутсвтовать команды, добавленные с клавиатуры, а их распознавание хоть иногда должно срабатывать без обучения.

Добавлено через 5 минут и 58 секунд
Кстати, должно поддерживаться распознавание русских команд, английских, произносимых с русским акцентом. Поддержка английских комманд, произносимых без акцента не обязательна, но тоже вариант. Проблема заключается в том, что я впринципе не знаю, в каком направлении работать по данной теме.

Автор: Alexeis 5.2.2008, 12:23
  Из русского софта я видел только "Горыныча", но он тоже построен на американском движке Dragon. Говорят неплохой движок для английского языка.

Автор: FelikZ 5.2.2008, 17:01
Цитата(atavinta @  5.2.2008,  11:52 Найти цитируемый пост)
Пусть не 100%, но в принципе работать должно.

ну если проект делается 4fun тобишь для личных нужд, то пробывать можно. Иначе просто нету имхо смысла выводить в свет продукт расчитанный только на пользователей определенного возраста и без малейших дефектов речи(и то такое сделать будет оч сложно). 
А так в помощь только http://www.google.ru....

Автор: Alexeis 5.2.2008, 17:32
Ну если проблема только в поиске, то могу подсказать сайт http://speech-soft.ru/, там много обзоров различных программ и движков.

Автор: atavinta 7.2.2008, 03:55
Продукт должент быть выпущен для конечных юзеров и понимать любой голос. Если обучение голосу необходимо, оно должно быть оступно. Но расспознавание должно хоть иногда срабатывать без речевого образца конкертной команды. Наоборот, поддержка акцента - обязательно, особенно для английского языка.

Добавлено через 5 минут и 55 секунд
Я так понял, чтио есть речевые SDK. Где их можно достаить? С сайта speech-soft.ru скачать хоть что-то не получается. Где можно купить такой диск? Можно ли его найти в Новокузнецке или в Новосибирске?

Автор: atavinta 7.2.2008, 06:01
Как сделать слоговое обучение и слоговое расспознавание? Используем два словаря: постоянный словарь слогов и динамический словарь слов в слоговой записи с автоматической трансляцией при добавлении из буквенной записи тех же слов. Программа обучается расспознаванию слогов, потом распознаёт их и при распознавании составляет из слогов слова. Потом полученные слова сравниваются со словарем слов. Как это реализовать? Как сделать трансляцию из букв в слоги? Как при распознавании выделить слоги из слитно произносимых слов? Как выделить их из слов при обучении? Как сравнивать голос с образцом? Как огранизовать словари? Как лучше кодировать? Как захватить звук?

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)