| Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате |
| Форум программистов > C/C++: Мультимедия, OpenGL/DirectX > Расспознавание голосовых команд |
| Автор: atavinta 31.1.2008, 14:22 |
| Надо реализовать распознавание речевых команд для управления автоматизированными модулями, каждый из которых имеет собственный набор команд Кроме того, один из модулей должен понимать произношение имен собственных, произвольно регистрируемых с клавиатур других компьютеров. Предположим в сетевой космической леталке союзник зарегистрировал свой космокрейсер под именем "глория". Я говорю в микрофон "связь глория" и должен получить чат с командиром этого корабля. |
| Автор: seth 31.1.2008, 14:43 |
| майкрософт что то такое делает... названия точного не помню... и то там на английском помоему... |
| Автор: FelikZ 3.2.2008, 17:48 |
| atavinta, ммм а в чем проблемо собственно? без специального оборудования 100% результат из звука в цифровом виде получить НЕ возможно... |
| Автор: atavinta 5.2.2008, 11:52 |
| Пусть не 100%, но в принципе работать должно. При неувереннои расспознавании допускается выполнение не той команды, которая признесена или невыполнение вообще ничего. Но номинально в списке должны присутсвтовать команды, добавленные с клавиатуры, а их распознавание хоть иногда должно срабатывать без обучения. Добавлено через 5 минут и 58 секунд Кстати, должно поддерживаться распознавание русских команд, английских, произносимых с русским акцентом. Поддержка английских комманд, произносимых без акцента не обязательна, но тоже вариант. Проблема заключается в том, что я впринципе не знаю, в каком направлении работать по данной теме. |
| Автор: Alexeis 5.2.2008, 12:23 |
| Из русского софта я видел только "Горыныча", но он тоже построен на американском движке Dragon. Говорят неплохой движок для английского языка. |
| Автор: FelikZ 5.2.2008, 17:01 |
ну если проект делается 4fun тобишь для личных нужд, то пробывать можно. Иначе просто нету имхо смысла выводить в свет продукт расчитанный только на пользователей определенного возраста и без малейших дефектов речи(и то такое сделать будет оч сложно). А так в помощь только http://www.google.ru.... |
| Автор: Alexeis 5.2.2008, 17:32 |
| Ну если проблема только в поиске, то могу подсказать сайт http://speech-soft.ru/, там много обзоров различных программ и движков. |
| Автор: atavinta 7.2.2008, 03:55 |
| Продукт должент быть выпущен для конечных юзеров и понимать любой голос. Если обучение голосу необходимо, оно должно быть оступно. Но расспознавание должно хоть иногда срабатывать без речевого образца конкертной команды. Наоборот, поддержка акцента - обязательно, особенно для английского языка. Добавлено через 5 минут и 55 секунд Я так понял, чтио есть речевые SDK. Где их можно достаить? С сайта speech-soft.ru скачать хоть что-то не получается. Где можно купить такой диск? Можно ли его найти в Новокузнецке или в Новосибирске? |
| Автор: atavinta 7.2.2008, 06:01 |
| Как сделать слоговое обучение и слоговое расспознавание? Используем два словаря: постоянный словарь слогов и динамический словарь слов в слоговой записи с автоматической трансляцией при добавлении из буквенной записи тех же слов. Программа обучается расспознаванию слогов, потом распознаёт их и при распознавании составляет из слогов слова. Потом полученные слова сравниваются со словарем слов. Как это реализовать? Как сделать трансляцию из букв в слоги? Как при распознавании выделить слоги из слитно произносимых слов? Как выделить их из слов при обучении? Как сравнивать голос с образцом? Как огранизовать словари? Как лучше кодировать? Как захватить звук? |