Полная версия этой страницы:
Про процессоры
Гы, кроме процессорной пурги там есть вааще пурга интересная:
| QUOTE |
апример, буква "i" в разных английских словах произносится по-разному. Даже в словах "five" и "nine" под влиянием звуков, произносимых до и после, "i" звучит для процессора неодинаково. Только для этой буквы существует более 1000 вариантов звучания.
|
интерсно как он представляет себе распознавание этой буквы i в слове eight

Правда еще интереснее как он видит распознавание там букв gh или буквы t в слове ballet
Это бред, распознают не буквы, а фонемы(звуки) - это аксиома, известная любому, кто хоть немного знакомился с задачей распознавания речи. Фонем больше, чем букв, в английском, если не ошибаюсь, их около 60, в русском - около 50.
Смешно...
Вовсе не речь они там распознают, а мысли читают:
"Университетская система смогла распознать короткие предложения в два раза быстрее, чем ученые их произносили."
Корреспонденты все могут переврать, но это развитие очень давних идей.
Еще в библиотеках процедур для очень древних языков программирования были функции. которые ориентировались не на точность написания слова, а как бы на его звучание, т.е. выдавали одинаковый результат при любом написании слова, например, 'photo' или "foto'
| QUOTE (facus @ 30.08.2006, 14:35) |
Корреспонденты все могут переврать, но это развитие очень давних идей. ... |
Идеи там не такие уж и древние - основные математические подходы(HMM -"Скрытые модели Маркова") были получены в 60-е годы, причем без приложения к задаче распознавания речи, а стали доступными инженерной публике в 70-е. Здесь вот это все описано:
http://www.cs.ubc.ca/~murphyk/Bayes/rabiner.pdf
Под "древними" я в данном случае имел в виду тот же Клиппер 80-х годов.
Нам на практике не хватало таких же библиотек тока для русского языка.
Кстати, есть ли конкретные программные средства, которые бы понимали, что последовательность символов "превед" или "пирвет" на самом деле "привет", но без использования таблиц соответствия?
| QUOTE (facus @ 30.08.2006, 15:51) |
... Кстати, есть ли конкретные программные средства, которые бы понимали, что последовательность символов "превед" или "пирвет" на самом деле "привет", но без использования таблиц соответствия? |
Спеллчекеры всякие имннно это и делают, но это не задача распознавания речи, а задача распознавания символов (OCR).
Не совсем понятно, что есть таблица соответствия? Если, к примеру, нейронную сеть использовать, то это таблица соответствия или нет?
| QUOTE (Михалыч @ 30.08.2006, 16:06) |
| Если, к примеру, нейронную сеть использовать, то это таблица соответствия или нет? |
Все намного приземленнее

Некий оператор набирая текст ошибся и набрал "Алег" вместо "Олег".
Примитивно это решается так - в таблицу внесен перечень слов, которые программа должна понять как "Олег".
Но ошибки операторов есть вещь непредсказуемая... и все их заранее в таблицу не внесешь.
Для просмотра полной версии этой страницы, пожалуйста,
пройдите по ссылке.