Помощь - Поиск - Пользователи - Календарь
Полная версия этой страницы: Про процессоры
Питерская горнолыжная конференция > Общие форумы > Курилка
Михалыч
Безграмотный журналист пишет "за науку" smile.gif
http://www.utro.ru/articles/2006/08/24/577511.shtml
АнтонА
Гы, кроме процессорной пурги там есть вааще пурга интересная:
QUOTE
апример, буква "i" в разных английских словах произносится по-разному. Даже в словах "five" и "nine" под влиянием звуков, произносимых до и после, "i" звучит для процессора неодинаково. Только для этой буквы существует более 1000 вариантов звучания.


интерсно как он представляет себе распознавание этой буквы i в слове eight smile.gif Правда еще интереснее как он видит распознавание там букв gh или буквы t в слове ballet
Михалыч
Это бред, распознают не буквы, а фонемы(звуки) - это аксиома, известная любому, кто хоть немного знакомился с задачей распознавания речи. Фонем больше, чем букв, в английском, если не ошибаюсь, их около 60, в русском - около 50.
lavrik
Смешно... smile.gif
NAM
Вовсе не речь они там распознают, а мысли читают:
"Университетская система смогла распознать короткие предложения в два раза быстрее, чем ученые их произносили."
facus
Корреспонденты все могут переврать, но это развитие очень давних идей.
Еще в библиотеках процедур для очень древних языков программирования были функции. которые ориентировались не на точность написания слова, а как бы на его звучание, т.е. выдавали одинаковый результат при любом написании слова, например, 'photo' или "foto'
Михалыч
QUOTE (facus @ 30.08.2006, 14:35)
Корреспонденты все могут переврать, но это развитие очень давних идей.
...

Идеи там не такие уж и древние - основные математические подходы(HMM -"Скрытые модели Маркова") были получены в 60-е годы, причем без приложения к задаче распознавания речи, а стали доступными инженерной публике в 70-е. Здесь вот это все описано:
http://www.cs.ubc.ca/~murphyk/Bayes/rabiner.pdf
facus
Под "древними" я в данном случае имел в виду тот же Клиппер 80-х годов.
Нам на практике не хватало таких же библиотек тока для русского языка.

Кстати, есть ли конкретные программные средства, которые бы понимали, что последовательность символов "превед" или "пирвет" на самом деле "привет", но без использования таблиц соответствия?
Михалыч
QUOTE (facus @ 30.08.2006, 15:51)
...
Кстати, есть ли конкретные программные средства, которые бы понимали, что последовательность символов "превед" или "пирвет" на самом деле "привет", но без использования таблиц соответствия?

Спеллчекеры всякие имннно это и делают, но это не задача распознавания речи, а задача распознавания символов (OCR).
Не совсем понятно, что есть таблица соответствия? Если, к примеру, нейронную сеть использовать, то это таблица соответствия или нет?
facus
QUOTE (Михалыч @ 30.08.2006, 16:06)
Если, к примеру, нейронную сеть использовать, то это таблица соответствия или нет?

Все намного приземленнее smile.gif

Некий оператор набирая текст ошибся и набрал "Алег" вместо "Олег".
Примитивно это решается так - в таблицу внесен перечень слов, которые программа должна понять как "Олег".
Но ошибки операторов есть вещь непредсказуемая... и все их заранее в таблицу не внесешь.
Для просмотра полной версии этой страницы, пожалуйста, пройдите по ссылке.
Форум IP.Board © 2001-2026 IPS, Inc.