Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > Алгоритмы > Выделение особых позиций в последовательностях


Автор: _Y_ 13.2.2008, 16:43
Пришла в голову такая задача. Интересно, можно ли ее решить, а если можно, то с какой стороны копать?

Имеется исходная последовательность обьектов. Например строка. Количество букв в ней может варьироваться в довольно широких пределах. Мы знаем, что некоторые позиции в этой строке несут особое значение, но мы не знаем закона, по которому можно эти позиции идентифицировать и мы не знаем сколько в строке таких позиций. Может они определяются группами окружающих их букв, может расстоянием от конца строки, может расстоянием друг от друга, а может и комбинацией разных факторов. Надо эти позиции найти. Понятное дело, имеется куча примеров строк, в которых такие позиции уже идентифицированы.

Подозреваю (но не факт), что нужно строить нейронную сеть и обучать ее на примерах строк с известными позициями, а потом использовать эту сеть для поиска позиций в новых строках.

Вопрос - куда копать? Хотя бы какой тип нейронных сетей надо рассматривать?



Автор: Promitheus 13.2.2008, 21:56
Цитата
 Количество букв в ней может варьироваться в довольно широких пределах. 
 - Очень узкое место в постановке задачи. 

    Скажем если обучать на примерах длиной 7 символов, то в строках, где особенности на 9-10 символе ничего не будет. Но с другой стороны, можно обучить на максимально длинных примерах, тогда короткие будут обрабатываться.  И вообще в сетях за раннее задается число входов и выходов. О таких в которых можно походу дела варьировать число входов и выходов не слыхал… 
    Вообще можно применять нечеткие правила, есть общие какие-то моменты с сетями, но зато не будет ограничения на число элементов. Скажем такой вар: декомпозиция строки на подстроки и применение к подстрокам из 3-4 символов правил, а потом уже к результатам работы правил еще правило и на выходе результат. (Реальных задач не решал пока только в книжках читал)
    Может это из теории компиляторов ? В инсте у нас были задачи из разряда подходит ли нам 0010101010101000101010101001101010 строка в рамках нашей грамматики, а такая 0101010101011111111010101010101 и т.д.  

Автор: _Y_ 14.2.2008, 11:07
Цитата(Promitheus @ 13.2.2008,  21:56)
Цитата
 Количество букв в ней может варьироваться в довольно широких пределах. 
 - Очень узкое место в постановке задачи.

Я так и подумал. Но зато надумал что можно просто проезжать по строке неким окном определенной длины (не маленькой) игнорируя влияние кусков, выходящих за пределы этого окна.

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)