Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > Java: GUI и Java FX приложения > подсчет частоты слов в html


Автор: elija 30.5.2010, 15:42
В общем, задание такое:
Форматирование гипертекстового (HTML) файла
Программа подсчитывает частоты появления слов в html-файле, слова считаются одинаковыми при совпадении первых 70% букв (% совпадения можно менять, синтаксис слов не учитывается). Формируется таблица из первых n наиболее часто встречающихся слов, в таблице содержится само слово и ссылки на все абзацы, где оно появляется.

Немного поясню...html файл загружается с локального источника, то есть прописывается путь до файла. Насколько я понял, дальше идет поиск одинаковых слов и происходит создание нового html файла...В файле есть таблица со часто встречающимися словами и номерами абзацев(номера имеют ссылки на абзацы), где эти слова встречаются. После таблицы в файле идет исходный текст. Под абзацем понимается все, что имеет тег <br>...Слова с больших и маленьких букв являются одинаковыми...

помогите сделать...совершенно не понимаю, с чего тут начать, а сдавать надо уже завтра...

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)