| Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате |
| Форум программистов > Java: GUI и Java FX приложения > подсчет частоты слов в html |
| Автор: elija 30.5.2010, 15:42 |
| В общем, задание такое: Форматирование гипертекстового (HTML) файла Программа подсчитывает частоты появления слов в html-файле, слова считаются одинаковыми при совпадении первых 70% букв (% совпадения можно менять, синтаксис слов не учитывается). Формируется таблица из первых n наиболее часто встречающихся слов, в таблице содержится само слово и ссылки на все абзацы, где оно появляется. Немного поясню...html файл загружается с локального источника, то есть прописывается путь до файла. Насколько я понял, дальше идет поиск одинаковых слов и происходит создание нового html файла...В файле есть таблица со часто встречающимися словами и номерами абзацев(номера имеют ссылки на абзацы), где эти слова встречаются. После таблицы в файле идет исходный текст. Под абзацем понимается все, что имеет тег <br>...Слова с больших и маленьких букв являются одинаковыми... помогите сделать...совершенно не понимаю, с чего тут начать, а сдавать надо уже завтра... |