| Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате |
| Форум программистов > Java: Общие вопросы > Выборка нужной информации с html страницы? |
| Автор: unkis 17.9.2006, 19:24 | ||
| Ребята подскожите чем можно пропарcить html страницу? Есть страница, в ней где-то посередине находится таблица а в ней мне нужная информация, как мне еёполучить? Что нам java предлогает? я немогу на 100 % сказать является ли эта страница "XML".
Зарания благодарен. |
| Автор: unkis 17.9.2006, 20:20 | ||
вот что-то накапал но никак не могу понять как мнеполучить именно мойелемент?
|
| Автор: powerOn 17.9.2006, 20:32 |
| unkis, аналогичные темы уже обсуждались: http://forum.vingrad.ru/index.php?showtopic=73175 http://forum.vingrad.ru/index.php?showtopic=75197 http://forum.vingrad.ru/index.php?showtopic=103445 |
| Автор: unkis 17.9.2006, 21:42 |
| спасибо там предлогают регулярными выроженими рользоваться или сторонними библиотеками, я не уверен что это будет быстро. Мне же очень важна скорость, так как парсить надо будет около 200-1000 чтраниц. Может что-нибудьбконкретней подскажите. Зарания благодарен. |
| Автор: LSD 17.9.2006, 22:30 |
| Скорость работы регулярных выражений зависит от того насколько сложное само выражение. Если тебе удастся описать искомый текст максимально простым регулярным выражением, то это будет максимально быстрый способ. Быстрее чем парсинг HTML и последующий анализ структуры. |
| Автор: unkis 17.9.2006, 22:46 | ||
| что-то уменя никак не получается написать регулярное вырожение чтобыз абирать этот текст. Мне надо чтобы он был к примеру вот так: a1 = "Inverkehrssetzung" b1 = "8 / 2002" a2 = "Fahrzeugart" b2 = "Occasion" и так далея, типа map, key=value помогите пожалуйста. Заранияблагодарен.
|