| Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате |
| Форум программистов > Perl: разработка для Web > парсинг сложных таблиц |
| Автор: burakov 7.6.2012, 23:26 | ||
| Здравствуйте, поставили задачу распарсить в отдельные поля расписание http://www.fitnes.ru/content/ru/schedule.html?cl=8299 сложность заключается в том, что в таблице, где содержится расписание понаобъединяли столбцы после простейшего распарсивания получилось
из чего видно, что построчно такую таблицу не возьмешь поскольку непонятно (там где меньшее количество столбцов) какой ячейке таблицы принадлежит контент. понимаю что хочу ЧУДА, но для моей логики данный парсинг весьма сложен оказался может есть какой то модуль? который бы преобразовывал данную таблицу в таблицу состоящую из одиночных ячеек (без rowspan=""). или может кто уже делал и поделится кусочком кода.? спасибо. |
| Автор: EcSYZ 8.6.2012, 00:21 | ||
| Как на счёт варианта - превратить rowspan в несколько записей ? Что-то вроде:
|
| Автор: burakov 8.6.2012, 07:58 | ||
| спасибо. об этом решении я подумал конечно, но это было бы легко, если бы в каждой строке было свое объединение столбцов. ниже кусочек, где видно, что в верхней строке есть объединение, а внизу оставлен просто 1 столбец. то есть нужно как то еще анализировать предыдущее состояние... кроме того кусочек показывает как криво выполненно само объединение (хотя отображается "глазами" все верно). (я имею ввиду, что столбцов в таблице всего 8, а роуспанов хрен поймешь на каждой ячейке понатыкано.) -- вообщем криво до безобразия. прямо руки опускаются.
|
| Автор: White_Eagle 8.6.2012, 13:37 | ||
| Как я вижу из предоставленного html - значения есть только там где td class="ляляляляля_4109" - последние 4 цифры. А там где в конце "0" - их нет. Начинать с
а дальше проверять "0" в конце класса - пропускать или 4 цифры - записывать. |