Модераторы: Daevaorn
  

Поиск:

Ответ в темуСоздание новой темы Создание опроса
> Парсинг html с помощью lxml 
:(
    Опции темы
Karadul
Дата 14.5.2012, 05:52 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Опытный
**


Профиль
Группа: Участник
Сообщений: 378
Регистрация: 18.5.2006

Репутация: нет
Всего: 1



Почему lxml.html.parse() возвращает ElementTree, а lxml.html.document_fromstring() - Element html?

Можно сделать tree.getroot() - и он будет html, но зачем такая разница? И почему cssselect работает только для Element, но не для ElementTree?

[offtop]
Код

Traceback (most recent call last):
  File "<stdin>", line 1, in <module>
  File "d:\Program Files\Python27\lib\site-packages\lxml-2.3-py2.7-win32.egg\lxml\html\__init__.py", line 692, in parse
    return etree.parse(filename_or_url, parser, base_url=base_url, **kw)
  File "lxml.etree.pyx", line 2942, in lxml.etree.parse (src/lxml/lxml.etree.c:54187)
  File "parser.pxi", line 1553, in lxml.etree._parseDocument (src/lxml/lxml.etree.c:79727)
TypeError: cannot parse from 'builtin_function_or_method'

80k строк в файле?
PM MAIL   Вверх
  
Ответ в темуСоздание новой темы Создание опроса
0 Пользователей читают эту тему (0 Гостей и 0 Скрытых Пользователей)
0 Пользователей:
« Предыдущая тема | Python: Общие вопросы | Следующая тема »


 




[ Время генерации скрипта: 0.0380 ]   [ Использовано запросов: 22 ]   [ GZIP включён ]


Реклама на сайте     Информационное спонсорство

 
По вопросам размещения рекламы пишите на vladimir(sobaka)vingrad.ru
Отказ от ответственности     Powered by Invision Power Board(R) 1.3 © 2003  IPS, Inc.