Модераторы: Aliance, skyboy, MoLeX, ksnk
  

Поиск:

Ответ в темуСоздание новой темы Создание опроса
> текст между тэгами, сканирование результатов поисковика 
:(
    Опции темы
supercelt
Дата 25.10.2009, 16:30 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Опытный
**


Профиль
Группа: Участник
Сообщений: 658
Регистрация: 25.8.2005

Репутация: нет
Всего: 1



Здравствуйте! Помогите пожалуйста!
Нужно вот что:

Есть фраза "destroy shoes"
Нужно подставить её в поисковик, например вот так: somesite.ru/search.php?q=destroy shoes
Потом нужно с помощью пхп открыть эту страницу с результатами как текст. Ну это я знаю - fopen() и так далее
А вот дальше структура примерно такая:
Что открылось:
Код

<html>
<head>
....
</head>

<body>
тут какие-то теги...
<table class="result">
  <tr>
    <td>А тут результаты поиска - 1</td>
  </tr>
</table>
Тут какие-то дивы могут быть
<table class="result">
  <tr>
    <td>А тут результаты поиска - 2</td>
  </tr>
</table>
Другие элементы
<table class="result">
  <tr>
    <td>А тут результаты поиска - 3</td>
  </tr>
</table>
</body>
</html>


Нужно просканить этот отдаваемый исходный код и:
- выделить каждый результат поиска, то есть из всего выцарапать кусок:
Код

<table class="result">
  <tr>
    <td>А тут результаты поиска - 1</td>
  </tr>
</table>

Соотв. остальные результаты тоже, короче опираясь на таблицы, у которых класс = result
Выцарапать надо как есть, то есть вместе с тэгами table

PM   Вверх
NewDima
Дата 10.11.2009, 07:49 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Опытный
**


Профиль
Группа: Участник
Сообщений: 922
Регистрация: 20.2.2006
Где: <?here?>

Репутация: -1
Всего: 12



simplexml
PM ICQ   Вверх
Aumn
Дата 5.12.2009, 05:55 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 15
Регистрация: 3.12.2009

Репутация: нет
Всего: нет



Код

$doc = new DOMDocument();
$doc->load('somesite.ru/search.php?q=destroy shoes', LIBXML_DTDLOAD);
$doc->saveXML() = str_replace("class=\"result\"", "xml:id=\"result\", $doc->saveXML());
$result=$doc->getElementById('result');


Этот код парсит страницу, использует модуль PHP, заменяет class на id, затем парсит все таблицы в массив $result. Структуру получившегося массива Вы можете просмотреть, предварительно вывев его на экран ( например с помощью print_r($result); ), а дальше уже легко. Удачи!

Это сообщение отредактировал(а) Aumn - 5.12.2009, 05:56
PM MAIL ICQ Skype   Вверх
  
Ответ в темуСоздание новой темы Создание опроса
0 Пользователей читают эту тему (0 Гостей и 0 Скрытых Пользователей)
0 Пользователей:
« Предыдущая тема | PHP: Тексты | Следующая тема »


 




[ Время генерации скрипта: 0.0391 ]   [ Использовано запросов: 22 ]   [ GZIP включён ]


Реклама на сайте     Информационное спонсорство

 
По вопросам размещения рекламы пишите на vladimir(sobaka)vingrad.ru
Отказ от ответственности     Powered by Invision Power Board(R) 1.3 © 2003  IPS, Inc.