![]() |
|
Модераторы: Illuminaty |
![]()
|
|
| Javoracle |
|
|||
|
Шустрый ![]() Профиль Группа: Участник Сообщений: 113 Регистрация: 20.12.2006 Где: Ново- Попуа- Нова я Гвинея Репутация: нет Всего: нет |
Не знаю в какой раздел запостить. пусть будет сюда.
есть сайт скажем yahoo.com мне нужно собрать все ссылки которые представлены на этой странице. Как понимаю, большая часть ссылак сделана каким то хитроумным способом, то есть если я открыл исходный код страницы то увидел следующее:
Какой может быть алгоритм для собирание всех ссылок сайта? |
|||
|
||||
| WebDisaster |
|
|||
![]() Опытный ![]() ![]() Профиль Группа: Участник Сообщений: 406 Регистрация: 22.6.2007 Репутация: 17 Всего: 19 |
Ну, эт точно не про вёрстку. А непонятно что, потому что задача не сформулирована.
Что значит "собрать все ссылки"? Скопировать в файл на локальом компьютере? Вставить в страницу на сайте? С одной этой страницы? Со всех страниц сайта? Одина раз "собрать" или при каждом запросе "пересобирать" заново? Варианты ответа будут от "собирать вручную" до "писать парсер". На каком языке его писать, будет зависеть от того, где парсинг страниц будет выполняться (в какой ОС) и в каком виде должен быть представлен результат. Не видя страницу живьём, складывается впечатление, что абсолютно ничего хитроумного в этих ссылках нет. Чтобы получить ссылку нужно: 1. Получить URL страницы (например, http://yahoo.com) 2. Парсить страницу, отыскивая вхождения подстроки <a href="r/hr" 3. Выкусить значение атрибута href, заключённое в кавычки 4. Подставить его к URL страницы: http://yahoo.com/r/hr |
|||
|
||||
![]()
|
| 0 Пользователей читают эту тему (0 Гостей и 0 Скрытых Пользователей) | |
| 0 Пользователей: | |
| « Предыдущая тема | Вёрстка веб-сайтов | Следующая тема » |
|
|
По вопросам размещения рекламы пишите на vladimir(sobaka)vingrad.ru
Отказ от ответственности Powered by Invision Power Board(R) 1.3 © 2003 IPS, Inc. |