Главная страница
Top.Mail.Ru    Яндекс.Метрика
Текущий архив: 2005.01.30;
Скачать: CL | DM;

Вниз

Определение изменения Web-страницы   Найти похожие ветки 

 
Sergey18   (2004-11-09 13:18) [0]

Суть проблемы:
Есть программа, которая закачивает себе содержимое страниц с разнообразных сайтов в БД. Если страничка осталась неизменной, то она пропускается. Если изменилась, то она снова заносится в базу. Это я в общем плане, но суть не в этом. Проблема в определении изменения страницы:
* Возможно ли определить изменилась ли страница или нет, не загружая ее целиком? По содержимому страницы определять новизну невозможно по двум причинам:
1) База планируется большая. Запросы для сравнения будут выполняться очень долго.
2) Для экономии трафика. Чтобы каждый раз не заходить на одну и ту же страницу.

Возможно, это можно определять каким-либо образом по дате изменения или размеру страницы? Возможно ли получить каким-то образом эти данные от Web-сервера?

Спасибо.

p.s. Ведь как-то это делают различные Web-Downloader"ы...


 
panov ©   (2004-11-09 13:35) [1]

Использовать метод HEAD для получения заголовка страницы.


 
Sergey18   (2004-11-10 00:00) [2]

Чем мне может помочь метод HEAD? Ведь возможно, что в странице был изменен текст, а TITLE остался прежним?..



Страницы: 1 вся ветка

Текущий архив: 2005.01.30;
Скачать: CL | DM;

Наверх




Память: 0.47 MB
Время: 0.06 c
1-1105945707
DelphiN!
2005-01-17 10:08
2005.01.30
Как установить иконку, для определенной строки ListBox-a ?


6-1100692778
BFG9k
2004-11-17 14:59
2005.01.30
Ошибка определения размера файла в idFTP


1-1105701874
Axeman
2005-01-14 14:24
2005.01.30
Как закрыть???


1-1105831404
Vcl
2005-01-16 02:23
2005.01.30
Как спрятать курсор в TEdit ?


3-1104246356
Belkova
2004-12-28 18:05
2005.01.30
Копирование БД и монопольный доступ