<?php
function get_url_content($Url,$Method = 'c') {
//Укажите требуемую языковую кодировку. Если нет, по умолчанию будет использоваться utf-8, не волнуйтесь.
глобальный $Charset;
$Urlarr = parse_url($Url);
//Если доменное имя не может быть обнаружено, возвращаемся.
if (!isset($Urlarr['host'])) {
вернуть ложь;
}
//Мы разумно определяем множественную информацию заголовка.
foreach (@getallheaders() как $key => $val){
$key==='Host' && $val = $Urlarr['host'];
$key==='Referer' && $val ='http://'.$Urlarr['host'];
$str .= "'$key:$val', n";
}
//Виртуальное происхождение.
!eregi('Referer',$str) && $str .="'Referer:http://{$Urlarr['host']}', n";
//После исправления, по сути, источником также является этот сайт, а хостом также является URL-сайт.
$Header = массив(обрезка($str));
//Далее просто выберите, какую программу использовать для сбора.
if($Method === 'f'&&function_exists('file_get_contents')) {
$opts = массив(
'http'=>массив(
'метод'=>"ПОЛУЧИТЬ",
'header'=>$Заголовок,
)
);
$cxContext =stream_context_create($opts);
$file_contents = @file_get_contents($Url, false, $cxContext);
} elseif ($Method === 'c'&&function_exists('curl_init')) {
$Ch = Curl_init();
$Таймаут = 5;
Curl_setopt($Ch,CURLOPT_HTTPHEADER,$Header);
Curl_setopt ($Ch, CURLOPT_URL, $Url);
Curl_setopt ($Ch, CURLOPT_RETURNTRANSFER,1);
Curl_setopt ($Ch, CURLOPT_CONNECTTIMEOUT, $Timeout);
$file_contents = curl_exec($Ch);
локон_закрыть ($ Ч);
}
//Чтобы стиль отображался красиво, добавляем к нему целевую направляющую.
$file_contents = str_replace('</title>',"</title>n<base href=" http://{$Urlarr['host']}/ " />",$file_contents);
//Обработка наиболее распространенных кодировок. Если на целевом веб-сайте нет кодировки, по умолчанию используется GBK.
!preg_match('/charset=([^<>"]*)"/isU',$file_contents,$lang) && $lang[1]='GBK';
function_exists('mb_convert_encoding') && $file_contents = mb_convert_encoding($file_contents,empty($Charset)?'UTF-8':$Charset,$lang[1]);
//Выходим из части кода;
unset($Url,$lang,$Timeout,$Urlarr,$Charset);
вернуть $file_contents;
}
//Начинаем тестирование с помощью метода file_get_contents
HEADER("CONTENT-TYPE:TEXT/HTML; CHARSET=UTF-8");
//http://www.xtzj.com/read-htm-tid-347550.html Сбор данных невозможен.
$file = get_url_content(" http://www.hao123.com",'f' );
$file = Strip_tags($file,'<a>');
preg_match_all('/(http:[^"<>]*)>/isU',$file,$link);unset($link[0]);
$link = $link[1];
//Давайте смоделируем получение данных самостоятельно.
$х = 10;
$file = get_url_content($link[$x]);
эхо $файл;
?>
Пишите все пояснения и комментарии.
Если есть ответы, которые вам непонятны... Распространю информацию о сборнике.
Оригинальный адрес: http://bbs.phpchina.com/viewthread.php?tid=. 99263