更新時間:2022-04-25 編輯:創(chuàng)始人 關(guān)注人次:0 新格搜索
<?php //連接,$error錯誤編號,$errstr錯誤的字符串,30s是連接超時時間 $fp=fsockopen("www.youku.com",80,$errno,$errstr,30); if(!$fp) die("連接失敗".$errstr); //構(gòu)造http協(xié)議字符串,因為socket編程是最底層的,它還沒有使用http協(xié)議 $http="GET /?spm=a2hww.20023042.topNav.5~1~3!2~A HTTP/1.1\r\n"; // \r\n表示前面的是一個命令 $http.="Host:www.youku.com\r\n"; //請求的主機 $http.="Connection:close\r\n\r\n"; // 連接關(guān)閉,最后一行要兩個\r\n //發(fā)送這個字符串到服務(wù)器 fwrite($fp,$http,strlen($http)); //接收服務(wù)器返回的數(shù)據(jù) $data=''; while (!feof($fp)) { $data.=fread($fp,4096); //fread讀取返回的數(shù)據(jù),一次讀取4096字節(jié) } //關(guān)閉連接 fclose($fp); var_dump($data); ?>
打印出的結(jié)果如下,包含了返回的頭信息及頁面的源碼:
[php] view plain copy
//生成一個curl對象
$curl=curl_init();
//設(shè)置URL和相應(yīng)的選項
curl_setopt($curl, CURLOPT_URL, "http://www.youku.com");
curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1); //將curl_exec()獲取的信息以字符串返回,而不是直接輸出。
//執(zhí)行curl操作
$data=curl_exec($curl);
var_dump($data);
打印出的結(jié)果如下,只包含頁面的源碼:
[php] view plain copy
//使用file_get_contents()
$data=file_get_contents("http://www.youku.com");
var_dump($data);
[php] view plain copy
/**
* 發(fā)一個GET請求獲取數(shù)據(jù)
*/
function get($url)
{
global $curl;
// 配置curl中的http協(xié)議->可配置的薦可以查PHP手冊中的curl_
curl_setopt($curl, CURLOPT_URL, $url);
curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE);
curl_setopt($curl, CURLOPT_HEADER, FALSE);
// 執(zhí)行這個請求
return curl_exec($curl);
}
// 生成一個curl對象
$curl = curl_init();
$url='http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html';
$data=get($url);
// 匹配電影所在位置
$list_preg = '/<li class="yk-col4 mr1">.+<\/li>/Us';
// 匹配img標簽上的src和alt
$img_preg = '/<img class="quic" _src="(.*)" src="(.*)" alt="(.*)" \/>/U';
//匹配電影的url
$video_preg='/<a href="(.*)" title="(.*)" target="(.*)"><\/a>/U';
//把所有的li存到$list里,$list是個二維數(shù)組
preg_match_all($list_preg,$data,$list);
//var_dump($list);
foreach ($list[0] as $k => $v) { //這里$v就是每一個li標簽
/* 獲取圖片及電影名稱
preg_match($img_preg,$v,$img); //把匹配到的圖片的信息存到$img里
var_dump($img);
*/
/*獲取電影地址
preg_match($video_preg,$v,$video); //把匹配到的電影的信息存到$video里
var_dump($video);
*/
preg_match($img_preg,$v,$img);
preg_match($video_preg,$v,$video);
echo $img[0].'<a href="'.$video[1].'">'.$video[2].'</a>';
}
[php] view plain copy
$imgData = get($img[1]);
// 把圖片文件寫到硬盤上【下載】
// 因為操作系統(tǒng)是GBK的,所以要把UTF8轉(zhuǎn)成GBK
is_dir('./youkuimg/') ? '': mkdir('./youkuimg/');
file_put_contents('./youkuimg/'.mb_convert_encoding($img[3], 'gbk', 'utf-8').'.jpg', $imgData);