国产精品高潮呻吟视频_国产精品久久综合av爱欲tv_亚洲free性xxxx护士hd_亚洲最新av在线网站

PHP數(shù)據(jù)采集常用的方法 做網(wǎng)站很多時候需要用到數(shù)據(jù)采集入庫操作

更新時間:2022-04-25 編輯:創(chuàng)始人 關(guān)注人次:0 云搜索


是使用PHP程序,把其他網(wǎng)站中的信息抓取到我們自己的數(shù)據(jù)庫中、網(wǎng)站中。

 

PHP制作采集的技術(shù):

從底層的socket到高層的文件操作函數(shù),一共有3種方法可以實現(xiàn)采集。

1. 使用socket技術(shù)采集:

socket采集是最底層的,它只是建立了一個長連接,然后我們要自己構(gòu)造http協(xié)議字符串去發(fā)送請求。

例如要想獲取這個頁面的內(nèi)容,http://tv.youku.com/?spm=a2hww.20023042.topNav.5~1~3!2~A,用socket寫如下:

<?php  
//連接,$error錯誤編號,$errstr錯誤的字符串,30s是連接超時時間  
$fp=fsockopen("www.youku.com",80,$errno,$errstr,30);  
if(!$fp) die("連接失敗".$errstr);  
   
//構(gòu)造http協(xié)議字符串,因為socket編程是最底層的,它還沒有使用http協(xié)議  
$http="GET /?spm=a2hww.20023042.topNav.5~1~3!2~A HTTP/1.1\r\n";   //  \r\n表示前面的是一個命令  
$http.="Host:www.youku.com\r\n";  //請求的主機  
$http.="Connection:close\r\n\r\n";   // 連接關(guān)閉,最后一行要兩個\r\n  
   
//發(fā)送這個字符串到服務(wù)器  
fwrite($fp,$http,strlen($http));  
//接收服務(wù)器返回的數(shù)據(jù)  
$data='';  
while (!feof($fp)) {  
$data.=fread($fp,4096);  //fread讀取返回的數(shù)據(jù),一次讀取4096字節(jié)  
}  
//關(guān)閉連接  
fclose($fp);  
var_dump($data);  
?>

打印出的結(jié)果如下,包含了返回的頭信息及頁面的源碼:



2. 使用curl_一套函數(shù)

curl把HTTP協(xié)議都封裝成了很多函數(shù),直接傳相應(yīng)參數(shù)即可,降低了編寫HTTP協(xié)議字符串的難度。

前提:在php.ini中要開啟curl擴展。

2. 使用curl_一套函數(shù)

curl把HTTP協(xié)議都封裝成了很多函數(shù),直接傳相應(yīng)參數(shù)即可,降低了編寫HTTP協(xié)議字符串的難度。

前提:在php.ini中要開啟curl擴展。

[php]  view plain  copy

  1. //生成一個curl對象  

  2. $curl=curl_init();  

  3. //設(shè)置URL和相應(yīng)的選項  

  4. curl_setopt($curl, CURLOPT_URL, "http://www.youku.com");  

  5. curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);  //將curl_exec()獲取的信息以字符串返回,而不是直接輸出。  

  6. //執(zhí)行curl操作  

  7. $data=curl_exec($curl);  

  8. var_dump($data);  

打印出的結(jié)果如下,只包含頁面的源碼:

3. 直接使用file_get_contents(最頂層的)

前提:在php.ini中設(shè)置允許打開一個網(wǎng)絡(luò)的url地址。


[php]  view plain  copy

  1. //使用file_get_contents()  

  2. $data=file_get_contents("http://www.youku.com");  

  3. var_dump($data);  



3種方式的選擇

網(wǎng)絡(luò)之間通信主要使用的是以上三種。其中后兩種用的較多:如果要批量采集大量的數(shù)據(jù)時使用第二種【CURL】,性能好、穩(wěn)定。

偶爾發(fā)幾個請求發(fā)的頻繁不密集時使用第三種。

 

擴展:圖片的防盜鏈如何破?

比如7060網(wǎng)站上的圖片做了防盜鏈:在他的網(wǎng)站中可以看到圖片,把圖片拿到站外就無法訪問。



解決辦法:發(fā)HTTP時自己模擬referer即可:


擴展:有些要采集數(shù)據(jù)時時必須先登錄,可以使用模擬的試模擬在登錄狀態(tài)下的采集:

a. 先用瀏覽登錄一下,登錄完,瀏覽器的COOKIE中就會有SESSIONID

b. 發(fā)PHP發(fā)HTTP協(xié)議時,把瀏覽器中的SESSIONID放到PHP的HTTP協(xié)議請求里,這樣就在以登錄的狀態(tài)發(fā)請求。

總結(jié):所有客戶端發(fā)過來的數(shù)據(jù)都可以被模擬,所以服務(wù)器上的程序必須要必要的地方過濾客戶端的數(shù)據(jù)。


什么時候用以上東西?接口開發(fā)時、采集時。

二、數(shù)據(jù)采集

例如我要采集這個url里的所有美國電影的信息,

http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html

則先要知道電影所在的節(jié)點的結(jié)構(gòu),我們使用firebug查看。


然后開始寫代碼:完整代碼如下

[php]  view plain  copy

  1. /** 

  2.  * 發(fā)一個GET請求獲取數(shù)據(jù) 

  3.  */  

  4. function get($url)  

  5. {  

  6.    global $curl;  

  7.    // 配置curl中的http協(xié)議->可配置的薦可以查PHP手冊中的curl_  

  8.    curl_setopt($curl, CURLOPT_URL, $url);  

  9.    curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE);  

  10.    curl_setopt($curl, CURLOPT_HEADER, FALSE);  

  11.    // 執(zhí)行這個請求  

  12.    return curl_exec($curl);  

  13. }  

  14.    

  15. // 生成一個curl對象  

  16. $curl = curl_init();  

  17. $url='http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html';  

  18. $data=get($url);  

  19. // 匹配電影所在位置  

  20. $list_preg = '/<li class="yk-col4 mr1">.+<\/li>/Us';  

  21. // 匹配img標(biāo)簽上的src和alt  

  22. $img_preg = '/<img class="quic" _src="(.*)" src="(.*)" alt="(.*)" \/>/U';  

  23. //匹配電影的url  

  24. $video_preg='/<a href="(.*)" title="(.*)" target="(.*)"><\/a>/U';  

  25. //把所有的li存到$list里,$list是個二維數(shù)組  

  26. preg_match_all($list_preg,$data,$list);  

  27.    //var_dump($list);  

  28. foreach ($list[0] as $k => $v) {   //這里$v就是每一個li標(biāo)簽  

  29. /* 獲取圖片及電影名稱 

  30.     preg_match($img_preg,$v,$img);  //把匹配到的圖片的信息存到$img里 

  31.     var_dump($img); 

  32.     */  

  33.     /*獲取電影地址 

  34.     preg_match($video_preg,$v,$video);  //把匹配到的電影的信息存到$video里 

  35.     var_dump($video); 

  36. */  

  37.     preg_match($img_preg,$v,$img);  

  38.     preg_match($video_preg,$v,$video);  

  39.     echo $img[0].'<a href="'.$video[1].'">'.$video[2].'</a>';  

  40. }  


測試:

打印$list;


打印$img


打印$video


最終效果


如果需要把圖片拷貝到硬盤上,則在foreach循環(huán)里加上以下代碼:

[php]  view plain  copy

  1. $imgData = get($img[1]);  

  2.    // 把圖片文件寫到硬盤上【下載】  

  3.    // 因為操作系統(tǒng)是GBK的,所以要把UTF8轉(zhuǎn)成GBK  

  4.    is_dir('./youkuimg/') ? ''mkdir('./youkuimg/');  

  5. file_put_contents('./youkuimg/'.mb_convert_encoding($img[3], 'gbk''utf-8').'.jpg'$imgData);  


效果如下:在當(dāng)前目錄下的youkuimg目錄下就會有下載好的圖片。


本文地址: http://www.fr0ll.cn/show-244.html ,轉(zhuǎn)載請注明出處。

最新動態(tài)

相關(guān)資訊

服務(wù)支持

我們珍惜您每一次在線詢盤,有問必答,用專業(yè)的態(tài)度,貼心的服務(wù)。

讓您真正感受到我們的與眾不同!

国产精品高潮呻吟视频_国产精品久久综合av爱欲tv_亚洲free性xxxx护士hd_亚洲最新av在线网站
国产精品69久久久久水密桃| 国产一区欧美二区| 精品久久99ma| 大白屁股一区二区视频| 亚洲欧美日韩中文播放| 欧美美女激情18p| 韩国v欧美v日本v亚洲v| 国产精品久久久久久久岛一牛影视| 91电影在线观看| 久久精品免费看| 中文字幕中文字幕一区| 欧美日韩免费观看一区二区三区 | 欧美性猛交一区二区三区精品| 日韩vs国产vs欧美| 亚洲国产精品99久久久久久久久 | 色94色欧美sute亚洲13| 另类欧美日韩国产在线| 中文字幕乱码亚洲精品一区 | 日韩欧美一级在线播放| 成人18视频日本| 五月婷婷激情综合网| 久久久久久久久久看片| 在线欧美日韩精品| 日韩成人精品在线| 国产精品初高中害羞小美女文| 欧美日韩视频专区在线播放| 国产黄色精品视频| 亚洲欧美日韩一区| 欧美成人一区二区三区片免费 | 色综合天天在线| 久久er99热精品一区二区| 国产精品国产精品国产专区不蜜| 在线不卡中文字幕| 成a人片亚洲日本久久| 日韩不卡一二三区| 亚洲天堂精品在线观看| 精品精品国产高清a毛片牛牛| 一本色道久久加勒比精品| 久久精品国产精品亚洲红杏| 亚洲精品自拍动漫在线| 26uuuu精品一区二区| 欧美日韩中文字幕一区二区| 国产福利一区二区三区| 日韩激情中文字幕| 亚洲免费观看高清完整| 国产亚洲欧洲997久久综合| 欧美日韩色一区| 暴力调教一区二区三区| 韩国一区二区三区| 亚洲18色成人| 最新国产精品久久精品| 2024国产精品视频| 666欧美在线视频| 色欧美片视频在线观看| 国产成人在线视频网站| 爽爽淫人综合网网站| 亚洲欧美区自拍先锋| 久久精品网站免费观看| 欧美一区二区高清| 91免费版在线看| 粉嫩嫩av羞羞动漫久久久| 老司机精品视频在线| 亚洲成人一区二区在线观看| 国产精品久久久久久久久免费樱桃 | 亚洲视频每日更新| 欧美国产综合一区二区| 精品成人一区二区三区四区| 8x福利精品第一导航| 在线影视一区二区三区| 99久久亚洲一区二区三区青草 | 欧美日免费三级在线| 色综合一区二区| 99久免费精品视频在线观看| 国产成人欧美日韩在线电影| 精品一区精品二区高清| 青青草原综合久久大伊人精品优势| 亚洲综合男人的天堂| 亚洲日本欧美天堂| 国产精品麻豆视频| 国产女人18毛片水真多成人如厕 | 国产欧美一区二区三区在线老狼| 欧美草草影院在线视频| 欧美一二三区精品| 3d动漫精品啪啪一区二区竹菊 | 亚洲欧美激情插| 国产精品久久夜| 国产欧美视频一区二区| 久久嫩草精品久久久久| 91精品国产综合久久久蜜臀图片 | 欧美在线观看视频一区二区三区| 91色九色蝌蚪| 99re视频精品| 99re这里只有精品6| 91亚洲午夜精品久久久久久| av不卡在线观看| 99re6这里只有精品视频在线观看| 成人av片在线观看| www.欧美.com| 91蝌蚪国产九色| 91黄色在线观看| 91黄色免费观看| 欧美三级日本三级少妇99| 欧美在线高清视频| 欧美久久久一区| 欧美一区二区三区思思人| 日韩欧美国产午夜精品| 精品国产青草久久久久福利| 久久这里只有精品6| 国产日韩高清在线| 国产精品国产a级| 亚洲乱码中文字幕| 亚洲国产精品一区二区www在线| 洋洋成人永久网站入口| 亚洲成人av电影在线| 人妖欧美一区二区| 韩国在线一区二区| 成人精品国产一区二区4080| 99re6这里只有精品视频在线观看 99re8在线精品视频免费播放 | 亚洲午夜三级在线| 日韩电影免费在线| 国产一区二区三区最好精华液| 粉嫩一区二区三区在线看| 色一情一伦一子一伦一区| 欧美日韩一二区| 欧美不卡在线视频| 国产精品免费aⅴ片在线观看| 亚洲精品视频自拍| 日韩av电影免费观看高清完整版在线观看 | 3d动漫精品啪啪一区二区竹菊| 精品少妇一区二区| 中文字幕不卡三区| 亚洲小说欧美激情另类| 欧美aaaaaa午夜精品| 国产精品一区一区| 91蜜桃网址入口| 91精品国产手机| 久久日一线二线三线suv| 中文字幕一区二区日韩精品绯色| 亚洲国产三级在线| 精品一区二区三区欧美| jlzzjlzz欧美大全| 欧美日韩国产成人在线91| 欧美zozozo| 综合久久综合久久| 日本麻豆一区二区三区视频| 国产成人综合自拍| 欧美日韩在线三级| 久久久精品欧美丰满| 亚洲综合视频网| 韩国一区二区三区| 色婷婷综合中文久久一本| 日韩视频免费观看高清完整版| 日本一区二区免费在线| 亚洲成人激情社区| 国产福利视频一区二区三区| 色婷婷综合视频在线观看| 欧美成人精品福利| 亚洲视频你懂的| 精品一区二区三区在线播放| 色88888久久久久久影院野外 | 日韩一卡二卡三卡国产欧美| 国产精品电影一区二区| 日本不卡中文字幕| 97精品久久久久中文字幕 | 久久夜色精品国产欧美乱极品| 一区二区高清视频在线观看| 国内精品久久久久影院一蜜桃| 91久久奴性调教| 久久久久一区二区三区四区| 亚洲成人午夜电影| 不卡的av网站| 精品国产一区二区三区av性色| 亚洲免费观看高清| 国产精品资源站在线| 欧美色综合网站| 欧美激情资源网| 日韩黄色一级片| 色噜噜狠狠成人网p站| 精品人伦一区二区色婷婷| 亚洲一区二区中文在线| 岛国精品一区二区| 欧美不卡视频一区| 午夜欧美大尺度福利影院在线看| 成人午夜av影视| 欧美电影免费观看完整版| 亚洲综合免费观看高清完整版在线| 国产精品一区二区不卡| 911精品产国品一二三产区| 亚洲天天做日日做天天谢日日欢| 国产精品一二三四| 日韩一区和二区| 天天色 色综合| 在线免费av一区| 国产精品久久久久久亚洲毛片| 韩日av一区二区| 日韩一级成人av| 午夜伦理一区二区| 色狠狠色噜噜噜综合网| 国产精品久久午夜夜伦鲁鲁| 国产美女精品在线|