日本不卡不码高清免费观看,久久国产精品久久w女人spa,黄色aa久久,三上悠亚国产精品一区二区三区

您的位置:首頁技術文章
文章詳情頁

PHP使用三種方法實現數據采集

瀏覽:180日期:2022-09-08 08:39:13
什么叫采集?

就是使用PHP程序,把其他網站中的信息抓取到我們自己的數據庫中、網站中。

PHP制作采集的技術

從底層的socket到高層的文件操作函數,一共有3種方法可以實現采集。

1. 使用socket技術采集:

socket采集是最底層的,它只是建立了一個長連接,然后我們要自己構造http協議字符串去發送請求。

例如要想獲取這個頁面的內容,http://tv.youku.com/?spm=a2hww.20023042.topNav.5~1~3!2~A,用socket寫如下:

<?php//連接,$error錯誤編號,$errstr錯誤的字符串,30s是連接超時時間$fp=fsockopen('www.youku.com',80,$errno,$errstr,30);if(!$fp) die('連接失敗'.$errstr); //構造http協議字符串,因為socket編程是最底層的,它還沒有使用http協議$http='GET /?spm=a2hww.20023042.topNav.5~1~3!2~A HTTP/1.1rn'; // rn表示前面的是一個命令$http.='Host:www.youku.comrn'; //請求的主機$http.='Connection:closernrn'; // 連接關閉,最后一行要兩個rn //發送這個字符串到服務器fwrite($fp,$http,strlen($http));//接收服務器返回的數據$data=’’;while (!feof($fp)) {$data.=fread($fp,4096); //fread讀取返回的數據,一次讀取4096字節}//關閉連接fclose($fp);var_dump($data);?>

打印出的結果如下,包含了返回的頭信息及頁面的源碼:

PHP使用三種方法實現數據采集

2. 使用curl_一套函數

curl把HTTP協議都封裝成了很多函數,直接傳相應參數即可,降低了編寫HTTP協議字符串的難度。

前提:在php.ini中要開啟curl擴展。

//生成一個curl對象$curl=curl_init();//設置URL和相應的選項curl_setopt($curl, CURLOPT_URL, 'http://www.youku.com');curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1); //將curl_exec()獲取的信息以字符串返回,而不是直接輸出。//執行curl操作$data=curl_exec($curl);var_dump($data);

打印出的結果如下,只包含頁面的源碼:

PHP使用三種方法實現數據采集

3. 直接使用file_get_contents(最頂層的)

前提:在php.ini中設置允許打開一個網絡的url地址。

PHP使用三種方法實現數據采集

//使用file_get_contents()$data=file_get_contents('http://www.youku.com');var_dump($data);

PHP使用三種方法實現數據采集

3種方式的選擇

網絡之間通信主要使用的是以上三種。其中后兩種用的較多:如果要批量采集大量的數據時使用第二種【CURL】,性能好、穩定。

偶爾發幾個請求發的頻繁不密集時使用第三種。

擴展:圖片的防盜鏈如何破?

比如7060網站上的圖片做了防盜鏈:在他的網站中可以看到圖片,把圖片拿到站外就無法訪問。

PHP使用三種方法實現數據采集

原理:在HTTP協議中有一個referer項,代表發這個請求的來源地址,服務器會判斷如果這個請求不是這個網站發來的就會過濾掉這個請求:

PHP使用三種方法實現數據采集

解決辦法:發HTTP時自己模擬referer即可:

PHP使用三種方法實現數據采集

擴展:有些要采集數據時時必須先登錄,可以使用模擬的試模擬在登錄狀態下的采集:

a. 先用瀏覽登錄一下,登錄完,瀏覽器的COOKIE中就會有SESSIONID

b. 發PHP發HTTP協議時,把瀏覽器中的SESSIONID放到PHP的HTTP協議請求里,這樣就在以登錄的狀態發請求。

總結:所有客戶端發過來的數據都可以被模擬,所以服務器上的程序必須要必要的地方過濾客戶端的數據。

什么時候用以上東西?接口開發時、采集時。

數據采集

例如我要采集這個url里的所有美國電影的信息,

http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html

則先要知道電影所在的節點的結構,我們使用firebug查看。

PHP使用三種方法實現數據采集

然后開始寫代碼:完整代碼如下

/** * 發一個GET請求獲取數據 */function get($url){ global $curl; // 配置curl中的http協議->可配置的薦可以查PHP手冊中的curl_ curl_setopt($curl, CURLOPT_URL, $url); curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE); curl_setopt($curl, CURLOPT_HEADER, FALSE); // 執行這個請求 return curl_exec($curl);} // 生成一個curl對象$curl = curl_init();$url=’http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html’;$data=get($url);// 匹配電影所在位置$list_preg = ’/<li class='yk-col4 mr1'>.+</li>/Us’;// 匹配img標簽上的src和alt$img_preg = ’/<img _src='(.*)' src='http://m.b3g6.com/bcjs/(.*)' alt='(.*)' />/U’;//匹配電影的url$video_preg=’/<a href='http://m.b3g6.com/bcjs/(.*)' rel='external nofollow' target='(.*)'></a>/U’;//把所有的li存到$list里,$list是個二維數組preg_match_all($list_preg,$data,$list); //var_dump($list);foreach ($list[0] as $k => $v) { //這里$v就是每一個li標簽/* 獲取圖片及電影名稱 preg_match($img_preg,$v,$img); //把匹配到的圖片的信息存到$img里 var_dump($img); */ /*獲取電影地址 preg_match($video_preg,$v,$video); //把匹配到的電影的信息存到$video里 var_dump($video);*/ preg_match($img_preg,$v,$img); preg_match($video_preg,$v,$video); echo $img[0].’<a href='http://m.b3g6.com/bcjs/’.$video[1].’' rel='external nofollow' >’.$video[2].’</a>’;}

測試:

打印$list;

PHP使用三種方法實現數據采集

打印$img

PHP使用三種方法實現數據采集

打印$video

PHP使用三種方法實現數據采集

最終效果:

PHP使用三種方法實現數據采集

如果需要把圖片拷貝到硬盤上,則在foreach循環里加上以下代碼:

$imgData = get($img[1]); // 把圖片文件寫到硬盤上【下載】 // 因為操作系統是GBK的,所以要把UTF8轉成GBK is_dir(’./youkuimg/’) ? ’’: mkdir(’./youkuimg/’);file_put_contents(’./youkuimg/’.mb_convert_encoding($img[3], ’gbk’, ’utf-8’).’.jpg’, $imgData);

PHP使用三種方法實現數據采集

效果如下:在當前目錄下的youkuimg目錄下就會有下載好的圖片。

PHP使用三種方法實現數據采集

以上就是PHP使用三種方法實現數據采集的詳細內容,更多關于PHP使數據采集的資料請關注好吧啦網其它相關文章!

標簽: PHP
相關文章:
日本不卡不码高清免费观看,久久国产精品久久w女人spa,黄色aa久久,三上悠亚国产精品一区二区三区
国产精品探花在线观看| 精品72久久久久中文字幕| 亚洲一级特黄| 欧美一区二区三区激情视频| 尤物tv在线精品| 国产精品视频3p| 麻豆视频久久| 国产精品毛片久久| 日韩一区二区三区在线免费观看| 毛片在线网站| 欧美日中文字幕| 神马日本精品| 好吊日精品视频| 在线国产精品一区| 69堂免费精品视频在线播放| 久久国产婷婷国产香蕉| 国产精品丝袜在线播放| 日韩av专区| 亚洲手机在线| 在线观看视频免费一区二区三区| 亚洲欧洲日韩| 国产精品一卡| 日本激情一区| 欧美日韩视频| 欧美日韩亚洲一区三区| 麻豆一区二区99久久久久| 四季av一区二区凹凸精品| 精精国产xxxx视频在线野外| av成人国产| 青青在线精品| 伊人网在线播放| 欧美另类综合| 18国产精品| 岛国av在线网站| av不卡在线| 国产精品porn| 欧美va天堂| 日韩超碰人人爽人人做人人添| 国产精品白浆| 欧美+亚洲+精品+三区| 亚州av一区| 久久99蜜桃| 久久久久中文| 欧美欧美黄在线二区| 中文在线а√在线8| 在线亚洲精品| 国产精品久一| 在线日韩一区| 国产日本精品| 日韩啪啪电影网| 亚洲人妖在线| 亚洲欧洲美洲av| 亚洲资源网站| 国产一区二区三区国产精品| 亚洲少妇诱惑| 国产专区精品| 美女毛片一区二区三区四区| 国产日产精品_国产精品毛片| 亚洲成人国产| 免费亚洲婷婷| 综合视频一区| 99热精品久久| 欧美视频久久| 精品中文字幕一区二区三区av| 日韩国产欧美视频| 久久久久99| 国产经典一区| 亚洲视频电影在线| 91看片一区| 欧美中文一区| 亚洲专区在线| 成午夜精品一区二区三区软件| 一二三区精品| 蜜桃国内精品久久久久软件9| 欧美激情网址| 日韩二区在线观看| 日韩一级不卡| 中文一区一区三区高中清不卡免费| 日韩精品五月天| 激情久久婷婷| 日本欧美国产| 麻豆久久久久久| 综合国产视频| 亚洲精品91| 一本大道色婷婷在线| 国产精品15p| 一区二区亚洲视频| 日韩午夜一区| 欧美一区二区三区激情视频| 狠狠久久伊人| 国产精品一区二区精品| 日产欧产美韩系列久久99| 日韩午夜av在线| 久久精品国产99久久| 精品成av人一区二区三区| 欧美日韩18| 亚洲aa在线| 99成人在线| 蜜桃成人av| 欧美福利一区| 偷拍欧美精品| 久久久精品日韩| 日韩高清中文字幕一区二区| www.九色在线| 给我免费播放日韩视频| 国产精品99久久久久久董美香| 日韩精品中文字幕吗一区二区| 亚洲综合不卡| 免费日韩av| 久久亚洲国产精品一区二区| 久久久久久久久久久妇女| 综合日韩av| 国产资源在线观看入口av| 成人污污视频| 日韩精品91| 性欧美videohd高精| 国产精品蜜芽在线观看| 国语精品一区| 日韩国产一区二区| 99精品综合| 亚洲国产一区二区三区在线播放| 久久伦理在线| 99视频一区| 综合激情网...| 欧美一区二区三区免费看| 国产欧美高清视频在线| 国产精品蜜月aⅴ在线| 美女国产一区二区三区| 精品黄色一级片| 高潮久久久久久久久久久久久久| 精品国产三区在线| 高清一区二区三区| 美女一区网站| 欧美一区二区性| 水蜜桃久久夜色精品一区的特点| 巨乳诱惑日韩免费av| 亚洲日产国产精品| 国产精品视频一区视频二区| 精品国产亚洲一区二区在线观看| 日韩av专区| 精品在线99| 亚洲资源网站| 国产欧美一区| 日韩大片在线| 亚洲视频www| 亚洲综合日韩| 日韩二区在线观看| 精品欠久久久中文字幕加勒比| 日本欧美不卡| 日韩在线a电影| 国产丝袜一区| 久久久久久夜| av不卡在线看| 国产欧美日韩精品一区二区免费 | 精品三级久久久| av免费不卡国产观看| 九一精品国产| 亚洲欧美网站在线观看| 国产精品自在| 亚洲永久av| 美女国产一区| 麻豆精品国产91久久久久久| 久久久久蜜桃| 日韩精品免费一区二区夜夜嗨| 久久精品国产在热久久| 亚洲一级二级| 欧美精品三级在线| 精品捆绑调教一区二区三区| 亚洲一级淫片| 麻豆视频一区二区| 婷婷综合在线| 国产精品**亚洲精品| 亚洲天堂久久| 欧美日一区二区在线观看| 亚洲成人不卡| 日韩精品午夜视频| 日韩美女一区二区三区在线观看| 视频一区二区三区入口| 麻豆国产精品777777在线| 九一国产精品| 久久爱www成人| 国产视频一区三区| 美女在线视频一区| 欧美专区一区二区三区| 国产美女亚洲精品7777| 亚洲二区精品| 国产精选久久| av不卡在线| 日韩1区2区| 日韩高清在线一区| 久久国产主播| 国产精品一线| 一本一本久久| 中文字幕人成乱码在线观看 | av免费不卡国产观看| 日韩高清电影一区| 日韩av福利| 国产精品一区二区精品 | 国产免费播放一区二区| 日韩视频中文|