婷婷综合国产,91蜜桃婷婷狠狠久久综合9色 ,九九九九九精品,国产综合av

主頁 > 知識(shí)庫 > PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集

PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集

熱門標(biāo)簽:安裝電銷外呼系統(tǒng) 新河科技智能外呼系統(tǒng)怎么樣 福州人工外呼系統(tǒng)哪家強(qiáng) 百度商鋪地圖標(biāo)注 釘釘打卡地圖標(biāo)注 衡水外呼系統(tǒng)平臺(tái) 注冊400電話申請 常州地圖標(biāo)注服務(wù)商 地圖標(biāo)注平臺(tái)怎么給錢注冊

什么叫采集?

就是使用PHP程序,把其他網(wǎng)站中的信息抓取到我們自己的數(shù)據(jù)庫中、網(wǎng)站中。

PHP制作采集的技術(shù)

從底層的socket到高層的文件操作函數(shù),一共有3種方法可以實(shí)現(xiàn)采集。

1. 使用socket技術(shù)采集:

socket采集是最底層的,它只是建立了一個(gè)長連接,然后我們要自己構(gòu)造http協(xié)議字符串去發(fā)送請求。

例如要想獲取這個(gè)頁面的內(nèi)容,http://tv.youku.com/?spm=a2hww.20023042.topNav.5~1~3!2~A,用socket寫如下:

?php
//連接,$error錯(cuò)誤編號,$errstr錯(cuò)誤的字符串,30s是連接超時(shí)時(shí)間
$fp=fsockopen("www.youku.com",80,$errno,$errstr,30);
if(!$fp) die("連接失敗".$errstr);
 
//構(gòu)造http協(xié)議字符串,因?yàn)閟ocket編程是最底層的,它還沒有使用http協(xié)議
$http="GET /?spm=a2hww.20023042.topNav.5~1~3!2~A HTTP/1.1\r\n";   //  \r\n表示前面的是一個(gè)命令
$http.="Host:www.youku.com\r\n";  //請求的主機(jī)
$http.="Connection:close\r\n\r\n";   // 連接關(guān)閉,最后一行要兩個(gè)\r\n
 
//發(fā)送這個(gè)字符串到服務(wù)器
fwrite($fp,$http,strlen($http));
//接收服務(wù)器返回的數(shù)據(jù)
$data='';
while (!feof($fp)) {
$data.=fread($fp,4096);  //fread讀取返回的數(shù)據(jù),一次讀取4096字節(jié)
}
//關(guān)閉連接
fclose($fp);
var_dump($data);
?>

打印出的結(jié)果如下,包含了返回的頭信息及頁面的源碼:

2. 使用curl_一套函數(shù)

curl把HTTP協(xié)議都封裝成了很多函數(shù),直接傳相應(yīng)參數(shù)即可,降低了編寫HTTP協(xié)議字符串的難度。

前提:在php.ini中要開啟curl擴(kuò)展。

//生成一個(gè)curl對象
$curl=curl_init();
//設(shè)置URL和相應(yīng)的選項(xiàng)
curl_setopt($curl, CURLOPT_URL, "http://www.youku.com");
curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);  //將curl_exec()獲取的信息以字符串返回,而不是直接輸出。
//執(zhí)行curl操作
$data=curl_exec($curl);
var_dump($data);

打印出的結(jié)果如下,只包含頁面的源碼:

3. 直接使用file_get_contents(最頂層的)

前提:在php.ini中設(shè)置允許打開一個(gè)網(wǎng)絡(luò)的url地址。

//使用file_get_contents()
$data=file_get_contents("http://www.youku.com");
var_dump($data);

3種方式的選擇

網(wǎng)絡(luò)之間通信主要使用的是以上三種。其中后兩種用的較多:如果要批量采集大量的數(shù)據(jù)時(shí)使用第二種【CURL】,性能好、穩(wěn)定。

偶爾發(fā)幾個(gè)請求發(fā)的頻繁不密集時(shí)使用第三種。

擴(kuò)展:圖片的防盜鏈如何破?

比如7060網(wǎng)站上的圖片做了防盜鏈:在他的網(wǎng)站中可以看到圖片,把圖片拿到站外就無法訪問。

原理:在HTTP協(xié)議中有一個(gè)referer項(xiàng),代表發(fā)這個(gè)請求的來源地址,服務(wù)器會(huì)判斷如果這個(gè)請求不是這個(gè)網(wǎng)站發(fā)來的就會(huì)過濾掉這個(gè)請求:

解決辦法:發(fā)HTTP時(shí)自己模擬referer即可:

擴(kuò)展:有些要采集數(shù)據(jù)時(shí)時(shí)必須先登錄,可以使用模擬的試模擬在登錄狀態(tài)下的采集:

a. 先用瀏覽登錄一下,登錄完,瀏覽器的COOKIE中就會(huì)有SESSIONID

b. 發(fā)PHP發(fā)HTTP協(xié)議時(shí),把瀏覽器中的SESSIONID放到PHP的HTTP協(xié)議請求里,這樣就在以登錄的狀態(tài)發(fā)請求。

總結(jié):所有客戶端發(fā)過來的數(shù)據(jù)都可以被模擬,所以服務(wù)器上的程序必須要必要的地方過濾客戶端的數(shù)據(jù)。

什么時(shí)候用以上東西?接口開發(fā)時(shí)、采集時(shí)。

數(shù)據(jù)采集

例如我要采集這個(gè)url里的所有美國電影的信息,

http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html

則先要知道電影所在的節(jié)點(diǎn)的結(jié)構(gòu),我們使用firebug查看。

然后開始寫代碼:完整代碼如下

/**
 * 發(fā)一個(gè)GET請求獲取數(shù)據(jù)
 */
function get($url)
{
   global $curl;
   // 配置curl中的http協(xié)議->可配置的薦可以查PHP手冊中的curl_
   curl_setopt($curl, CURLOPT_URL, $url);
   curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE);
   curl_setopt($curl, CURLOPT_HEADER, FALSE);
   // 執(zhí)行這個(gè)請求
   return curl_exec($curl);
}
 
// 生成一個(gè)curl對象
$curl = curl_init();
$url='http://list.youku.com/category/show/c_96_a_%E7%BE%8E%E5%9B%BD_s_1_d_1_p_3.html';
$data=get($url);
// 匹配電影所在位置
$list_preg = '/li class="yk-col4 mr1">.+\/li>/Us';
// 匹配img標(biāo)簽上的src和alt
$img_preg = '/img class="quic" _src="(.*)" src="(.*)" alt="(.*)" \/>/U';
//匹配電影的url
$video_preg='/a href="(.*)" rel="external nofollow"  title="(.*)" target="(.*)">\/a>/U';
//把所有的li存到$list里,$list是個(gè)二維數(shù)組
preg_match_all($list_preg,$data,$list);
   //var_dump($list);
foreach ($list[0] as $k => $v) {   //這里$v就是每一個(gè)li標(biāo)簽
/* 獲取圖片及電影名稱
    preg_match($img_preg,$v,$img);  //把匹配到的圖片的信息存到$img里
    var_dump($img);
    */
    /*獲取電影地址
    preg_match($video_preg,$v,$video);  //把匹配到的電影的信息存到$video里
    var_dump($video);
*/
    preg_match($img_preg,$v,$img);
    preg_match($video_preg,$v,$video);
    echo $img[0].'a href="'.$video[1].'" rel="external nofollow" >'.$video[2].'/a>';
}

測試:

打印$list;

打印$img

打印$video

最終效果:

如果需要把圖片拷貝到硬盤上,則在foreach循環(huán)里加上以下代碼:

 $imgData = get($img[1]);
    // 把圖片文件寫到硬盤上【下載】
    // 因?yàn)椴僮飨到y(tǒng)是GBK的,所以要把UTF8轉(zhuǎn)成GBK
    is_dir('./youkuimg/') ? '': mkdir('./youkuimg/');
	file_put_contents('./youkuimg/'.mb_convert_encoding($img[3], 'gbk', 'utf-8').'.jpg', $imgData);

效果如下:在當(dāng)前目錄下的youkuimg目錄下就會(huì)有下載好的圖片。

以上就是PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集的詳細(xì)內(nèi)容,更多關(guān)于PHP使數(shù)據(jù)采集的資料請關(guān)注腳本之家其它相關(guān)文章!

您可能感興趣的文章:
  • 深入php數(shù)據(jù)采集的詳解
  • php7中停止php-fpm服務(wù)的方法詳解
  • PHP 對接美團(tuán)大眾點(diǎn)評團(tuán)購券(門票)的開發(fā)步驟
  • PHP小程序后臺(tái)部署運(yùn)行 LNMP+WNMP的方法
  • 為PHP模塊添加SQL SERVER2012數(shù)據(jù)庫的步驟詳解
  • php微信小程序解包過程實(shí)例詳解
  • 利用ajax+php實(shí)現(xiàn)商品價(jià)格計(jì)算
  • PHP對接阿里云虛擬號的實(shí)現(xiàn)(號碼隱私保護(hù))
  • thinkphp5redis緩存新增方法實(shí)例講解
  • PHP引擎php.ini參數(shù)優(yōu)化深入講解
  • php優(yōu)化查詢foreach代碼實(shí)例講解
  • PHP使用Redis隊(duì)列執(zhí)行定時(shí)任務(wù)實(shí)例講解
  • PHP如何限制定時(shí)任務(wù)的進(jìn)程數(shù)量

標(biāo)簽:鷹潭 唐山 六安 白城 克拉瑪依 遼陽 鶴崗 柳州

巨人網(wǎng)絡(luò)通訊聲明:本文標(biāo)題《PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集》,本文關(guān)鍵詞  PHP,使用,三種,方法,實(shí)現(xiàn),;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問題,煩請?zhí)峁┫嚓P(guān)信息告之我們,我們將及時(shí)溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò),涉及言論、版權(quán)與本站無關(guān)。
  • 相關(guān)文章
  • 下面列出與本文章《PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集》相關(guān)的同類信息!
  • 本頁收集關(guān)于PHP使用三種方法實(shí)現(xiàn)數(shù)據(jù)采集的相關(guān)信息資訊供網(wǎng)民參考!
  • 推薦文章
    婷婷综合国产,91蜜桃婷婷狠狠久久综合9色 ,九九九九九精品,国产综合av
    国产精品国产三级国产aⅴ中文| 成人av午夜电影| 4438x成人网最大色成网站| 亚洲主播在线播放| 欧美美女激情18p| 日本欧美在线观看| 久久一二三国产| 97超碰欧美中文字幕| 亚洲自拍都市欧美小说| 日韩亚洲欧美综合| 国产99精品视频| 亚洲激情在线激情| 日韩欧美电影在线| 成人97人人超碰人人99| 亚洲亚洲精品在线观看| 日韩精品一区二区三区中文精品| 国产美女精品人人做人人爽 | 精品污污网站免费看| 免费成人av在线| 国产精品美女久久久久久 | 欧美精品在线视频| 精品一区二区综合| 亚洲精品国产精华液| 精品免费视频.| 91在线视频在线| 老色鬼精品视频在线观看播放| 亚洲成人三级小说| 精品国产乱码久久久久久牛牛| 97精品国产露脸对白| 日本不卡视频在线| 亚洲人成网站在线| 久久嫩草精品久久久精品| 欧美吞精做爰啪啪高潮| 国产99一区视频免费| 日韩精品欧美精品| 亚洲人成网站色在线观看| 日韩女优av电影| 欧美三级中文字| 99re热视频这里只精品| 激情久久五月天| 视频一区视频二区中文| 亚洲男女毛片无遮挡| 久久久99免费| 日韩精品一区二区三区蜜臀| 在线观看国产一区二区| 成人国产在线观看| 国产一区二区福利视频| 日韩在线观看一区二区| 亚洲精品国产无天堂网2021 | 国产精品久久久久精k8| 日韩欧美国产麻豆| 欧美日韩国产高清一区二区三区 | 久久国产精品一区二区| 亚洲福中文字幕伊人影院| 国产精品毛片大码女人| 欧美成人精品1314www| 欧美久久一区二区| 欧美性视频一区二区三区| 99久久婷婷国产精品综合| 国产乱子伦视频一区二区三区 | 欧洲一区二区三区在线| 91亚洲永久精品| 成人动漫一区二区在线| 国产激情一区二区三区四区 | 亚洲视频香蕉人妖| 中文字幕永久在线不卡| 日本一区二区免费在线| 国产午夜精品一区二区| 久久精品视频一区二区| 久久色中文字幕| 久久老女人爱爱| 久久亚洲捆绑美女| 国产欧美日韩亚州综合| 亚洲国产精品激情在线观看| 久久久国产一区二区三区四区小说 | 中文字幕日韩一区| 最新日韩在线视频| 依依成人综合视频| 偷拍亚洲欧洲综合| 美女在线观看视频一区二区| 久久国产精品色婷婷| 精品亚洲国内自在自线福利| 久久爱www久久做| 国产很黄免费观看久久| 成人app下载| 欧洲av在线精品| 欧美一区二区视频在线观看| 欧美电视剧在线看免费| 精品久久久久久最新网址| 久久精品免费在线观看| 国产精品久久网站| 亚洲精品va在线观看| 偷拍日韩校园综合在线| 激情综合网天天干| 成人爽a毛片一区二区免费| 色婷婷久久久久swag精品| 欧美精选一区二区| 久久精品亚洲精品国产欧美kt∨| 国产精品久久久久久久午夜片| 一区二区三区四区精品在线视频| 日韩精品亚洲专区| 成人精品国产福利| 欧美日韩成人综合在线一区二区| 欧美一区二区黄色| 国产精品系列在线| 午夜视黄欧洲亚洲| 国产成人亚洲精品青草天美| 91美女片黄在线观看91美女| 日韩一级免费一区| 亚洲视频综合在线| 精品一区二区三区免费观看| 91偷拍与自偷拍精品| 日韩欧美国产一区在线观看| 椎名由奈av一区二区三区| 石原莉奈一区二区三区在线观看| 国产91精品露脸国语对白| 欧美三级资源在线| 国产欧美日韩视频一区二区| 亚洲国产精品一区二区www在线| 国产精品一区一区| 欧美电影一区二区三区| 国产欧美精品区一区二区三区 | jvid福利写真一区二区三区| 91精品国产综合久久久久久久| 国产精品久久久久久久第一福利 | 色综合婷婷久久| 欧美成人性战久久| 亚洲一区二区成人在线观看| 懂色一区二区三区免费观看| 欧美一级高清片| 一区二区视频在线| 成人精品免费网站| 欧美精品一区视频| 香蕉成人啪国产精品视频综合网| www..com久久爱| www久久精品| 蜜桃视频一区二区| 欧美日韩高清影院| 一区二区三区四区精品在线视频| 国产aⅴ综合色| 精品国精品国产尤物美女| 日韩成人伦理电影在线观看| 欧美午夜精品一区二区三区| 18成人在线视频| 成人黄色大片在线观看| 亚洲国产精品精华液ab| 韩国女主播成人在线| 日韩精品在线看片z| 奇米影视一区二区三区小说| 精品视频在线免费| 亚洲一区二区美女| 欧美色图一区二区三区| 亚洲欧美成aⅴ人在线观看| 99re6这里只有精品视频在线观看 99re8在线精品视频免费播放 | 91丨porny丨户外露出| 欧美激情中文字幕一区二区| 国产在线麻豆精品观看| 精品久久久久香蕉网| 狠狠色丁香婷婷综合| 欧美r级电影在线观看| 久久精品久久综合| xf在线a精品一区二区视频网站| 久久99精品国产麻豆婷婷洗澡| 91精品国产91综合久久蜜臀| 日本欧美肥老太交大片| 欧美一区二区三区成人| 久久精品噜噜噜成人88aⅴ| 2023国产精品视频| 粉嫩13p一区二区三区| 成人欧美一区二区三区白人| 99精品视频免费在线观看| 亚洲欧洲成人av每日更新| 一本色道久久综合亚洲91 | 久久久久一区二区三区四区| 国产成人亚洲精品青草天美| 国产精品福利影院| 色偷偷一区二区三区| 亚洲成av人片在线观看无码| 91麻豆精品久久久久蜜臀| 久久精品国产亚洲高清剧情介绍| www国产精品av| 成人av电影免费观看| 亚洲欧美一区二区三区久本道91| 欧美网站一区二区| 国模无码大尺度一区二区三区| 欧美国产综合色视频| 色综合天天做天天爱| 日韩高清不卡一区| 国产亚洲精品bt天堂精选| 91女厕偷拍女厕偷拍高清| 水蜜桃久久夜色精品一区的特点| 欧美mv和日韩mv的网站| 99久久国产综合精品色伊| 无吗不卡中文字幕| 亚洲国产精品精华液ab| 欧美三级视频在线观看| 国产一区二区伦理| 一级女性全黄久久生活片免费| 日韩欧美国产电影| 色诱视频网站一区|