php中file_get_contents獲取網頁亂碼解決辦法
來源:程序員人生 發布時間:2013-11-04 14:51:47 閱讀次數:2925次
昨天我在做一個簡單采集功能時我直接使用了file_get_contents函數,但是采集有些網站沒問題,采集有些網籌碼了,后來分析出現亂碼是服務器開啟了gzip壓縮功能,知道原因了我們就好辦了,先百度了一下得出是可以改用curl操作,curl解決代碼如下:
- function curl_get($url, $gzip=false){
- $curl = curl_init($url);
- curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);
- curl_setopt($curl, CURLOPT_CONNECTTIMEOUT, 10);
- if($gzip) curl_setopt($curl, CURLOPT_ENCODING, "gzip");
- $content = curl_exec($curl);
- curl_close($curl);
- return $content;
- }
采用gzip編碼格式,file_get_contents,代碼如下:file_get_contents("compress.zlib://".$url);無論頁面是否經過gzip壓縮,上述代碼都可以正常工作!
注意:CURL是需要打開的哦。
curl安裝,xp下面的安裝:修改php.ini文件的設置,找到:
php_curl.dll//取消下在的注釋extension=php_curl.dll
linux下面安裝,代碼如下:
- # wget http://curl.haxx.se/download/curl-7.17.1.tar.gz
- # tar zxvf curl-7.17.1.tar.gz //解壓
- #cd curl-7.17.1
- # ./configure –prefix=/usr/local/curl
- # make
- # make install
這是安裝php之前安裝的方法.
生活不易,碼農辛苦
如果您覺得本網站對您的學習有所幫助,可以手機掃描二維碼進行捐贈