当前位置:首页 > PHP教程 > php函数 > 列表

php中file_get_contents获取网页乱码解决办法

发布:smiling 来源: PHP粉丝网  添加日期:2013-12-05 22:09:25 浏览: 评论:0 

昨天我在做一个简单采集功能时我直接使用了file_get_contents函数,但是采集有些网站没问题,采集有些网筹码了,后来分析出现乱码是服务器开启了gzip压缩功能,知道原因了我们就好办了,先百度了一下得出是可以改用curl操作,curl解决代码如下:

  1. function curl_get($url$gzip=false){ 
  2.         $curl = curl_init($url); 
  3.         curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1); 
  4.         curl_setopt($curl, CURLOPT_CONNECTTIMEOUT, 10); 
  5.         if($gzip) curl_setopt($curl, CURLOPT_ENCODING, "gzip"); // 关键在这里 
  6.         $content = curl_exec($curl); 
  7.         curl_close($curl); 
  8.         return $content

采用gzip编码格式,file_get_contents,代码如下:file_get_contents("compress.zlib://".$url);无论页面是否经过gzip压缩,上述代码都可以正常工作!

注意:CURL是需要打开的哦。

curl安装,xp下面的安装:修改php.ini文件的设置,找到:

php_curl.dll//取消下在的注释extension=php_curl.dll

linux下面安装,代码如下:

  1. # wget http://curl.haxx.se/download/curl-7.17.1.tar.gz 
  2. # tar zxvf curl-7.17.1.tar.gz  //解压 
  3. #cd curl-7.17.1 
  4. # ./configure –prefix=/usr/local/curl 
  5. # make 
  6. # make install 

这是安装php之前安装的方法.

Tags: php中file_get_contents 获取 网页

分享到: