您当前的位置: 首页 > 网站编程 > PHP教程 > 解析file_get_contents模仿浏览器头(user_agent)获取数据

解析file_get_contents模仿浏览器头(user_agent)获取数据

作者:不详 来源:网络 发布时间: 2014-08-19 14:20 点击:
什么是user agent User Agent中文名为用户代理,简称 UA,它是一个特殊字符串头,使得服务器能够识别客户使用的操作系统及版本、CPU 类型、浏览器及版本、浏览器渲染引擎、浏览器语言、浏览器插件等。 网站可以通过判断不同UA来呈现不同的网站,例如手机访问和PC访问显

解析file_get_contents模仿浏览器头(user_agent)获取数据

  什么是user agent

  
User Agent中文名为用户代理,简称 UA,它是一个特殊字符串头,使得服务器能够识别客户使用的操作系统及版本、CPU 类型、浏览器及版本、浏览器渲染引擎、浏览器语言、浏览器插件等。

  网站可以通过判断不同UA来呈现不同的网站,例如手机访问和PC访问显示不同的页面。

  PHP在用file_get_contents函数采集网站时,有时会明明用浏览器可以看,但就是采不到任何内容。

  这很有可能是服务器上做了设置,根据 User_agent判断是否为正常的浏览器请求,因为默认PHP的file_get_contents函数是不发送ua的。

  如果要采集这样的网站,我们就必须要让PHP模拟浏览器发送UA,欺骗网站返回正常内容。

  实现如下:

  
ini_set('user_agent','Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0; 4399Box.560; .NET4.0C; .NET4.0E)');

  这是模拟IE8环境下的UA,当然你也可以换成其他的。比如中火狐

  也可以这样读取:

  复制代码 代码如下:

  $opts = array(

  'http'=>array(

  'method'=>"GET",

  'header'=>"Host: zh.wikipedia.orgrn" .

  "Accept-language: zh-cnrn" .

  "User-Agent: Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0; 4399Box.560; .NET4.0C; .NET4.0E)" .

  "Accept: *//*"

  )

  );
分享到:
本文"解析file_get_contents模仿浏览器头(user_agent)获取数据"由远航站长收集整理而来,仅供大家学习与参考使用。更多网站制作教程尽在远航站长站。
顶一下
(0)
0%
踩一下
(0)
0%
[点击 次] [返回上一页] [打印]
发表评论
请自觉遵守互联网相关的政策法规,严禁发布色情、暴力、反动的言论。
评价:
表情:
用户名: 密码: 验证码:
关于本站 - 联系我们 - 网站声明 - 友情连接- 网站地图 - 站点地图 - 返回顶部
Copyright © 2007-2013 www.yhzhan.com(远航站长). All Rights Reserved .
远航站长:为中小站长提供最佳的学习与交流平台,提供网页制作与网站编程等各类网站制作教程.
官方QQ:445490277 网站群:26680406 网站备案号:豫ICP备07500620号-4