查看原文
其他

fake-useragent库:值得花2分钟学习的库

2017-09-15 大邓 Python爱好者社区

作者: 大邓 

微信公众号:大邓带你玩python

文科生的python笔记


前几天意外找到一个简单实用的库- fake-useragent,可以伪装生成headers请求头中的User Agent值。再也不用,重复做复制粘贴这种很Low的工作了。

安装


  1. pip3 install fake-useragent


各浏览器的user-agent值


  1. from fake_useragent import UserAgent

  2. ua = UserAgent()

  3. #ie浏览器的user agent

  4. print(ua.ie)

  1. Mozilla/5.0 (Windows; U; MSIE 9.0; Windows NT 9.0; en-US)

  1. #opera浏览器

  2. print(ua.opera)

  1. Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

  1. #chrome浏览器

  2. print(ua.chrome)

  1. Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2

  1. #firefox浏览器

  2. print(ua.firefox)

  1. Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/20121011 Firefox/16.0.1

  1. #safri浏览器

  2. print(ua.safari)

  1. Mozilla/5.0 (iPad; CPU OS 6_0 like Mac OS X) AppleWebKit/536.26 (KHTML, like Gecko) Version/6.0 Mobile/10A5355d Safari/8536.25


最实用的

但我认为写爬虫最实用的是可以随意变换headers,一定要有随机性。在这里我写了三个随机生成user agent,三次打印都不一样,随机性很强,十分方便。大邓觉得这个库,只会这random方法就可以了。

  1. from fake_useragent import UserAgent

  2. ua = UserAgent()

  3. print(ua.random)

  4. print(ua.random)

  5. print(ua.random)

  1. Mozilla/5.0 (compatible; MSIE 10.0; Macintosh; Intel Mac OS X 10_7_3; Trident/6.0)

  2. Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2

  3. Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11


爬虫中具体使用方法


  1. import requests

  2. from fake_useragent import UserAgent

  3. ua = UserAgent()

  4. headers = {'User-Agent': ua.random}

  5. url = '待爬网页的url'

  6. resp = requests.get(url, headers=headers)

  7. #省略具体爬虫的解析代码,大家可以回去试试

  8. ...


转载自:大邓带你玩python

福利:文末扫码立刻关注公众号,“Python爱好者社区”,开始学习Python课程:

关注后在公众号内回复“课程”即可获取:

1.崔老师爬虫实战案例免费学习视频。

2.丘老师数据科学入门指导免费学习视频。

3.陈老师数据分析报告制作免费学习视频。

4.玩转大数据分析!Spark2.X+Python 精华实战课程免费学习视频。

5.丘老师Python网络爬虫实战免费学习视频。


Python爱好者社区


为大家提供与Python相关的最新技术和资讯。

长按指纹 > 识别图中二维码 > 添加关注

您可能也对以下帖子感兴趣

文章有问题?点此查看未经处理的缓存