python爬虫添加请求头代码实例-侯体宗的博客

python爬虫添加请求头代码实例
Python / 管理员发布于 8年前 259

这篇文章主要介绍了python爬虫添加请求头代码实例,文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下

request

import requestsheaders = {  # 'Accept': 'application/json, text/javascript, */*; q=0.01',  # 'Accept': '*/*',  # 'Accept-Language': 'zh-CN,zh;q=0.9,en;q=0.8,en-US;q=0.7',  # 'Cache-Control': 'no-cache',  # 'accept-encoding': 'gzip, deflate, br',  'User-Agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/78.0.3904.97 Safari/537.36',  'Referer': 'https://www.google.com/'}resp = requests.get('http://httpbin.org/get', headers=headers)print(resp.content)

urllib

import urllib, urllib2def get_page_source(url):  headers = {'Accept': '*/*',        'Accept-Language': 'en-US,en;q=0.8',        'Cache-Control': 'max-age=0',        'User-Agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/48.0.2564.116 Safari/537.36',        'Connection': 'keep-alive',        'Referer': 'http://www.baidu.com/'        }  req = urllib2.Request(url, None, headers)  response = urllib2.urlopen(req)  page_source = response.read()  return page_source

phantomjs请求页面

from selenium import webdriverfrom selenium.webdriver.common.desired_capabilities import DesiredCapabilitiesdef get_headers_driver():  desire = DesiredCapabilities.PHANTOMJS.copy()  headers = {'Accept': '*/*',        'Accept-Language': 'en-US,en;q=0.8',        'Cache-Control': 'max-age=0',        'User-Agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/48.0.2564.116 Safari/537.36',        'Connection': 'keep-alive',        'Referer': 'http://www.baidu.com/'        }  for key, value in headers.iteritems():    desire['phantomjs.page.customHeaders.{}'.format(key)] = value  driver = webdriver.PhantomJS(desired_capabilities=desire, service_args=['--load-images=yes'])#将yes改成no可以让浏览器不加载图片  return driver

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

上一条：
python爬虫模拟浏览器访问-User-Agent过程解析
下一条：
python使用rsa非对称加密过程解析

0条评论 (评论内容有缓存机制,请悉知!)

最新最热

近期评论
test1 在
opencode + Oh-my-openagent,我的第一个免费的ai编程智能体管家:Sisyphus中评论 test..
122 在
学历：一种延缓就业设计，生活需求下的权衡之选中评论工作几年后，报名考研了，到现在还没认真学习备考，迷茫中。作为一名北漂互联网打工人..
Zita 在
Google AI Studio升级全栈 vibe coding体验，可直接构建带登录和数据库的应用中评论 111222..
123 在
Clash for Windows作者删库跑路了，github已404中评论按理说只要你在国内，所有的流量进出都在监控范围内，不管你怎么隐藏也没用，想搞你分..
原梓番博客在
在Laravel框架中使用模型Model分表最简单的方法中评论好久好久都没看友情链接申请了，今天刚看，已经添加。..

Top