Python中的requests框架使用爬虫代理的方案

程序员文章站 2022-05-11 17:24:59

...

#! -- encoding:utf-8 --

    import requests
    import random

    # 要访问的目标页面
    targetUrl = "http://httpbin.org/ip"

    # 要访问的目标HTTPS页面
    # targetUrl = "https://httpbin.org/ip"

    # 代理服务器
    proxyHost = "t.16yun.cn"
    proxyPort = "31111"

    # 代理隧道验证信息
    proxyUser = "username"
    proxyPass = "password"

    proxyMeta = "http://%(user)s:%(pass)[email protected]%(host)s:%(port)s" % {
        "host" : proxyHost,
        "port" : proxyPort,
        "user" : proxyUser,
        "pass" : proxyPass,
    }

    # 设置 http和https访问都是用HTTP代理
    proxies = {
        "http"  : proxyMeta,
        "https" : proxyMeta,
    }


    #  设置IP切换头
    tunnel = random.randint(1,10000)
    headers = {"Proxy-Tunnel": str(tunnel)}



    resp = requests.get(targetUrl, proxies=proxies, headers=headers)

    print resp.status_code
    print resp.text

上一篇： docker学习笔记补充：记一次docker启动失败的问题

下一篇： window中对ubuntu通过samba共享出来的文件没有写权限/无法修改

Python中的requests框架使用爬虫代理的方案

Python的Django框架中if标签的相关使用

Python的Django框架中的Context使用

在Python的Django框架中创建和使用模版

Python的Flask框架中SQLAlchemy使用时的乱码问题解决

在python中的socket模块使用代理实例

python中requests模块的使用方法

使用Python编写爬虫的基本模块及框架使用指南

基于python requests库中的代理实例讲解

使用Python的Scrapy框架编写web爬虫的简单示例

使用url_helper简化Python中Django框架的url配置教程