python3 Scrapy爬虫框架ip代理配置 - 代码天地

python3 Scrapy爬虫框架ip代理配置

其他 2021-03-23 08:47:29 阅读次数: 0

一、背景

在做爬虫项目的过程中遇到ip代理的问题，网上搜了一些，要么是用阿里云的ip代理，要么是搜一些网上现有的ip资源，然后配置在setting文件中。这两个方法都存在一些问题。

1、阿里云ip代理方法，网上大都是配置阿里云的ip代理的用户名、密码然后加密、解密。我按照上面的方面操作，发现阿里云上面的ip代理的参数里面没有用户名、密码相关的参数配置了。

2、至于网上查到的另外一种方法是在setting文件里面添加代理IP资源池，然后再在middlewares.py文件里面添加上一些代码来实现，但代理ip不一定是可用的。

二、改进方法

1、基于背景中提到的网上两种方法的局限性，我在此综合了两种方法。

2、改进方法：

1）利用阿里云的ip代理API生成50个代理IP资源池（用自己的阿里云账号登陆生成的，ip有效性得到保障）

2）直接在middlewares.py中添加如下函数，PROXIES为在阿里云上面生成的ip，此处涉及到个人隐私，故用****代替。

class my_proxy(object):
    def process_request(self, request, spider):
        PROXIES = ['http://****.****.****.****:8080']
        ip = random.choice(PROXIES)
        request.meta['Proxy-Authorization'] = ip

注意：request.meta的方括号里面的关键字需要写对，不然无法正常运行。

希望个人的方法总结可以帮到需要帮助的人。

猜你喜欢

转载自blog.csdn.net/sinat_29217765/article/details/103994307

python3 Scrapy爬虫框架ip代理配置

【Python爬虫】 scrapy框架添加IP代理池反反爬

Python爬虫之scrapy框架中ip代理池的设置

Python3 爬虫使用代理 IP

Python3 Scrapy爬虫框架(Scrapy/scrapy-redis)

Python 分布式爬虫框架 Scrapy 7-5 scrapy实现ip代理池

【Python3 爬虫学习笔记】Scrapy框架的使用 3

【Python3 爬虫学习笔记】Scrapy框架的使用 4

Python3爬虫Scrapy框架常用命令

【Python3 爬虫】12_代理IP的使用

【python3】如何建立爬虫代理ip池

【Python3】基于Requests库的爬虫代理ip的配置以及使用

python3 爬虫

python3爬虫

python3 爬虫——scrapy文档

Python3 Scrapy 框架学习

python3（requests）使用代理ip

Python3获取代理IP

python3在线更新代理IP

Python3爬虫（十五）代理

Python3安装Scrapy

Python3 --- Scrapy入门

Python3 --- Scrapy安装

Python3爬虫（十六） pyspider框架

Python网络爬虫--Scrapy使用IP代理池

CentOS 7系统下安装python3并创建python3虚拟环境以及安装scrapy爬虫框架

python3 随机代理

python3 爬虫入门

python3爬虫入门

python3 的小爬虫

今日推荐

《美国对全球网络空间安全与发展的威胁和破坏》报告发布

火速冲上 GitHub 热榜 —— 开源编程语言、框架哪有这么可爱？

北京人形机器人创新中心发布全球首个纯电驱拟人奔跑的全尺寸人形机器人“天工”

LFOSSA 源来如此公开课 | 掌握云原生未来：CNCF 认证全面攻略与备考秘籍

周排行

让自己的头脑极度开放

CentOS 6.5(x64) 和Redhat6.5操作系误删libc

高可用注册中心

【日记】12.28/【题解】AtCoder AGC041

XML（5）_XML 约束_DTD

Java集合Map（四）

树梅派安装桌面环境教程

pipenv 的使用和安装

小程序白屏问题和内存研究

C语言简单选择排序

每日归档

更多

2024-05-02(0)

2024-05-01(4)

2024-04-30(1)

2024-04-29(40)

2024-04-28(0)

2024-04-27(56)

2024-04-26(39)

2024-04-25(22)

2024-04-24(36)

2024-04-23(26)