免费 IP 代理池示例

使用文档

import requests

import re

import random

from concurrent.futures import ThreadPoolExecutor

import time

start = time.time()

pool = ThreadPoolExecutor(12)

def get_proxy():

    return requests.get('http://127.0.0.1:5010/get/').json()

def delete_proxy(proxy):

    requests.get("http://127.0.0.1:5010/delete/?proxy={}".format(proxy))

url = 'https://www.pearvideo.com/category_loading.jsp?reqType=5&categoryId=9&start=0'

video_list=[]

ret = requests.get(url)

reg = '<a href="(.*?)" class="vervideo-lilink actplay">'

video_urls = re.findall(reg, ret.text)

print(video_urls)

for url in video_urls:

    proxy = get_proxy().get('proxy')

    print(proxy)

    try:

        ret_detail = requests.get('https://www.pearvideo.com/' + url, proxies={"http": "http://{}".format(proxy)})

        print(proxy)

        reg = 'srcUrl="(.*?)",vdoUrl=srcUrl'

        mp4_url = re.findall(reg, ret_detail.text)[0]  # type:str

        video_name = mp4_url.rsplit('/', 1)[-1]

        dic = {

            'v_name': video_name,

            'v_url': mp4_url

        }

        video_list.append(dic)

    except Exception:

        delete_proxy(proxy)

def get_video(dic):

    url = dic['v_url']

    name = dic['v_name']

    print(f'开始下载{name}')

    video_data = requests.get(url=url)

    print(url)

    with open(name, 'wb') as f:

        for line in video_data.iter_content():

            f.write(line)

        print(f'{name}下载完成')

        end = time.time()

        ctime = end - start

        print(ctime)

print(video_list)

def main():

    for url in video_list:

        done = pool.submit(get_video, url)

if __name__ == '__main__':

    main()

    pool.shutdown(wait=True)

免费 IP 代理池示例的更多相关文章

免费IP代理池定时维护，封装通用爬虫工具类每次随机更新IP代理池跟UserAgent池，并制作简易流量爬虫
前言我们之前的爬虫都是模拟成浏览器后直接爬取,并没有动态设置IP代理以及UserAgent标识,本文记录免费IP代理池定时维护,封装通用爬虫工具类每次随机更新IP代理池跟UserAgent池,并制作 ...
记一次企业级爬虫系统升级改造（六）：基于Redis实现免费的IP代理池
前言: 首先表示抱歉,春节后一直较忙,未及时更新该系列文章. 近期,由于监控的站源越来越多,就偶有站源做了反爬机制,造成我们的SupportYun系统小爬虫服务时常被封IP,不能进行数据采集. 这时候 ...
爬取西刺ip代理池
好久没更新博客啦~,今天来更新一篇利用爬虫爬取西刺的代理池的小代码先说下需求,我们都是用python写一段小代码去爬取自己所需要的信息,这是可取的,但是,有一些网站呢,对我们的网络爬虫做了一些限制, ...
scrapy_随机ip代理池
什么是ip代理? 我们电脑访问网站,其实是访问远程的服务器,通过ip地址识别是那个机器访问了服务器,服务器就知道数据该返回给哪台机器,我们生活中所用的网络是局域网,ip是运营商随机分配的,是一种直接访 ...
Python爬虫之ip代理池
可能在学习爬虫的时候,遇到很多的反爬的手段,封ip 就是其中之一. 对于封IP的网站.需要很多的代理IP,去买代理IP,对于初学者觉得没有必要,每个卖代理IP的网站有的提供了免费IP,可是又很少,写了 ...
python之squid实现免费 IP代理 (windows win7 单机本机本地正向代理区分 HTTPS)
0.目录 1.思路2.windows安装3.相关命令行4.简单配置和初步使用5.问题:squid是否支持HTTPS6.问题:配置多个代理条目,相同ip不同port报错7.问题:根据代理请求区分HTTP ...
使用免费ip代理进行投票
只要是投票系统,必然要限制一个用户投多张票. 如何限制呢?限制ip是最直观最简单的思路,可是代理池可以解决限制ip的情况. 如果投票页面前面加上一个验证码,那程序就会有点困难了. 有些投票使用微信号, ...
python开源IP代理池--IPProxys
今天博客开始继续更新,谢谢大家对我的关注和支持.这几天一直是在写一个ip代理池的开源项目.通过前几篇的博客,我们可以了解到突破反爬虫机制的一个重要举措就是代理ip.拥有庞大稳定的ip代理,在爬虫工作中 ...
反爬虫之搭建IP代理池
反爬虫之搭建IP代理池听说你又被封 ip 了,你要学会伪装好自己,这次说说伪装你的头部.可惜加了header请求头,加了cookie 还是被限制爬取了.这时就得祭出IP代理池!!! 下面就是requ ...

随机推荐

css 箭头三角形
1.向下的三角形 .down{ display:inline-block; width:0px; height:0px; border-top:8px solid rgba(0, 0, 0, 0.65 ...
使用pandas库实现csv行和列的获取
1.读取csv import pandas as pd df = pd.read_csv('路径/py.csv') 2.取行号 index_num = df.index 举个例子: import pa ...
最全面的Android Studio使用教程
http://www.admin10000.com/document/5496.html
IDEA启动springboot项目找不到application.yml配置文件
idea启动项目时读取不到application-pro.yml文件,但是配置文件都在resource目录下: 解决:target/classes 目录是IDEA的classpath目录,项目编译后配 ...
BZOJ1059 二分匹配
1059: [ZJOI2007]矩阵游戏 Time Limit: 10 Sec Memory Limit: 162 MBSubmit: 4810 Solved: 2297[Submit][Stat ...
模板：分页JSP（结合Servlet）
DAO类(后续无需改变) package dao; import java.sql.Connection; import java.sql.PreparedStatement; import java ...
Poj2109 (1) k^n = p.
看到1<=p<10101 ,就去想大数操作了,后来看了discuss原来double完全可以放. 类型长度 (bit) 有效数字 ...
Robot Framework（5）- 使用测试库
如果你还想从头学起Robot Framework,可以看看这个系列的文章哦! https://www.cnblogs.com/poloyy/category/1770899.html 前言在RF 测 ...
使用VuePress搭建个人博客
使用VuePress搭建个人博客 VuePress 是一个基于 Vue 的静态网站生成器.其中主要用到:Vue,VueRouter,Webpack. 类似的工具:hexo 基于 Markdown 语法 ...
[Android-NDK编译] ndk 编译 c++ 兼容性问题汇总整理
1.__int64找不到符号采用int64_t来代替: #if defined(__ANDROID__) typedef int64_t __int64; #endif 2.<sys/io.h ...

免费 IP 代理池示例

免费 IP 代理池示例的更多相关文章

随机推荐

热门专题