使用工具：

Python 3.6

pycharm

主要内容：

1、系统分析目标网页

2、html标签数据解析方法（xpath）

3、海量图片数据一键保存

爬虫的一般思路：

1、确定爬取的url路径，headers参数

2、发送请求 -- requests 模拟浏览器发送请求，获取响应数据

3、析数据 -- parsel 转化为Selector对象，Selector对象具有xpath的方法，能够对转化的数据进行处理

4、保存数据

代码如下：

import requests

import parsel

# 1、确定爬取的url路径，headers参数

base_url = 'https://www.umei.cc/meinvtupian/meinvxiezhen/'

headers = {'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.122 Safari/537.36'}

# 2、发送请求 -- requests 模拟浏览器发送请求，获取响应数据

response = requests.get(base_url, headers=headers)

response.encoding = response.apparent_encoding  # 自动识别响应对象的编码

html = response.text

# print(html)

# 3、解析数据 -- parsel  转化为Selector对象，Selector对象具有xpath的方法，能够对转化的数据进行处理

# 3、1 转换数据类型

parse = parsel.Selector(html)

# 3、2 解析数据

href_list = parse.xpath('//div[@class="TypeList"]/ul/li/a/@href').extract()

# print(href_list)

for href in href_list:

    # print(href)

    # 再次发送图片请求

    href_data = requests.get(href, headers=headers).text

    # 解析图片数据

    img = parsel.Selector(href_data)

    img_src = img.xpath('//div[@class="ImageBody"]/p/a/img/@src').extract_first()

    # print(img_src)

    # 发送图片的url

    img_data = requests.get(img_src, headers=headers).content

    # 4、保存数据

    # 1、准备文件名

    file_name = img_src.split('/')[-1]

    # print(file_name)

    # 3、保存文件

    with open('img\\' + file_name, 'wb') as f:

        print('正在保存文件：{}'.format(file_name))

        f.write(img_data)

效果如下：

如果你处于想学Python或者正在学习Python，Python的教程不少了吧，但是是最新的吗？说不定你学了可能是两年前人家就学过的内容，在这小编分享一波2020最新的Python教程。获取方式，私信小编 “ 资料 ”，即可免费获取哦！

python爬取优美图库海量图片，附加代码，一键爬取的更多相关文章

scrapy关键字爬取百度图库（一）
刚入门学习python的菜鸟,如有错误,还望指教爬取百度图库需要知道百度图库的加载方式是通过下拉加载的,所以我们需要分析Ajax请求来爬取每一页的数据信息表述不清直接上图片图片一是刷新页面后加载 ...
python爬爬爬之单网页html页面爬取
python爬爬爬之单网页html页面爬取作者:vpoet mail:vpoet_sir@163.com 注:随意copy 不用告诉我 #coding:utf-8 import urllib2 Re ...
Python爬虫入门教程 2-100 妹子图网站爬取
妹子图网站爬取---前言从今天开始就要撸起袖子,直接写Python爬虫了,学习语言最好的办法就是有目的的进行,所以,接下来我将用10+篇的博客,写爬图片这一件事情.希望可以做好. 为了写好爬虫,我们 ...
python爬虫实战（六）--------新浪微博（爬取微博帐号所发内容，不爬取历史内容）
相关代码已经修改调试成功----2017-4-13 详情代码请移步我的github:https://github.com/pujinxiao/sina_spider 一.说明 1.目标网址:新浪微博 ...
python网络爬虫之解析网页的BeautifulSoup(爬取电影图片)[三]
目录前言一.BeautifulSoup的基本语法二.爬取网页图片扩展学习后记前言本章同样是解析一个网页的结构信息在上章内容中(python网络爬虫之解析网页的正则表达式(爬取4k动漫图 ...
Java爬虫一键爬取结果并保存为Excel
Java爬虫一键爬取结果并保存为Excel 将爬取结果保存为一个Excel表格官方没有给出导出Excel 的教程这里我就发一个导出为Excel的教程导包因为个人爱好我喜欢用Gradle所以这 ...
Python post请求模拟登录淘宝并爬取商品列表
一.前言大概是一个月前就开始做淘宝的爬虫了,从最开始的用selenium用户配置到selenium模拟登录,再到这次的post请求模拟登录.一共是三篇博客,记录了我爬取淘宝网的经历.期间也有朋友向我 ...
（转）Python网络爬虫实战：世纪佳缘爬取近6万条数据
又是一年双十一了,不知道从什么时候开始,双十一从“光棍节”变成了“双十一购物狂欢节”,最后一个属于单身狗的节日也成功被攻陷,成为了情侣们送礼物秀恩爱的节日. 翻着安静到死寂的聊天列表,我忽然惊醒,不行 ...
python 分别用python2和python3伪装浏览器爬取网页内容
python网页抓取功能非常强大,使用urllib或者urllib2可以很轻松的抓取网页内容.但是很多时候我们要注意,可能很多网站都设置了防采集功能,不是那么轻松就能抓取到想要的内容. 今天我来分享下 ...

随机推荐

R语言基本操作
is.na and is.element is.na can use which, it finds specific rows, is.element can't, it is designed t ...
dapp 是什么？dapp 和 app 有什么区别？一文明白 dapp。
DApp 是 decentralized application 中文分布式 APP 的缩写. 一个 DApp 有后台代码运行在分布式点对点网络中.传统的 APP 的后台代码是运行在中心化的服务器. ...
干货 | Python进阶系列之学习笔记（四）
目录 Python条件判断 Python循环语句 Python循环控制迭代器与生成器异常一.Python 条件判断如果某些条件满足,才能做某件事情:条件不满足时,则不能做,这就是所谓的判断. ...
树莓派 Raspberry PI基础
树莓派 Raspberry PI基础官网网址:https://www.raspberrypi.org 下载地址:https://www.raspberrypi.org/downloads/ 官方系统 ...
数据源管理 | 基于JDBC模式，适配和管理动态数据源
本文源码:GitHub·点这里 || GitEE·点这里一.关系型数据源 1.动态数据源动态管理数据源的基本功能:数据源加载,容器维护,持久化管理. 2.关系型数据库不同厂商的关系型数据库,提供 ...
Elasticsearch+spring cloud201912301423
<?xml version="1.0" encoding="UTF-8"?> <project xmlns="http://mave ...
js 中对于this 的理解的经典案例
function Foo(){ getName = function(){console.log(1);}; return this; }Foo.getName = function(){consol ...
C9K Stackwise Virtual（一）
一.SV技术基本说明思科Catalyst9K平台的Stackwise Virtual技术是将两个物理的交换机虚拟成一个逻辑的实体(从网络控制层面和管理的角度来看),这两个交换机合二为一之后,将共享相 ...
PTA | 1005 继续(3n+1)猜想 (25分)
卡拉兹(Callatz)猜想已经在1001中给出了描述.在这个题目里,情况稍微有些复杂. 当我们验证卡拉兹猜想的时候,为了避免重复计算,可以记录下递推过程中遇到的每一个数.例如对 n=3 进行验证的时 ...
下载腾讯视频mp4格式
import time import subprocess import argparse def command(cmd, timeout=60): ''' :param cmd: 执行命令cmd, ...

python爬取优美图库海量图片，附加代码，一键爬取