Python抓取妹子图，内含福利

目标抓取全站妹子封面图片全部爬下来以图片标题命名

分析网页数据结构

妹子图首页
接下来找张图片右击点击检查

想要数据
拿到图片链接直接用浏览器可以访问，但是程序下载有反爬虫，图片直接下载不了需要加请求头部信息

先上手代码试试！

import requests

from lxml import etree

# 设计模式 --》面向对象编程

class Spider(object):

    def __init__(self):

        # 反反爬虫措施，加请求头部信息

        self.headers = {

            "User-Agent": "Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.110 Safari/537.36",

            "Referer": "https://www.mzitu.com/xinggan/"

        }

    def start_request(self):

        # 1. 获取整体网页的数据 requests

        for i in range(1, 204):

            print("==========正在抓取%s页==========" % i)

            response = requests.get("https://www.mzitu.com/page/"+ str(i) + "/", headers=self.headers)

            html = etree.HTML(response.content.decode())

            self.xpath_data(html)

    def xpath_data(self, html):

        # 2. 抽取想要的数据 标题 图片 xpath

        src_list = html.xpath('//ul[@id="pins"]/li/a/img/@data-original')

        alt_list = html.xpath('//ul[@id="pins"]/li/a/img/@alt')

        for src, alt in zip(src_list, alt_list):

            file_name = alt + ".jpg"

            response = requests.get(src, headers=self.headers)

            print("正在抓取图片：" + file_name)

            # 3. 存储数据 jpg with open

            try:

                with open(file_name, "wb") as f:

                    f.write(response.content)

            except:

                print("==========文件名有误！==========")

spider = Spider()

spider.start_request()

哎！好像没问题！

运行中

运行结果

同学们，都把裤子给我穿上！好好学习！

教程已出，但是可能有很多网友不会使用

大家有任何问题可以扫描二维码关注公众号，添加我的微信

我会第一时间为大家解答

搜索公众号“一条正弦”或扫码关注公众号，第一时间获取更多优质资源

Python抓取妹子图，内含福利的更多相关文章

python 爬取妹子图
作为一个python还没入门的小白,搞懂这段代码实在是很不容易,还要去学html的知识(#黑脸) 因此我加上了注释,比较好读懂点 #coding=utf-8 import time import re ...
Python 爬虫入门(二)——爬取妹子图
Python 爬虫入门听说你写代码没动力?本文就给你动力,爬取妹子图.如果这也没动力那就没救了. GitHub 地址: https://github.com/injetlee/Python/blob ...
Python 爬虫入门之爬取妹子图
Python 爬虫入门之爬取妹子图来源:李英杰链接: https://segmentfault.com/a/1190000015798452 听说你写代码没动力?本文就给你动力,爬取妹子图.如果 ...
Python 抓取网页并提取信息(程序详解)
最近因项目需要用到python处理网页,因此学习相关知识.下面程序使用python抓取网页并提取信息,具体内容如下: #---------------------------------------- ...
使用 Python 抓取欧洲足球联赛数据
Web Scraping在大数据时代,一切都要用数据来说话,大数据处理的过程一般需要经过以下的几个步骤数据的采集和获取数据的清洗,抽取,变形和装载数据的分析,探索和预测 ...
python抓取性感尤物美女图
由于是只用标准库,装了python3运行本代码就能下载到多多的美女图... 写出代码前面部分的时候,我意识到自己的函数设计错了,强忍继续把代码写完. 测试发现速度一般,200K左右的下载速度,也没有很 ...
python抓取网页例子
python抓取网页例子最近在学习python,刚刚完成了一个网页抓取的例子,通过python抓取全世界所有的学校以及学院的数据,并存为xml文件.数据源是人人网. 因为刚学习python,写的代码 ...
Python抓取页面中超链接(URL)的三中方法比较(HTMLParser、pyquery、正则表达式) <转>
Python抓取页面中超链接(URL)的3中方法比较(HTMLParser.pyquery.正则表达式) HTMLParser版: #!/usr/bin/python # -*- coding: UT ...
如何用python抓取js生成的数据 - SegmentFault
如何用python抓取js生成的数据 - SegmentFault 如何用python抓取js生成的数据 1赞踩收藏想写一个爬虫,但是需要抓去的的数据是js生成的,在源代码里看不到,要怎么才能抓 ...

随机推荐

python学习-os引入
# 引入import os # 路径处理 -- 外部资源-os # 获取当前的工作路径workspace = os.getcwd() # os模块下的getcwd函数print(workspace) ...
mysql中where和having子句的区别和具体用法
1.mysql中的where和having子句的区别 having的用法 having字句可以让我们筛选成组后的各种数据,where字句在聚合前先筛选记录,也就是说作用在group by和having ...
keras实现mnist手写数字数据集的训练
网络:两层卷积,两层全连接,一层softmax 代码: import numpy as np from keras.utils import to_categorical from keras imp ...
test-hellow world!
//for C #include<stdio.h> int main() { printf("hellow world!"); return 0; } #for pyt ...
【Java必修课】好用的Arrays.asList也有这三个坑
好用的asList 在开发或写测试用例的过程中,经常会用到Arrays.asList()这个方法,可以快速方便地将数组转化成一个List.例如: List<String> list = A ...
JAVA Socket API与LINUX Socket API探究
代码这是一个带有UI界面的JAVA网络聊天程序,使用Socket连接完成通信. JAVA服务端程序 import java.io.IOException; import java.io.InputS ...
Golang 入门系列（十二）ORM框架gorm
之前在已经介绍了用的github.com/go-sql-driver/mysql 访问数据库,不太了解的可以看看之前的文章 https://www.cnblogs.com/zhangweizhong/ ...
python GUI编程tkinter示例之目录树遍历工具
摘录 python核心编程本节我们将展示一个中级的tkinter应用实例,这个应用是一个目录树遍历工具:它会从当前目录开始,提供一个文件列表,双击列表中任意的其他目录,就会使得工具切换到新目录中,用 ...
SSM框架整合之练习篇
SSM的练习 : 1开发环境数据库:mysql5.5以上版本. Jdk:1.7 开发环境:Eclipse mars2 Spring:4.2.4 Mybatis:3.2.7 Tomcat:7 2数据库 ...
BOM对象——Location
BOM对象--location <!DOCTYPE html> <html> <head> <meta charset="utf-8"&g ...

Python抓取妹子图，内含福利

目标抓取全站妹子封面图片全部爬下来以图片标题命名

同学们，都把裤子给我穿上！好好学习！

Python抓取妹子图，内含福利的更多相关文章

随机推荐

热门专题