一、request安装

pip install requests

request使用示例

import requests

response = requests.get('https://www.mzitu.com/') # get()方法发送请求，获取HTML网页

response.status_code  # 返回状态码

response.text  #以文本格式返回网页内容

response.content  # 以二进制形式返回

二、BeautifulSoup库

BeautifulSoup是Python的一个库，最主要的功能就是从网页爬取我们需要的数据。BeautifulSoup将html解析为对象进行处理，全部页面转变为字典或者数组。

pip install beautifulsoup4

BeautifulSoup基本使用

三、抓取图片

from bs4 import BeautifulSoup

url='http://www.mzitu.com'

res = requests.get(url)    # get()方法发送请求，获取HTML网页

soup = BeautifulSoup(res.text, 'html.parser')  # # 使用BeautifulSoup来解析我们获取到的网页

#coding=utf-8

import requests

from bs4 import BeautifulSoup

def imgurl(url):

    res = requests.get(url)   # url为a标签的helf链接，即为图片封面的图片

    soup = BeautifulSoup(res.text, 'html.parser')   # 使用BeautifulSoup来解析我们获取到的网页

    page = int(soup.select('.pagenavi span')[-2].text)   # 获取总页数，-2为去掉上下页

    # a = soup.select('.main-image a')[0]  # 获取当前图片链接

    # src = a.select('img')[0].get('src')

    src = soup.select('.main-image a img')[0].get('src')  # 获取图片链接

    meiziid = src[-9:-6]  # 切片将src的倒数的字符串做名字

    print('开始下载妹子:', format(meiziid))  # 输出窗口提示下载

    for i in range(1, page+1):

        i = '%02d' % i

        img = src.replace('01.jpg', str(i)+'.jpg')  # replace()替换页数

        #  添加headers模拟浏览器工作 反反爬

        headers = {

            'User-Agent': 'Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1)',

            'Referer': 'http://www.mzitu.com'

        }

        response = requests.get(img, headers=headers)

        f = open('/Users/xcn/Desktop/mzitu/'+meiziid+'%s.jpg' % i, 'wb')  # 放在D:\666\目录下

        f.write(response.content)

        f.close()

        print('===> %s 完成 ' % (meiziid + i))

    print(' %s 已下载\n' % meiziid)

def imgpage(page=''):

    res = requests.get('http://www.mzitu.com/page/' + page)

    soup = BeautifulSoup(res.text, 'html.parser')  # 解析页面

    href = soup.select('#pins a')  # 筛选

    list = set([i.get('href') for i in href])  # 遍历获取筛选后的href链接并用set()去掉重复的链接

    [imgurl(i) for i in list]  # 遍历下载

result = input('下载哪一页：')

imgpage(result)

四、大功告成

使用request+Beautiful爬取妹子图的更多相关文章

Python 爬虫入门(二)——爬取妹子图
Python 爬虫入门听说你写代码没动力?本文就给你动力,爬取妹子图.如果这也没动力那就没救了. GitHub 地址: https://github.com/injetlee/Python/blob ...
Python 爬虫入门之爬取妹子图
Python 爬虫入门之爬取妹子图来源:李英杰链接: https://segmentfault.com/a/1190000015798452 听说你写代码没动力?本文就给你动力,爬取妹子图.如果 ...
scrapy 也能爬取妹子图？
目录前言 Media Pipeline 启用Media Pipeline 使用 ImgPipeline 抓取妹子图瞎比比前言我们在抓取数据的过程中,除了要抓取文本数据之外,当然也会有抓取图片的需 ...
requests+正则表达式爬取妹子图
做了一个爬取妹子图某张索引页面的爬虫,主要用request和正则表达式. 感谢崔庆才大神的爬虫教学视频和 gitbook: B站:https://www.bilibili.com/video/a ...
小白学 Python 爬虫（16）：urllib 实战之爬取妹子图
人生苦短,我用 Python 前文传送门: 小白学 Python 爬虫(1):开篇小白学 Python 爬虫(2):前置准备(一)基本类库的安装小白学 Python 爬虫(3):前置准备(二)Li ...
爬取妹子图(requests + BeautifulSoup)
刚刚入门爬虫,今天先对于单个图集进行爬取,过几天再进行翻页爬取. 使用requests库和BeautifulSoup库目标网站:妹子图今天是对于单个图集的爬取,就选择一个进行爬取,我选择的链接为: ...
利用 PhpQuery 随机爬取妹子图
前言运行下面的代码会随机得到妹子图的一张图片,代码中的phpQuery可以在这里下载:phpQuery-0.9.5.386.zip <?php require 'phpQuery.php'; ...
python 爬取妹子图
作为一个python还没入门的小白,搞懂这段代码实在是很不容易,还要去学html的知识(#黑脸) 因此我加上了注释,比较好读懂点 #coding=utf-8 import time import re ...
Python爬虫个人记录（三）爬取妹子图
这此教程可能会比较简洁,具体细节可参考我的第一篇教程: Python爬虫个人记录(一)豆瓣250 Python爬虫个人记录(二)fishc爬虫一.目的分析获取煎蛋妹子图并下载 http://jan ...

随机推荐

MyISAM和innoDB对比，覆盖索引简单回顾
MyISAM Myisam是Mysql的默认存储引擎,当create创建新表时,未指定新表的存储引擎时,默认使用Myisam. 它不支持事务,也不支持外键,尤其是访问速度快,对事务完整性没有要求或者以 ...
用windows自带的fsutil修改稀疏文件大小成功，但文件内容似乎丢失
fsutil sparse setflag. fsutil sparse setrange 10M对应字节,1G对应字节.. 看文件属性,实际尺寸是小了,但内容似乎也丢了..因为自己把该文件做成虚拟盘 ...
IIS : Add the server variable name to the allowed server variable list.
IIS下设置反向代理访问时报错:将服务器变量名添加到允许的服务器变量列表中. 1.打开IIS: 2.打开要添加变量的站点: 3.打开URL Rewrite: 4.在右列上,选择“查看服务器变量(Vie ...
打造自己的移动绿色版 Python 环境
本文只适用 Windows 系统,Linux,Mac 或其他系统可以直接自己写个脚本安装就好了,甚至大部分系统自带. 相信某些人写好了Python程序结果给朋友运行又得装个Python环境,难免失去了 ...
[HNOI2002]营业额统计（splay基础）
嘟嘟嘟这几天开始搞平衡树了,\(splay\)理解起来感觉还行,然而代码看了半天才勉强看懂. 我这篇博客应该不算什么入门讲解,因为我觉得我讲不明白,所以只能算自己的学习笔记吧. 这道题就是有\(n\ ...
微信小程序------导航栏样式、tabBar导航栏
一:导航栏样式设置小程序的导航栏样式在app.json中定义. 这里设置导航,背景黑色,文字白色,文字内容测试小程序 app.json内容: { "pages":[ " ...
python110道面试题
1.一行代码实现1--100之和利用sum()函数求和 2.如何在一个函数内部修改全局变量利用global 修改全局变量 3.列出5个python标准库 os:提供了不少与操作系统相关联的函数 s ...
SSM框架之RestFul示例
演示环境:maven+Spring+SpringMVC+MyBatis Plus或MyBatis都行+JDK8 JDK7我想应该没有问题,原因是用的基本都是JDK6或者JDK7的相关特性. 当然了,J ...
Mysql5.7.21 Navicat触发器创建
CREATE TRIGGER m_trigger AFTER UPDATE ON table1 FOR EACH ROW BEGIN IF( old.status!= new.status) THEN ...
PhpStorm 回到上次编辑位置的快捷键
回到上次编辑位置 Ctrl + Alt + <- (向后) Ctrl + Alt + -> (向前) 这个快捷键有时和电脑桌面快捷键冲突.解决办法: win + D 回到电脑桌面,右键-& ...

使用request+Beautiful爬取妹子图

一、request安装

二、BeautifulSoup库

三、抓取图片

四、大功告成

使用request+Beautiful爬取妹子图的更多相关文章

随机推荐

热门专题