python如何使用request爬取图片

下面是代码的简单实现，变量名和方法都是跑起来就行，没有整理，有需要的可以自己整理下：

image2local:

import requests

import time

from lxml import etree

import os

#存储位置

dir = 'xxxxxx'

#网址地址

image_host = 'https://www.27270.com'

#获取爬取列表

def get_list(page_detail=''):

    #爬取列表

    page = requests.get('https://www.27270.com/ent/meinvtupian/list_11_{0}.html'.format(page_detail))

    #解析列表数据

    image_urls = etree.HTML(page.text)

    print(image_urls.xpath('/html/body/div[2]/div[7]/ul/li/a[2]/@href'))

    pages = image_urls.xpath('/html/body/div[2]/div[7]/ul/li/a[2]/@href')

    return pages

def getEntityUrl(url):

    #爬取传过来的地址

    page = requests.get(image_host+url)

    page.keep_alive = False

    image_urls = etree.HTML(page.content)

    try:

        image = image_urls.xpath('//*[@id="picBody"]/p/a[1]/img/@src')[0]

        next = image_urls.xpath('//*[@id="nl"]/a/@href')[0]

        title = image_urls.xpath('/html/body/div[2]/div[2]/h1/text()')[0]

    except:

        return False

    #爬取第一张

    if next.find('##')>1:

        return False

    else:

        result = image2local(image,title,next)

    return True

#爬取图片

def image2local(url,title,name):

    title = title.split('(')[0]

    if not os.path.exists(dir + title):

        os.mkdir(dir + title)

    try:

        image = requests.get(url)

    except:

        return True

    # print(image.content+)

    with open(dir + title+'/{0}.jpg'.format(name),'wb') as f:

        f.write(image.content)

        f.close()

    return True

if __name__ == '__main__':

    x = range(1,215)

    for i in x:

        list = get_list(i)

        for image in list:

            num = 1

            result = True

            while result:

                next = image.replace('.','_{0}'.format(num)+'.')

                num = num+1

                result = getEntityUrl(next)

python代码是现学现写的，大家勿喷

python如何使用request爬取图片的更多相关文章

Python从网页上爬取图片
在搜索壁纸的时候,想把壁纸保存到本地,一张一张的保存太过麻烦,所以想到用Python来爬取壁纸. 设计思路: 1.首先先去找有壁纸的网页: http://www.acfun.cn/a/ac334521 ...
Python爬虫学习 - day1 - 爬取图片
利用Python完成简单的图片爬取最近学习到了爬虫,瞬时觉得很高大上,想取什么就取什么,感觉要上天.这里分享一个简单的爬取汽车之家文章列表的图片教程,供大家学习. 需要的知识点储备本次爬虫脚本依赖 ...
python爬虫---scrapy框架爬取图片,scrapy手动发送请求,发送post请求,提升爬取效率,请求传参(meta),五大核心组件,中间件
# settings 配置 UA USER_AGENT = 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, l ...
python网络爬虫之爬取图片
今天使用requests和BeautifulSoup爬取了一些图片,还是很有成就感的,注释可能有误,希望大家多提意见: 方法一:requests import requests from bs4 im ...
PYTHON 利用ImagePipeline专门爬取图片
自定义file_path()函数,即可以原有图像文件名为名来保存,并分类保存 def file_path(self, request, response=None, info=None): image ...
[python爬虫] 爬取图片无法打开或已损坏的简单探讨
本文主要针对python使用urlretrieve或urlopen下载百度.搜狗.googto(谷歌镜像)等图片时,出现"无法打开图片或已损坏"的问题,作者对它进行简单的探讨.同时 ...
孤荷凌寒自学python第八十二天学习爬取图片2
孤荷凌寒自学python第八十二天学习爬取图片2 (完整学习过程屏幕记录视频地址在文末) 今天在昨天基本尝试成功的基础上,继续完善了文字和图片的同时爬取并存放在word文档中. 一.我准备爬取一个有文 ...
孤荷凌寒自学python第八十一天学习爬取图片1
孤荷凌寒自学python第八十一天学习爬取图片1 (完整学习过程屏幕记录视频地址在文末) 通过前面十天的学习,我已经基本了解了通过requests模块来与网站服务器进行交互的方法,也知道了Beauti ...
爬取图片过程遇到的ValueError: Missing scheme in request url: h 报错与解决方法
一 .scrapy整体框架 1.1 scrapy框架图 1.2 scrapy框架各结构解析 item:保存抓取的内容 spider:定义抓取内容的规则,也是我们主要编辑的文件 pipelines:管道 ...

随机推荐

[React] 15 - Redux: practice IM
本篇属于私人笔记. client 引导部分一.assets: 音频,图片,字体 ├── assets │ ├── audios │ ├── fonts │ └── images 二.main&quo ...
SpringBoot（十六）-- 使用外部容器运行springBoot项目
spring-boot项目需要部署在外部容器中的时候,spring-boot导出的war包无法再外部容器(tomcat)中运行或运行报错. 为了解决这个问题,需要移除springBoot自带的tomc ...
[Linux] ssh-key 公钥文件格式
SSH 协议(Secure Shell 协议)最初在 1995 年由芬兰的 Tatu Ylönen 设计开发,由 IETF(Internet Engineering Task Force)的网络工作小 ...
【死磕jeesite源码】jeesite添加多数据源
本文转载自jeesite添加多数据源 1.jeesite.properties 添加数据源信息,(url2,username2,pawwword2) #mysql database setting j ...
Qt编写GIF录屏工具（开源）
在平时的写作过程中,经常需要将一些操作动作和效果图截图成gif格式,使得涵盖的信息更全面更生动,有时候可以将整个操作过程和运行效果录制成MP4,但是文件体积比较大,而且很多网站不便于上传,基本上都支持 ...
word2016怎么让目录索引显示在左边？
视图里面勾选导航窗格即可前提是你分级分好
剖析RAC中的@weakify、@strongify
0.很长的前言 1.问题 2.RAC是怎么解决的 2.weakify.strongify的定义预备知识一层层展开weakify 3.RAC装逼宏 metamacro_argcount 的定义 me ...
java转换图片压缩生成webp格式
http://blog.csdn.net/xu_san_duo/article/details/79085718
python3之枚举
枚举 li = ['a','b','c','d'] for index,i in enumerate(li): #for index,i in enumerate(li,100): print(ind ...
postgresql----条件表达式
postgresql支持CASE,COALESCE,NULLIF,GREATEST,LEAST条件表达式,使用它们有时候可以简化许多功能实现. 测试表 test),sex )); CREATE TAB ...

python如何使用request爬取图片

python如何使用request爬取图片的更多相关文章

随机推荐

热门专题