爬取房价信息并制作成柱状图XPath，pyecharts

以长沙楼盘为例，看一下它的房价情况如何url = https://cs.newhouse.fang.com/house/s/b91/

一、页面

二、分析页面源代码

我们要获得的数据就是名字和价格，先来分析一下源代码，鼠标右键Inspect，并且打开xpath，第一步，找到需要提取数据的区域，选中定位到代码相应位置，然后右击copy xpath到xpath里面去，可以发现插件中右侧results有一个，就是下面那片黄色的区域，即我们要提取的数据。

好了，网页部分已经了解了，那么接下来就是用代码抓取数据了。

三、代码实现

成果图：

play.py

#!/usr/bin/env python

# _*_ coding: UTF-8 _*_

"""=================================================

@Project -> File    : Operate_system_ModeView_structure -> play.py

@IDE     : PyCharm

@Author  : zihan

@Date    : 2020/5/6 14:59

@Desc    :

================================================="""

import requests

from lxml import etree

from pyecharts.charts import Bar

import pyecharts.options as opts

def getData():

    url = "https://cs.newhouse.fang.com/house/s/b91/"

    headers = {

        'User-Agent': ""

    }

    response = requests.get(url, headers=headers)  # 发送请求

    data= response.content.decode(encoding='gbk')

    html = etree.HTML(data)

    house_list = html.xpath('//div[@class="nl_con clearfix"]/ul/li')

    names = []

    prices = []

    for i in house_list:

        name = i.xpath('.//div[@class="nlcd_name"]/a/text()')

        price = i.xpath('.//div[@class="nhouse_price"]/span/text()')

        if name != [] and price != []:

            if price != ['价格待定']:

                name = name[0].strip()

                names.append(name)

                price = price[0]

                prices.append(price)

    return names, prices

def main():

    print("main() func is starting...")

    names, prices = getData()

    # print(names)

    # print(prices)

    bar = Bar()

    bar.add_xaxis(names)

    bar.add_yaxis('长沙房价图', prices)

    bar.set_global_opts(

            xaxis_opts=opts.AxisOpts(

                axislabel_opts=opts.LabelOpts(rotate=40),

            ),

        yaxis_opts=opts.AxisOpts(name="价格（元、平方米）"),

        title_opts=opts.TitleOpts(title="柱状图")

    )

    bar.render('房价图.html')

if __name__ == '__main__':

    main()

好了。

爬取房价信息并制作成柱状图XPath，pyecharts的更多相关文章

Python爬取招聘信息，并且存储到MySQL数据库中
前面一篇文章主要讲述,如何通过Python爬取招聘信息,且爬取的日期为前一天的,同时将爬取的内容保存到数据库中:这篇文章主要讲述如何将python文件压缩成exe可执行文件,供后面的操作. 这系列文章 ...
[python] 常用正则表达式爬取网页信息及分析HTML标签总结【转】
[python] 常用正则表达式爬取网页信息及分析HTML标签总结转http://blog.csdn.net/Eastmount/article/details/51082253 标签: pytho ...
Python爬虫小实践：寻找失踪人口，爬取失踪儿童信息并写成csv文件，方便存入数据库
前两天有人私信我,让我爬这个网站,http://bbs.baobeihuijia.com/forum-191-1.html上的失踪儿童信息,准备根据失踪儿童的失踪时的地理位置来更好的寻找失踪儿童,这种 ...
Python爬虫之selenium爬虫，模拟浏览器爬取天猫信息
由于工作需要,需要提取到天猫400个指定商品页面中指定的信息,于是有了这个爬虫.这是一个使用 selenium 爬取天猫商品信息的爬虫,虽然功能单一,但是也算是 selenium 爬虫的基本用法了. ...
python学习之——爬取网页信息
爬取网页信息说明:正则表达式有待学习,之后完善此功能 #encoding=utf-8 import urllib import re import os #获取网络数据到指定文件 def getHt ...
Python-王者荣耀自动刷金币+爬取英雄信息+图片
前提:本文主要功能是 1.用python代刷王者荣耀金币 2.爬取英雄信息 3.爬取王者荣耀图片之类的. (全部免费附加源代码) 思路:第一个功能是在基于去年自动刷跳一跳python代码上面弄的,思路 ...
常用正则表达式爬取网页信息及HTML分析总结
Python爬取网页信息时,经常使用的正则表达式及方法. 1.获取<tr></tr>标签之间内容 2.获取<a href..></a>超链接之间内容 3 ...
python爬取酒店信息练习
爬取酒店信息,首先知道要用到那些库.本次使用request库区获取网页,使用bs4来解析网页,使用selenium来进行模拟浏览. 本次要爬取的美团网的蚌埠酒店信息及其评价.爬取的网址为“http:/ ...
Python爬取网页信息
Python爬取网页信息的步骤以爬取英文名字网站(https://nameberry.com/)中每个名字的评论内容,包括英文名,用户名,评论的时间和评论的内容为例. 1.确认网址在浏览器中输入初 ...

随机推荐

UI自动化在RobotFramework中采用的分层设计
RF测试数据 RF测试数据由4种表数据组成.这些测试数据由表的第一个单元格标识,名称和用法如下: 表名用法别名设置表导入测试库,资源文件和变量文件.为测试套件和测试用例定义元数据 Settin ...
再看 Java 中的单例
此前面试遇到了单例问题,本以为已经背的滚瓜烂熟,没想到被问单例如何避免被反射和序列化破坏,虽然后来还是等到了通知,但还是复习一下单例的实现方式,并学习防止反射和序列化破坏的手段. 基本实现方式其他相 ...
LuatOS | 全新在线模拟器，随时随地发挥创意
LuatOS --运行在嵌入式硬件的实时操作系统,开启全新物联网生态. 聚焦嵌入式应用生态,内置功能可支持绝大多数物联网应用场景.深度整合Lua语言,只需少量内存和Flash空间就能运行.不局限于合宙 ...
Vue——v-for动态绑定id的问题
问题:在Vue中,会遇到许多个多选框,倘若数量很庞大那么一个一个input框.label节点寻找,这样操作很繁琐. 直接上解决方案吧: html页面: <ul v-for="(item ...
noip2007 总结
统计数字原题某次科研调查时得到了n个自然数,每个数均不超过1500000000(1.5*10^9).已知不相同的数不超过10000个,现在需要统计这些自然数各自出现的次数,并按照自然数从小到大的顺 ...
linux文件系统和日志分析
一.Linux文件系统 1.inode与block 1.概述: (1)文件数据包括元信息与实际信息 (2)文件存储在硬盘上,硬盘最小存储单位是"扇区",每个扇区存储512字节 (3 ...
JavaScript的核心语法
1.JavaScript同其他程序设计语言一样,有着独特的语法结构,主要包含:变量.数据类型.运算符号.控制语句和注释等. 2.变量是存储数据的基本单位,JavaScript通常利用变量来参与j各种运 ...
java特点了解及JDK初谈
java特性: 1.跨平台:主要是指字节码文件可以在任何具有Java虚拟机的计算机或者电子设备上运行,Java虚拟机中的Java解释器负责将字节码文件解释成为特定的机器码进行运行. 2.简单:相比与C ...
最新Unity 与Android 交互通信（基于Unity 2019.4 和 Android Studio 4.1.1)
原文章链接:https://blog.csdn.net/woshihaizeiwang/article/details/115395519 CLSays:网上找了一圈,真的是很多都不能用,要么太老,要 ...
Jquery 插件 chosen_v1.8.7 下拉复选框带搜索功能
地址:https://harvesthq.github.io/chosen/ 效果: 因为只需要这个功能,就只研究这个功能了,代码: <!doctype html> <html la ...

爬取房价信息并制作成柱状图XPath，pyecharts

爬取房价信息并制作成柱状图XPath，pyecharts的更多相关文章

随机推荐

热门专题