bs4解析-湖南农场品价格行情

import requests

from bs4 import BeautifulSoup

import csv

url = 'https://price.21food.cn/market/174-p1.html'

headers = {

    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/110.0.0.0 Safari/537.36 Edg/110.0.1587.41'

}

resp = requests.get(url=url, headers=headers)

# print(resp.text)

# 解析数据

# 1.把页面源代码交给BeautifulSoup进行处理，生成bs对象

page = BeautifulSoup(resp.text, 'html.parser')  # 设置解析器

# 2.从bs对象中查找数据

# find(标签，属性=值)

# find_all(标签，属性=值)

# 定位到一个方便提取具体数值的地方

# div = page.find('div',class_='sjs_top_cent_erv') # class是python关键字，所以要写成class_

div = page.find('div', attrs={"class": "sjs_top_cent_erv"})  # 和上一行是一个意思，此时可以避免class

# 拿到所有数据行

# 进行切片，不要第一个tr 第一个tr是每一个列标题

trs = div.find_all('tr')[1:]

# 存储文件

f = open('data.csv', mode='w', encoding='utf-8', newline='')  # newline = ''

# 备注：如果没有指定 newline=‘’，则嵌入引号中的换行符将无法正确解析，并且在写入时，使用 \r\n 换行的平台会有多余的 \r 写入。

csvwriter = csv.writer(f)

for tr in trs:  # 每一行的数据

    tds = tr.find_all('td')  # 拿到行中的所有td

    name = tds[0].text  # .text 表示拿到被标签标记的内容

    market = tds[1].text

    spe = tds[2].text

    max = tds[3].text

    min = tds[4].text

    ave = tds[5].text

    date = tds[6].text

    csvwriter.writerow([name, market, spe, max, min, ave, date])  # 放到csv文件里

resp.close()

f.close()

print("完成！！！")

bs4解析-湖南农场品价格行情的更多相关文章

bs4解析库
beautifulsoup4 bs4解析库是灵活又方便的网页解析库,处理高效,支持多种解析器.利用它不用编写正则表达式即可方便地实现网页的提取要解析的html标签 from bs4 import B ...
bs4 解析以及用法
bs4解析 bs4: 环境安装: lxml bs4 bs4编码流程: 1.实例化一个bs4对象,且将页面源码数据加载到该对象中 2.bs相关的方法或者属性实现标签定位 3.取文本或者取属性 bs的属性 ...
Python3.x：bs4解析html基础用法
Python3.x:bs4解析html基础用法代码: import urllib.request from bs4 import BeautifulSoup import re url = r'ht ...
爬虫的三种解析方式(正则解析, xpath解析, bs4解析)
一 : 正则解析 : 常用正则回顾: 单字符: . : 除换行符以外的所有字符 [] : [aoe] [a-w] 匹配集合中任意一个字符 \d : 数字 [0-9] \D : 非数字 \w : 非数字 ...
bs4解析
介绍:将一个html文档转换成BeautifulSoup对象,然后通过对象的方法或属性查找指定的节点内容转换本地文件: soup = BeautifulSoup(fp,'lxml') fp为文档 ...
python bs4解析网页时 bs4.FeatureNotFound: Couldn't find a tree builder with the features you requested: lxml. Do you need to inst（转）
Python小白,学习时候用到bs4解析网站,报错 bs4.FeatureNotFound: Couldn't find a tree builder with the features you re ...
爬虫系列二(数据清洗--->bs4解析数据)
一 BeautifulSoup解析 1 环境安装 - 需要将pip源设置为国内源,阿里源.豆瓣源.网易源等 - windows (1)打开文件资源管理器(文件夹地址栏中) (2)地址栏上面输入 %ap ...
pytho爬虫使用bs4 解析页面和提取数据
页面解析和数据提取关注公众号"轻松学编程"了解更多. 一般来讲对我们而言,需要抓取的是某个网站或者某个应用的内容,提取有用的价值.内容一般分为两部分,非结构化的数据和结构化的 ...
bs4解析要获取被注掉的部分需先将注释符号去掉
<div class="xzcf-content"> <div id="sfxz"> <div class="main- ...
爬虫的两种解析方式 xpath和bs4
1.xpath解析 from lxml import etree 两种方式使用:将html文档变成一个对象,然后调用对象的方法去查找指定的节点 (1)本地文件 tree = etree.parse(文 ...

随机推荐

【爬虫案例】用Python爬大麦网任意城市的近期演出活动！
目录一.爬取目标二.展示爬取结果三.讲解代码四.同步视频五.附完整源码一.爬取目标大家好,我是@马哥python说 ,一枚10年程序猿. 今天分享一期python爬虫案例,爬取目标是大麦 ...
如何在Ubuntu 20.04上安装Pyenv 管理多版本Python
目录 ubuntu安装pyenv 管理多版本Python 参考文档: 安装pyenv: pyenv 命令列表 pycharm配置 ubuntu安装pyenv 管理多版本Python 参考文档: htt ...
04.1 go-admin自动化上线到生产环境 nginx配置上线vue和go
目录简介基于Gin + Vue + Element UI的前后端分离权限管理系统一. 上线思路 1.1 首先确保项目前后端在本地可以都可以正常跑起来,如果不会可以去看一下作者的视频教程 1.2 ...
WEB服务与NGINX（7）-实现自定义错误页面
1. 自定义错误页面 error_page code ... [=[response]] uri; 定义错误页,以指定的响应状态码进行响应,此指令由ngx_http_index_module模块提供 ...
WEB服务与NGINX（5）- root和alias的区别详解
root和alias的区别 root:指定站点家目录,给定的路径对应于location中的/uri 左侧的/,文件的绝对路径为root+location. 支持环境:http, server, loc ...
ctf_web
ctfshow web13 访问题目链接一看是一道文件上传题,上传文件进行测试上传php会显示 error suffix 因此推测会检测格式当文件字数超出一定字数时,显示 error file ...
C语言：如何删除超链接
单独写出一个函数出来,基本思想就是用fscanf一个一个字符读取出来,(文本流只能用fscanf,不能用fgetc等用于二进制流的函数,不然会导致乱码)遇到<的时候就停止读取,先把之前存进cop ...
解锁高效创新：IPD策略如何重塑产品开发流程
IPD(集成产品开发)涵盖了产品从创意提出到研发.生产.运营等,包含了产品开发到营销运营的整个过程.围绕产品(或项目)生命周期的过程的管理模式,是一套生产流程,更是时下国际先进的管理体系.IPD(集成 ...
zabbix笔记_006 zabbix web监控
web监控 web监控是对http网站服务进行监控,模拟用户访问网站,对特定的结果进行告警,通知管理员网站状态. web监控是运维必备知识点,通过实验能够熟悉配置和了解zabbix是如何监控web站点 ...
kettle从入门到精通第五十课 ETL之kettle 课程源文件分享
Kettle 是一款功能强大的开源 ETL 工具,被广泛应用于数据集成.数据转换和数据加载等领域.随着数据量和多样性的不断增加,使用 Kettle 进行数据处理已成为许多企业和数据工程师的首选.在过去 ...

bs4解析-湖南农场品价格行情

bs4解析-湖南农场品价格行情的更多相关文章

随机推荐

热门专题