爬取JSON文件并且存储

思路

　　1 先调用模块

　　2 定义一个函数

　　　　2.1 获取网址（点击评论找到JSON的文件（分析评论preview）获取Request URL后面的地址）

　　　　2.2 添加用户的请求头

　　　　2.3 使用get方法发送请求

　　　　2.4 转化格式并返回（return）格式（.text）

　　3. 应为要以键值对的格式保存所以定义一个函数删除并且返回删除（replace）

　　4. 类型转换并且返回

　　　　4.1 return json.loads(传入参数的名称)

　　5. 保存获取到的JSON数据

　　　　5.1 open 一定要注意格式utf-8

　　6. 传入参数的函数

　　　　6.1 data = 2

　　　　6.2 s = 3(data)

　　　　6.3 5(s)

　　7. 运行调用

　　　　7.1 if __name__ ==‘__main__’:

　　　　　　　　6()

例题代码

import requests

import json

def name_1():

    # 获取网址 点击评论 找到有JSON的文件（分析评论 preview）获取Request URL后面的地址

    url = 'https://club.jd.com/comment/productPageComments.action?callback=fetchJSON_comment98&productId=100007080973&score=0&sortType=5&page=0&pageSize=10&isShadowSku=0&fold=1'

    # 添加用户请求头

    headers = {'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/90.0.4430.212 Safari/537.36'}

    # 使用get方法发送请求

    resp = requests.get(url,headers=headers)

    # 转换格式 并返回（return）

    return resp.text

def name_2(data_1):

    # 因为是键值对的形式 所以要删除一些东西 并且返回

    return data_1.replace('fetchJSON_comment98(','').replace(');','') #如果为str类型

def name_3(data_2):

    # 类型转换 并且返回

    return json.loads(data_2)

def name_4(obj):

    # 保存获取到的JSON数据

    json.dump(obj,open('京东销量最好的固态数据.txt','w',encoding='utf-8'),ensure_ascii=False)

def name():

    data = name_1()

    s = name_2(data)

    print(type(name_3(s)))

    print(s)

    name_4(s)

if __name__ == '__main__':

    name()

爬取JSON文件并且存储的更多相关文章

豆瓣电影信息爬取(json)
豆瓣电影信息爬取(json) # a = "hello world" # 字符串数据类型# b = {"name":"python"} # ...
正则爬取豆瓣Top250数据存储到CSV文件（6行代码）
利用正则爬取豆瓣TOP250电影信息电影名字电影年份电影评分评论人数 import requests import csv import re # 不算导包的话正式代码6行存储到csv文件 ...
使用HtmlAgilityPack爬取网站信息并存储到mysql
前言:打算做一个药材价格查询的功能,但刚开始一点数据都没有靠自己找信息录入的话很麻烦的,所以只有先到其它网站抓取存到数据库再开始做这个了. HtmlAgilityPack在c#里应该很多人用吧,简单又 ...
python之爬虫（爬取.ts文件并将其合并为.MP4文件——以及一些异常的注意事项）
//20200115 最近在看“咱们裸熊——we bears”第一季和第三季都看完了,单单就第二季死活找不到,只有腾讯有资源,但是要vip……而且还是国语版……所以就瞄上了一个视频网站——可以在线观看 ...
python爬虫26 | 把数据爬取下来之后就存储到你的MySQL数据库。
小帅b说过在这几篇中会着重说说将爬取下来的数据进行存储上次我们说了一种 csv 的存储方式这次主要来说说怎么将爬取下来的数据保存到 MySQL 数据库接下来就是学习python的正确姿势真 ...
scrapy --爬取媒体文件示例详解
scrapy 图片数据的爬取基于scrapy进行图片数据的爬取: 在爬虫文件中只需要解析提取出图片地址,然后将地址提交给管道配置文件中写入文件存储位置:IMAGES_STORE = './imgs ...
scrapy架构与目录介绍、scrapy解析数据、配置相关、全站爬取cnblogs数据、存储数据、爬虫中间件、加代理、加header、集成selenium
今日内容概要 scrapy架构和目录介绍 scrapy解析数据 setting中相关配置全站爬取cnblgos文章存储数据爬虫中间件和下载中间件加代理,加header,集成selenium 内 ...
基于nodejs模拟浏览器post请求爬取json数据
今天想爬取某网站的后台传来的数据,中间遇到了很多阻碍,花了2个小时才请求到数据,所以我在此总结了一些经验. 首先,放上我所爬取的请求地址http://api.chuchujie.com/api/?v= ...
爬取json Swaggerui界面
对一个静态的网页进行爬取. 要获取的内容分别为 paths 标签下的 1./quota/开头的路径 2. get 这样的httpmode 3 description对应的描述 4 summary 5 ...
scrapy爬取数据进行数据库存储和本地存储
今天记录下scrapy将数据存储到本地和数据库中,不是不会写,因为小编每次都写觉得都一样,所以记录下,以后直接用就可以了-^o^- 1．本地存储设置pipel ines.py class Ak17P ...

随机推荐

Centos使用nohup实现后台运行程序
nohup和&的区别& : 指在后台运行 nohup : 不挂断的运行,注意并没有后台运行的功能,,就是指,用nohup运行命令可以使命令永久的执行下去,和用户终端没有关系,例如我们断 ...
Http 包头里面有个content-length，可以获取下载的资源包大小
NSDictionary *headerFieldsDic = request.responseHeaders; 包大小为:[headerFieldsDic[@"Content-Length ...
Alibaba Cloud Linux 3.2104 64位安装php7.2.12
1 安装php所需要的扩展 yum -y install libxml2 libxml2-devel openssl openssl-devel bzip2 bzip2-devel curl curl ...
visio任意图形填充
开发工具->操作->修剪->按住Shift键点击填充图形所有边同时选中后->组合->开发工具->操作->连接回到开始选项卡选择填充颜色中途不要点击其他, ...
使用netstat命令查看Redis服务是否启动
Windows平台:netstat -ano | findstr 6379Linux平台:netstat -npl |grep 6379
new一个实例的原理及过程
前提,要明白new出来的实例是什么,包含了哪些内容? 请看一下举例代码↓↓↓↓ function Person(name,age){ this.name = name; this.age = age; ...
IT工具知识-11：一种安卓投屏到Win10失败的解决方法
软硬件平台电脑:WIN10 LTSC 手机:红米K30Pro/MIUI 11.0.26 投屏软件:安卓端-自带投屏,WIN10-自带投屏(连接) 故障描述之前还能用的,但是在换了个路由器之后就不能 ...
一道网红题：Java值传递，答案开始看了不太懂，是不是涉及到了匿名类的实例化？
题目如下:看起来是值传递的考察... public class Test{ public static void main(String[] args){ int a = 10; int b = 10 ...
JavaScript之jQuery要点记录
一属性和属性节点 1.什么是属性? 对象身上保存的变量就是属性 2.如何操作属性? 对象.属性名称 = 值; 对象.属性名称; 对象["属性名称"] = 值; 对象[" ...
LVS简略介绍
一.lvs是什么 LVS是 Linux Virtual Server 的简称,也就是Linux虚拟服务器.这是一个由章文嵩博士发起的一个开源项目,它的官方网站是 http://www.linuxvir ...

爬取JSON文件并且存储

爬取JSON文件并且存储的更多相关文章

随机推荐

热门专题