python批量插入数据到es和读取es数据

一、插入数据

1、首先准备类似如下数据

{"_type": "type1", "_id": 1, "_index": "test", "_source": {"JOBNAME0": "guba_eastmoney_com_265162", "JOBNAME1": "guba_eastmoney_com_265162"}}

2、调用es相关模块插入数据到es中

#!/usr/bin/python

import threading

import queue

import json

import time

from elasticsearch import Elasticsearch

from elasticsearch import helpers

import os

import sys

# 

# host_list = [

#     {"host":"10.58.7.190","port":9200},

#     {"host":"10.58.55.191","port":9200},

#     {"host":"10.58.55.192","port":9200},

# ]

#

host_list = [

    {"host":"10.87.7.190","port":9200},

]

# create a es clint obj

client = Elasticsearch(host_list)

with open(os.path.join(os.path.dirname(os.path.abspath(__file__)),"insert.json"),"r") as f:

    for line in f:

        actions = []

        actions.append(json.loads(line))

        try:

            for k, v in helpers.parallel_bulk(client=client, thread_count=1, actions=actions):

                # 这里的actions是插入es的数据，这个格式必须是列表的格式，列表的每个元素又必须是字典

                pass

        except Exception as e:

            sys.stderr(e)

3、查看es索引中的文档数

[root@test1 cdrom]# curl -XGET 'http://10.87.7.190:9200/_cat/indices?v&pretty'

health status index uuid                   pri rep docs.count docs.deleted store.size pri.store.size

yellow open   test  r91GhsFVT7iF6M3iAuNEKg   2   5      19362            0      1.3mb        499.7kb

二、读取es的数据

#!/usr/bin/python

from kafka import KafkaProducer

import threading

import json

import time

from elasticsearch import Elasticsearch

from elasticsearch import helpers

import os

import sys

import argparse

import random

def get_data_from_es():

    host_list = [

        {"host": "10.58.55.1", "port": 9200},

        {"host": "10.58.55.2", "port": 9200},

        {"host": "10.58.55.7", "port": 9200},

        # {"host": "10.58.55.201", "port": 9200},

        # {"host": "10.58.55.202", "port": 9200},

        # {"host": "10.58.55.203", "port": 9200},

    ]

    es = Elasticsearch(host_list)

    err_data_num = 0

    correct_data_num = 0

    size = 100

    query = es.search(index='full_sight', scroll='1m', size=size)

    for m in query['hits']['hits']:

        # print(m)

        d_id = m["_id"]

        if "LASTOPER" in m["_source"].keys():

        # if "UPDATE_TEST" in m["_source"].keys():

            if m["_source"]["LASTOPER"] == "" + str(d_id):

                correct_data_num += 1

            else:

                err_data_num += 1

        else:

            err_data_num += 1

            # print("id为{d_id}数据未更新成功,错误的条数为{num}".format(d_id=d_id, num=err_data_num))

    results = query['hits']['hits']

    total = query['hits']['total']

    scroll_id = query['_scroll_id']

    page = divmod(total, size)

    if page[1] == 0:

        page = page[0]

    else:

        page = page[0] + 1

    for i in range(0, page):

        try:

            query_scroll = es.scroll(scroll_id=scroll_id, scroll='1m', )['hits']['hits']

        except Exception as e:

            continue

        else:

            for m in query_scroll:

                d_id = m.get("_id",None)

                if "LASTOPER" in m["_source"].keys():

                    if m["_source"]["LASTOPER"] == "test" + str(d_id):

                        correct_data_num += 1

                    else:

                        err_data_num += 1

                else:

                    err_data_num += 1

    return err_data_num,correct_data_num

if __name__ == '__main__':

    while True:

        error,correct = get_data_from_es()

        print("未更新的数据的条数为：{num}".format(num = error))

        print("已更新的数据的条数为：{num}".format(num = correct))

        print("=" * 200)

        if int(error) == 0:

            break

        else:

            continue

python批量插入数据到es和读取es数据的更多相关文章

Python批量插入SQL Server数据库
因为要做性能测试,需要大量造数据到数据库中,于是用python写了点代码去实现,批量插入,一共四张表简单粗暴地插入10万条数据 import pymssql import random __auth ...
python批量插入mysql数据库（性能相关）以及反引号的使用
参考link: https://blog.csdn.net/qq_35958094/article/details/78462800(插入相关) https://www.cnblogs.com/hya ...
机器学习之数据预处理，Pandas读取excel数据
Python读写excel的工具库很多,比如最耳熟能详的xlrd.xlwt,xlutils,openpyxl等.其中xlrd和xlwt库通常配合使用,一个用于读,一个用于写excel.xlutils结 ...
用python批量插入数据到数据库中
既然使用python操作数据库必不可少的得使用pymysql模块可使用两种方式进行下载安装: 1.使用pip方式下载安装 pip install pymysql 2.IDE方式安装完成后就可以正常 ...
Python 基于Python从mysql表读取千万数据实践
基于Python 从mysql表读取千万数据实践 by:授客 QQ:1033553122 场景: 有以下两个表,两者都有一个表字段,名为waybill_no,我们需要从tl_waybill_b ...
MSSQL数据的批量插入
一.概述: 对于数据的批量插入操作似乎成了某些大数据量操作的必用手段,MSSQL也提供了一些数据批量插入的操作方法,先将这些方法汇总,以便于下次用到使用.面对数据的批量插入操作,我们也应该考虑一个问题 ...
.Net批量插入数据
1. 一般我们普通数据插入是这样的: 现在我们写一个控制台程序用常规办法添加10000条数据. //以下是批量插入数据的办法 //连接字符串 string str = "Server=.;D ...
python MySQL 插入Elasticsearch
一.需求分析注意: 本环境使用 elasticsearch 7.0版本开发,切勿低于此版本 mysql 表结构有一张表,记录的数据特别的多,需要将7天前的记录,插入到Elasticsearch中, ...
Mybatis与JDBC批量插入MySQL数据库性能测试及解决方案
转自http://www.cnblogs.com/fnz0/p/5713102.html 不知道自己什么时候才有这种钻研精神- -. 1 背景系统中需要批量生成单据数据到数据库表,所以采用 ...

随机推荐

MySQL主从介绍、配置主从、测试主从同步
6月28日任务说明:有不少同学不能一次性把实验做成功,这是因为还不熟悉,建议至少做3遍17.1 MySQL主从介绍17.2 准备工作17.3 配置主17.4 配置从17.5 测试主从同步有的同学,遇 ...
一个null，差点把系统给弄崩溃了
今天生产上面发现了一个奇异的bug,URL上面会带上一个ID,这个ID是关联别的系统的,类似这种格式 xxx.xxx.xxx.xxx ,是别的系统自己填写的,我们的URL会带上id=xxx.xxx. ...
Delphi7 - Server Monitor开发并实现指定端口定时刷新、重启和邮件提醒等功能
项目背景近期,总经办邮件反馈考勤数据频繁丢失,请IT排查其根本原因,并提供整改措施. 措不及防,这个项目当初并不是IT主导的,是设备部采购,然后协同软件供应商直接安装.部署和调试的,IT只是提供几个 ...
小白学 Python 爬虫（16）：urllib 实战之爬取妹子图
人生苦短,我用 Python 前文传送门: 小白学 Python 爬虫(1):开篇小白学 Python 爬虫(2):前置准备(一)基本类库的安装小白学 Python 爬虫(3):前置准备(二)Li ...
Cisco 7200 路由 PPPOE 拨号详解
1.1配置虚拟拨号接口 R1(config)#vpdn enable #启用vpdn虚拟专用拨号网络 R1(config)#interface dialer 1 ...
luogu P1908 逆序对 |树状数组
题目描述猫猫TOM和小老鼠JERRY最近又较量上了,但是毕竟都是成年人,他们已经不喜欢再玩那种你追我赶的游戏,现在他们喜欢玩统计.最近,TOM老猫查阅到一个人类称之为"逆序对"的 ...
洛谷 Atcoder 题解 AT2585 【Colorful Leaderboard】
目测普及/提高- 难度. 思路将 9 种可能的等级存储在数组里,则 min 值为分数为 0 ~ 3199 的颜色种类个数,max 值为 min 值加上分数 >3200 的人数. 特判若分数 ...
cmake 简介
CMake是一个跨平台的安装(编译)工具,可以用简单的语句来描述所有平台的安装(编译过程).他能够输出各种各样的makefile或者project文件,能测试编译器所支持的C++特性,类似UNIX下的 ...
AddTransient、AddSingleton、AddScoped的区别
权重: AddSingleton→AddTransient→AddScoped AddSingleton的生命周期: 项目启动-项目关闭相当于静态类只会有一个 AddScoped的生命周期: ...
Selenium之勾选框操作
勾选框操作: 所谓勾选框,意思是可以勾选一个及以上或全部勾选.勾选框的图标一般都是方形的. 复选框勾选一般分为三种情况: ①勾选单个框,我们直接用元素定位的方式定位到点击即可. ②勾选多个 ...

python批量插入数据到es和读取es数据

一、插入数据

二、读取es的数据

python批量插入数据到es和读取es数据的更多相关文章

随机推荐

热门专题