redis迁移第三篇(cluster forget)

1、删除错误节点,带有 fail,noaddr , 这种需要用 cluster forget

redis集群迁移之后，由于之前的误操作，导致pod日志里面出现这样的错误，出现一会好一会不好的情况，就是由于这个错误节点导致
[uts-node-0] [12:22:48:102] [ERROR] - org.redisson.client.handler.CommandDecoder.decode(CommandDecoder.java:113) - Unable to decode data. channel: [id: 0x2770e76d, L:/172.17.246.215:45564 - R:/10.129.51.30:7733] message: $879

f0e5d3d17babbce85a9290e679a626bc0bbacc93 10.129.51.30:7735@17735 slave 91b7f8c79c91c7edd77458c332f0b9299bdb94d4 0 1646366975000 63 connected

91b7f8c79c91c7edd77458c332f0b9299bdb94d4 10.129.51.30:7732@17732 master - 0 1646366976611 63 connected 5461-10922

c3c7ba2d0709121e69c2881724a0c5be903a4a6a 10.129.51.30:7736@17736 slave d1c7d99e13a2d7317baf883dffa906470a606641 0 1646366975000 62 connected

d1c7d99e13a2d7317baf883dffa906470a606641 10.129.51.30:7733@17733 myself,master - 0 1646366969000 62 connected 10923-16383

27f7e8dede5b68581486ce8cefdd656032baed70 :0@0 master,fail,noaddr - 1646366063257 1646366063257 4 disconnected

421ccd9a53168359272b733869fcb8ad827aa655 10.129.51.30:7734@17734 slave d46f032ea50763de8353fd530535412df6ffdc00 0 1646366976000 60 connected

d46f032ea50763de8353fd530535412df6ffdc00 10.129.51.30:7731@17731 master - 0 1646366977611 60 connected 0-5460

红色的一条就是我之前在迁移中失误操作造成的

pod启动后还会报错信息为：

java.lang.IllegalArgumentException: Illegal character in scheme name at index 0: []r[]e[]d[]i[]s[]:[]/[]/[]:[]0[]

红色的一条节点信息，是由于之前redis失误命令为：

[root@ht20 redis]#./redis-trib.rb del-node 10.129.51.30:7735 10.129.51.30

正确命令应该为：后面是 node_id
[root@ht20 redis]#./redis-trib.rb del-node 10.129.51.30:7735 10.129.51.30 32ee19af1f6a534c4014b9c41d387666f049354b

2、cluster forget命令操作,中间影响信息的部分处理掉了。

[root@ht20 data]# vi /data/redis_fpmai1/redis/data/nodes.conf   //查看master1的集群配置文件

d46f032ea50763de8353fd530535412df6ffdc00 10.129.51.30:7731@17731 slave

c3c7ba2d0709121e69c2881724a0c5be903a4a6a 10.129.51.30:7736@17736 slave

91b7f8c79c91c7edd77458c332f0b9299bdb94d4 10.129.51.30:7732@17732 myself,master -  5461-10922

d1c7d99e13a2d7317baf883dffa906470a606641 10.129.51.30:7733@17733 master -  10923-16383

27f7e8dede5b68581486ce8cefdd656032baed70 :0@0 master,fail,noaddr - 1646368054015 1646368054015 4 disconnected

421ccd9a53168359272b733869fcb8ad827aa655 10.129.51.30:7734@17734 master -  0-5460

f0e5d3d17babbce85a9290e679a626bc0bbacc93 10.129.51.30:7735@17735 slave

vars currentEpoch 64 lastVoteEpoch 64

[root@ht20 redis]# ./redis-cli -c -h 10.129.51.30 -p 7732 cluster forget 27f7e8dede5b68581486ce8cefdd656032baed70

OK

[root@ht20 data]# vi /data/redis_fpmai2/redis/data/nodes.conf   //查看master2的集群配置文件

c3c7ba2d0709121e69c2881724a0c5be903a4a6a 10.129.51.30:7736@17736 slave

421ccd9a53168359272b733869fcb8ad827aa655 10.129.51.30:7734@17734 master  0-5460

f0e5d3d17babbce85a9290e679a626bc0bbacc93 10.129.51.30:7735@17735 slave

d46f032ea50763de8353fd530535412df6ffdc00 10.129.51.30:7731@17731 slave

91b7f8c79c91c7edd77458c332f0b9299bdb94d4 10.129.51.30:7732@17732 myself,master  5461-10922

d1c7d99e13a2d7317baf883dffa906470a606641 10.129.51.30:7733@17733 master  10923-16383

vars currentEpoch 64 lastVoteEpoch 64

###就会发现没有这一条了   27f7e8dede5b68581486ce8cefdd656032baed70 :0@0 master,fail,noaddr - 1646368054015 1646368054015 4 disconnected

1、注意cluster forget 只针对当前的主和当前的从起作用。

2、我依次处理掉其他master ，一共3个master

//对三个master都要进行处理,否则会有残留信息。

[root@ht20 redis]# ./redis-cli -c -h 10.129.51.30 -p 7733 cluster forget 27f7e8dede5b68581486ce8cefdd656032baed70

OK

[root@ht20 redis]# ./redis-cli -c -h 10.129.51.30 -p 7732 cluster forget 27f7e8dede5b68581486ce8cefdd656032baed70

OK

[root@ht20 redis]# ./redis-cli -c -h 10.129.51.30 -p 7733 cluster forget 27f7e8dede5b68581486ce8cefdd656032baed70

OK

3、程序执行正常，但是会出现 No reachable node in cluster（这个意思很怪异，如果你刚接触redis，会蒙的，怎么会是不能到达节点，集群中的）
经过多方查找这个错误，最终确定是由于在程序中jredis没有改配置中心的配置文件的ip信息，开发人员只修改了redisson即连接池的信息，
但是没有修改jredis的ip端口信息导致jredis连接不上redis集群，报错为： No reachable node in cluster 详细说下排查过程
我们配置中心采用config-->eureka-->应用-->redis集群

[root@master-web-38 src]# kubectl exec -ti us-node-0 -- /bin/bash //进入master ping 外网也没有问题

[root@uts-node-0:/# kubectl cp us-node-0:/app.jar /usr/local/src //把程序包app.jar下载之后,改成app.zip，查看里面内容
里面lib下的java jar包进行破解，利用工具为 http://java-decompiler.github.io/#jd-gui-download
破解lib包里面的redission-redisson-3.6.5.jar和spring-data-redis-2.0.6.RELEASE.jar后跟踪到提示信息。

说明如下
1、程序端采用了redission连接池和spring支持的jredis客户端
2、redisson-3.6.5.jar //java客户端连接池,检查没有问题。
3、spring-data-redis-2.0.6.RELEASE.jar //客户端的jredis支持。

最终跟踪pod日志报错，发现提示set错误，跟踪连接池一直到jredis显示报错

public Jedis getConnection() {
List<JedisPool> pools = this.cache.getShuffledNodesPool();
for (JedisPool pool : pools) {
Jedis jedis = null;
try {
jedis = pool.getResource();
if (jedis == null)
continue;
String result = jedis.ping();
if (result.equalsIgnoreCase("pong"))
return jedis;
jedis.close();
} catch (JedisException ex) {
if (jedis != null)
jedis.close();
}
}
throw new JedisNoReachableClusterNodeException("No reachable node in cluster");
//查到这里基本问题就确定了，明显是连接jredis连接不上，从而确定问题来自 jredis，访问集群问题.
}

//这里jredis用了集群的ping命令

登录集群服务器客户端，执行ping,演示下jredis的机制。

[root@ht20 redis]# ./redis-cli -c -h 10.129.51.30 -p 7733
10.129.51.30:7733> ping
PONG

附日志错误

org.springframework.data.redis.RedisConnectionFailureException: No reachable node in cluster; nested exception is

 redis.clients.jedis.exceptions.JedisNoReachableClusterNodeException: No reachable node in cluster

    at org.apache.tomcat.util.threads.TaskThread$WrappingRunnable.run(TaskThread.java:61)

    at java.lang.Thread.run(Thread.java:745)

Caused by: redis.clients.jedis.exceptions.JedisNoReachableClusterNodeException: No reachable node in cluster

    at redis.clients.jedis.BinaryJedisCluster.set(BinaryJedisCluster.java:77)

    at org.springframework.data.redis.connection.jedis.JedisClusterStringCommands.set(JedisClusterStringCommands.java:113)

    ... 80 more

org.springframework.data.redis.RedisConnectionFailureException: No reachable node in cluster; nested exception

is redis.clients.jedis.exceptions.JedisNoReachableClusterNodeException: No reachable node in cluster

    at org.springframework.data.redis.connection.jedis.JedisExceptionConverter.convert(JedisExceptionConverter.java:67)

    at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:617)

    at org.apache.tomcat.util.threads.TaskThread$WrappingRunnable.run(TaskThread.java:61)

    at java.lang.Thread.run(Thread.java:745)

Caused by: redis.clients.jedis.exceptions.JedisNoReachableClusterNodeException: No reachable node in cluster

    at redis.clients.jedis.JedisSlotBasedConnectionHandler.getConnection(JedisSlotBasedConnectionHandler.java:57)

    at org.springframework.data.redis.connection.jedis.JedisClusterStringCommands.set(JedisClusterStringCommands.java:113)

    ... 80 more

org.springframework.data.redis.RedisConnectionFailureException: No reachable node in cluster; nested exception is 
redis.clients.jedis.exceptions.JedisNoReachableClusterNodeException: No reachable node in cluster

    at org.springframework.data.redis.connection.jedis.JedisExceptionConverter.convert(JedisExceptionConverter.java:67)

    at org.springframework.data.redis.connection.jedis.JedisExceptionConverter.convert(JedisExceptionConverter.java:41)

    at org.springframework.data.redis.PassThroughExceptionTranslationStrategy.translate(PassThroughExceptionTranslationStrategy.java:44)

redis迁移第三篇(cluster forget)的更多相关文章

redis介绍（8） window 下redis的集群（cluster命令）
前言: 前段时间我在centos上搭建过一次redis集群,那是借助ruby搭建,这次我介绍一种纯redis集群命令的方式去搭建[最后我会简单介绍ruby搭建]. redis集群搭建(三主三备): 准 ...
redis集群在线迁移第二篇（redis迁移后调整主从关系，停掉14机器上的所有从节点）-实战二
变更需求为: 1.调整主从关系,所有节点都调整到10.129.51.30机器上 2.停掉10.128.51.14上的所有redis,14机器关机 14机器下线迁移至新机房,这段时间将不能提供服务. 当 ...
【进阶之路】Redis基础知识两篇就满足（二）
导言大家好,我是南橘,一名练习时常两年半的java练习生,这是我在博客园的第二篇文章,当然,都是要从别处搬运过来的,不过以后新的文章也会在博客园同步发布,希望大家能多多支持^_^ 这篇文章的出现,首 ...
redis —主从&&集群（CLUSTER）
REDIS主从配置为了节省资源,本实验在一台机器进行.即,在一台机器上启动两个端口,模拟两台机器. 机器准备: [root@adailinux ~]# cp /etc/redis.conf /etc ...
SpringCloud核心教程 | 第三篇：服务注册与发现 Eureka篇
Spring Cloud简介 Spring Cloud是一个基于Spring Boot实现的云应用开发工具,它为基于JVM的云应用开发中涉及的配置管理.服务发现.断路器.智能路由.微代理.控制总线.全 ...
支撑微博亿级社交平台，小白也能玩转Redis集群(实战篇)
上篇文章<支撑微博亿级社交平台,小白也能玩转Redis集群(原理篇)>介绍了Redis集群相关原理,这篇文章将介绍Redis Cluster集群的搭建.配置,运维.扩容等具体操作集群搭建 ...
【进阶之路】Redis基础知识两篇就满足（一）
导言大家好,我是南橘,一名练习时常两年半的java练习生,这是我在博客园的第一篇文章,当然,都是要从别处搬运过来的,不过以后新的文章也会在博客园同步发布,希望大家能多多支持^_^ 这篇文章的出现,首 ...
从0开始搭建SQL Server AlwaysOn 第三篇（配置AlwaysOn）
从0开始搭建SQL Server AlwaysOn 第三篇(配置AlwaysOn) 第一篇http://www.cnblogs.com/lyhabc/p/4678330.html第二篇http://w ...
二、Redis基本操作——String(实战篇)
小喵万万没想到,上一篇博客,居然已经被阅读600次了!!!让小喵感觉压力颇大.万一有写错的地方,岂不是会误导很多筒子们.所以,恳请大家,如果看到小喵的博客有什么不对的地方,请尽快指正!谢谢! 小喵的唠 ...

随机推荐

LGP3790题解
建议改为省选原题题意:求所有生成树的边权 \(\gcd\) 之和. 看到 \(\gcd\) 立刻想反演. \[\sum_T\gcd_{e \in T}e_v \] 这里设 \(E=e_v(e ...
前端性能优化 —— 使用 BMP 图片代替 canvas.toDataURL
前端开发中有时需要将 canvas 的内容导出成图片文件,例如供 CSS 使用,通常会使用 canvas.toDataURL,兼容性好并且简单. 不过 canvas.toDataURL 显然是非常低效 ...
vue3-异步组件的使用
我们通常会在实际开发中,将项目进行分包处理,以此加快项目的速度即使用异步组件 //异步组件,分包处理 import {defineAsyncComponent} from "vue&quo ...
IDW插值得到降水量分布图
4 具体思路 4.1 加载数据 (1)点击[添加数据],选择"中国地面气候资料国际交换站数据集台站信息.csv"."省份.shp"和"2011年中国地 ...
a{...}和 .box a{...}的渲染性能高低
a{...}和 .box a{...}的渲染性能高低 .box a { ... } a{ ... } 因为对于CSS浏览器的渲染机制是选择器从右向左查询 .box a {...} 的渲染逻辑是:先找所 ...
【Mybatis】SQL语句的解析执行过程原理
sqlSession简单介绍拿到SqlSessionFactory对象后,会调用SqlSessionFactory的openSesison方法,这个方法会创建一个Sql执行器(Executor),这 ...
Dubbo 的整体架构设计有哪些分层?
接口服务层(Service):该层与业务逻辑相关,根据 provider 和 consumer 的业务设计对应的接口和实现配置层(Config):对外配置接口,以 ServiceConfig 和 ...
什么是feigin？它的优点是什么？
1.feign采用的是基于接口的注解2.feign整合了ribbon,具有负载均衡的能力3.整合了Hystrix,具有熔断的能力使用:1.添加pom依赖.2.启动类添加@EnableFeignClie ...
springcloud断路器的作用?
当一个服务调用另一个服务由于网络原因或自身原因出现问题,调用者就会等待被调用者的响应当更多的服务请求到这些资源导致更多的请求等待,发生连锁效应(雪崩效应) 断路器有完全打开状态:一段时间内达到一定 ...
C# winform自己的窗体不抢夺其他窗体的光标
在你的form里加入: protected override CreateParams CreateParams { get { var result = base.CreateParams; ; r ...

redis迁移第三篇(cluster forget)

redis迁移第三篇(cluster forget)的更多相关文章

随机推荐

热门专题