1. QuorumPeerMain运行

1)判断是采用单实例模式还是多实例模式启动QuorumPeerMain

2)在多实例模式下,加载启动参数中指定的配置文件

3)启动QuorumPeer

public class QuorumPeerMain {
... protected QuorumPeer quorumPeer; public static void main(String[] args) {
QuorumPeerMain main = new QuorumPeerMain();
try {
main.initializeAndRun(args);
}
...
} protected void initializeAndRun(String[] args) throws ConfigException, IOException {
QuorumPeerConfig config = new QuorumPeerConfig();
if (args.length == 1) {
config.parse(args[0]);
}
// 启动data目录下的定时清理任务
...
// 启动参数中指定配置文件,且配置文件中指定为多实例
if (args.length == 1 && config.servers.size() > 0) {
runFromConfig(config); //
} else {
// 单实例模式启动
...
}
} public void runFromConfig(QuorumPeerConfig config) throws IOException {
...
try {
// 客户端连接工厂,默认NIOServerCnxnFactory
ServerCnxnFactory cnxnFactory =
ServerCnxnFactory.createFactory();
cnxnFactory.configure(config.getClientPortAddress(), config.getMaxClientCnxns());
quorumPeer = new QuorumPeer(config.getServers(),
new File(config.getDataDir()),
new File(config.getDataLogDir()),
config.getElectionAlg(), // 选举算法,默认FastLeaderElection(3)
config.getServerId(),
config.getTickTime(),
config.getInitLimit(),
config.getSyncLimit(),
config.getQuorumListenOnAllIPs(),
cnxnFactory,
config.getQuorumVerifier());
...
quorumPeer.setZKDatabase(new ZKDatabase(quorumPeer.getTxnFactory()));
...
quorumPeer.start(); // 启动当前实例
quorumPeer.join(); // 主线程等待quorumPeer线程执行
} catch (InterruptedException e) {
...
}
}
}

2. QuorumPeer启动

1)监听客户端连接

2)确认选举算法,监听选举端口

3)启动服务(run),开始选举

4 ) 成为Leader / Follower / Observer(后续介绍)

public class QuorumPeer extends ZooKeeperThread implements QuorumStats.Provider {
...
ServerCnxnFactory cnxnFactory; // NIOServerCnxnFactory
...
@Override
public synchronized void start() {
loadDataBase(); // 加载currentEpoch和acceptedEpoch
cnxnFactory.start(); // 监听客户端连接,NIOServerCnxnFactory.start
startLeaderElection(); // 确认选举算法,监听选举端口
super.start(); // 启动服务(run),开始选举
}
...
synchronized public void startLeaderElection() {
try {
// 当前投票投给自己
currentVote = new Vote(myid, getLastLoggedZxid(), getCurrentEpoch());
} catch(IOException e) {
...
}
...
// 确认选举算法,监听选举端口
this.electionAlg = createElectionAlgorithm(electionType);
}
...
protected Election createElectionAlgorithm(int electionAlgorithm){
Election le=null;
switch (electionAlgorithm) {
...
case 3:
qcm = createCnxnManager(); // QuorumCnxManager负责收发投票
QuorumCnxManager.Listener listener = qcm.listener;
if(listener != null){
listener.start(); // 启动ServerSocket监听选举端口
le = new FastLeaderElection(this, qcm);
}
...
break;
...
}
return le;
}
...
@Override
public void run() {
...
try {
while (running) {
switch (getPeerState()) {
case LOOKING:
if (Boolean.getBoolean("readonlymode.enabled")) {
// 启动ReadOnlyZooKeeperServer处理只读请求
...
} else {
try {
setBCVote(null);
// 开始选举,FastLeaderElection.lookForLeader
setCurrentVote(makeLEStrategy().lookForLeader());
}
...
}
break;
case OBSERVING:
try {
setObserver(makeObserver(logFactory)); // Observer
observer.observeLeader();
}
...
break;
case FOLLOWING:
try {
setFollower(makeFollower(logFactory)); // Follower
follower.followLeader();
}
...
break;
case LEADING:
try {
setLeader(makeLeader(logFactory)); // Leader
leader.lead();
setLeader(null);
}
...
break;
}
}
} finally {
...
}
}
}

3. 快速选举算法

1)广播推荐的Leader为自己,并接收其它ZK服务器的投票

2)选举进行中

  1' 若对方推荐的Leader > 自己推荐Leader,跟随对方投票并广播

  2' 更新票箱,判断对方投票是否过半,是则返回最终投票,否则选举继续

3)选举已经结束

  更新票箱,判断对方投票是否过半且为Leader,是则返回最终投票,否则选举继续

public class FastLeaderElection implements Election {
...
public FastLeaderElection(QuorumPeer self, QuorumCnxManager manager){
...
starter(self, manager);
}
private void starter(QuorumPeer self, QuorumCnxManager manager) {
...
sendqueue = new LinkedBlockingQueue<ToSend>(); // 待发送投票队列
recvqueue = new LinkedBlockingQueue<Notification>(); // 待接收投票队列
// 通过QuorumCnxManager往sendqueue添加投票,从recvqueue获取投票
this.messenger = new Messenger(manager);
}
...
public Vote lookForLeader() throws InterruptedException {
...
try {
HashMap<Long, Vote> recvset = new HashMap<Long, Vote>(); // 投票箱
// 如当前ZK服务器新加入到集群时,选举已经结束且当前选举轮数落后
HashMap<Long, Vote> outofelection = new HashMap<Long, Vote>();
...
synchronized(this){
logicalclock++; // 选举轮数 + 1
// 初始推荐Leader为自己,即初始投票投给自己
updateProposal(getInitId(), getInitLastLoggedZxid(), getPeerEpoch());
}
...
sendNotifications(); // 广播自己的投票
// 循环直至选举出Leader
while ((self.getPeerState() == ServerState.LOOKING) && (!stop)){
// 获取一个其它ZK服务器的投票(超时时间为200毫秒)
Notification n = recvqueue.poll(notTimeout, TimeUnit.MILLISECONDS);
if(n == null){
// 重新广播自己的投票,增加超时时间
...
}
else if(self.getVotingView().containsKey(n.sid)) {
switch (n.state) {
case LOOKING: // 选举进行中
if (n.electionEpoch > logicalclock) { // 当前选举轮数落后
logicalclock = n.electionEpoch; // 更新选举轮数
recvset.clear(); // 清空票箱
// 对方投票 > 当前投票(对方推荐的LeaderID > 自己推荐的LeaderID)
if(totalOrderPredicate(n.leader, n.zxid, n.peerEpoch, getInitId(), getInitLastLoggedZxid(), getPeerEpoch())) {
updateProposal(n.leader, n.zxid, n.peerEpoch); // 跟随对方投票
} else {
updateProposal(getInitId(), getInitLastLoggedZxid(), getPeerEpoch()); // 坚持当前投票
}
sendNotifications(); // 重新广播自己的投票
} else if (n.electionEpoch < logicalclock) { // 当前选举轮数领先
// 纪录日志,不做其它处理
...
break;
} else if (totalOrderPredicate(n.leader, n.zxid, n.peerEpoch, proposedLeader, proposedZxid, proposedEpoch)) {
updateProposal(n.leader, n.zxid, n.peerEpoch); // 跟随对方投票
sendNotifications(); // 重新广播自己的投票
}
...
// 更新票箱
recvset.put(n.sid, new Vote(n.leader, n.zxid, n.electionEpoch, n.peerEpoch));
// 票数过半
if (termPredicate(recvset, new Vote(proposedLeader, proposedZxid, logicalclock, proposedEpoch))) {
// 等待200ms接收投票
while((n = recvqueue.poll(finalizeWait, TimeUnit.MILLISECONDS)) != null) {
// 对方投票 > 当前投票,则选举继续
if(totalOrderPredicate(n.leader, n.zxid, n.peerEpoch, proposedLeader, proposedZxid, proposedEpoch)){
recvqueue.put(n);
break;
}
}
if (n == null) { // 200ms内未接收到新的投票
// 服务器状态由LOOKING转为LEADING/FOLLOWING/OBSERVING
self.setPeerState((proposedLeader == self.getId()) ? ServerState.LEADING: learningState());
// 确认和返回最终投票
Vote endVote = new Vote(proposedLeader, proposedZxid, logicalclock, proposedEpoch);
leaveInstance(endVote);
return endVote;
}
}
break;
case OBSERVING:
break;
case FOLLOWING:
case LEADING:
// 如当前ZK服务器新加入到集群时,选举已经结束
if(n.electionEpoch == logicalclock) { // ??为何选举轮数落后则使用outofelection
// 更新recvset票箱,并查找当前集群Leader
recvset.put(n.sid, new Vote(n.leader, n.zxid, n.electionEpoch, n.peerEpoch));
if(ooePredicate(recvset, outofelection, n)) {
self.setPeerState((n.leader == self.getId()) ? ServerState.LEADING: learningState());
Vote endVote = new Vote(n.leader, n.zxid, n.electionEpoch, n.peerEpoch);
leaveInstance(endVote);
return endVote;
}
}
// 更新outofelection票箱,并查找当前集群Leader
outofelection.put(n.sid, new Vote(n.version, n.leader, n.zxid, n.electionEpoch, n.peerEpoch, n.state));
if(ooePredicate(outofelection, outofelection, n)) {
synchronized(this){
logicalclock = n.electionEpoch;
self.setPeerState((n.leader == self.getId()) ? erverState.LEADING: learningState());
}
Vote endVote = new Vote(n.leader, n.zxid, n.electionEpoch, n.peerEpoch);
leaveInstance(endVote);
return endVote;
}
break;
...
}
}
...
}
return null;
}
...
}
}

Zookeeper启动和集群选举的更多相关文章

  1. zookeeper全局数据一致性及其典型应用(发布订阅、命名服务、帮助其他集群选举)

    ZooKeeper全局数据一致性: 全局数据一致:集群中每个服务器保存一份相同的数据副本,client 无论连接到哪个服务器,展示的数据都是一致的,这是最重要的特征. 那么zookeeper集群是怎样 ...

  2. Zookeeper(4)---ZK集群部署和选举

    一.集群部署 1.准备三台机器,安装好ZK.强烈建议奇数台机器,因为zookeeper 通过判断大多数节点的存活来判断整个服务是否可用.3个节点,挂掉了2个表示整个集群挂掉,而用偶数4个,挂掉了2个也 ...

  3. 备忘zookeeper(单机+伪集群+集群)

    #下载: #单机模式 解压到合适目录. 进入zookeeper目录下的conf子目录, 复制zoo_sample.cfg-->zoo.cfg(如果没有data和logs就新建):tickTime ...

  4. HyperLedger Fabric基于zookeeper和kafka集群配置解析

    简述 在搭建HyperLedger Fabric环境的过程中,我们会用到一个configtx.yaml文件(可参考Hyperledger Fabric 1.0 从零开始(八)--Fabric多节点集群 ...

  5. zookeeper及kafka集群搭建

    zookeeper及kafka集群搭建 1.有关zookeeper的介绍可参考:http://www.cnblogs.com/wuxl360/p/5817471.html 2.zookeeper安装 ...

  6. Zookeeper简介与集群搭建【转】

    Zookeeper简介 Zookeeper是一个高效的分布式协调服务,可以提供配置信息管理.命名.分布式同步.集群管理.数据库切换等服务.它不适合用来存储大量信息,可以用来存储一些配置.发布与订阅等少 ...

  7. Zookeeper单机伪集群

    Zookeeper单机伪集群 1.配置 zookeeper下载地址:http://apache.mirrors.lucidnetworks.net/zookeeper/ 可以选择需要的版本,我下载的是 ...

  8. zookeeper 安装以及集群搭建

    安装环境: jdk1.7 zookeeper-3.4.10.tar.gz VM虚拟机redhat6.5-x64:192.168.1.200  192.168.1.201  192.168.1.202 ...

  9. zookeeper 高可用集群搭建

    前言 记录Zookeeper集群搭建的过程! 什么是 Zookeeper ? ZooKeeper是一个分布式的,开放源码的分布式应用程序协调服务,是Google的Chubby一个开源的实现,是Hado ...

随机推荐

  1. git创建新分支推送到远程

    1.创建本地分支 git branch 分支名,例如:git branch 2.0.1.20120806 注:2.0.1.20120806是分支名称,可以随便定义.   2.切换本地分支 git ch ...

  2. WebStorm 2016激活

    最近在网上找到一个激活webStorm 的好东西.博主说对jetbrains下的所有产品都是可以用这种方式激活的...如:PhpStorm,IntelliJ JDEA等. 但别的产品我没有试过.对于w ...

  3. THINKPHP简单商品查询项目

    代码:http://files.cnblogs.com/files/wordblog/test.zip

  4. AUC画图与计算

    利用sklearn画AUC曲线 from sklearn.metrics import roc_curve labels=[1,1,0,0,1] preds=[0.8,0.7,0.3,0.6,0.5] ...

  5. Hive ORC表的使用

    创建普通临时表: create table if not exists test_orc_tmp(   name string,   gender string,   cnt BIGINT )row ...

  6. Git和Github简单教程【转】

    转自:https://www.cnblogs.com/schaepher/p/5561193.html#clone 原文链接:Git和Github简单教程 网络上关于Git和GitHub的教程不少,但 ...

  7. 如何在Linux下用C/C++语言操作数据库sqlite3(很不错!设计编译链接等很多问题!)

    from : http://blog.chinaunix.NET/uid-21556133-id-118208.html 安装Sqlite3: 从www.sqlite.org上下载Sqlite3.2. ...

  8. 解决su – 后显示-bash-4.1#

    <1>现象 设置tfs的管理用户时. su - admin时,出现 -bash-4.1# <2>解决 chown  admin:admin /home/admin        ...

  9. 打开exls表格时报‘向程序发送命令是出现问题’的错误的解决方法

    1.问题现象 打开表格文件时系统报如下错误 2.解决方法 1)按照如下方法找到excel选项,点击进入 2)找到‘忽略使用动态数据交换(DDE)的其它应用程序(O)',去掉复选框种的勾,点击确定,重新 ...

  10. 【转载】python-协程

    转载自:廖雪峰的官方网站 协程,又称微线程,纤程.英文名Coroutine. 协程的概念很早就提出来了,但直到最近几年才在某些语言(如Lua)中得到广泛应用. 子程序,或者称为函数,在所有语言中都是层 ...