Storm 集群

　　Apache Storm
Storm是一个分布式的，可靠的，容错的数据流处理系统。Storm集群的输入流由一个被称作spout的组件管理，spout把数据传递给bolt，bolt要么把数据保存到某种存储器，要么把数据传递给其它的bolt。一个Storm集群就是在一连串的bolt之间转换spout传过来的数据。

1、Storm组件：
在Storm集群中、有两类节点：主节点master node和工作节点worker nodes。

主节点运行Nimbus守护进程，这个守护进程负责在集群中分发代码，为工作节点分配任务，并监控故障。Supervisor守护进程作为拓扑的一部分运行在工作节点上。

一个Storm拓扑结构在不同的机器上运行着众多的工作节点。每个工作节点都是topology中一个子集的实现。而Nimbus和Supervisor之间的协调则通过Zookeeper系统或者集群。

2、Zookeeper：
Zookeeper是完成Supervisor和Nimbus之间协调的服务。

而应用程序实现实时的逻辑则被封装进Storm中的“topology”。topology则是一组由Spouts（数据源）和Bolts（数据操作）通过Stream Groupings进行连接的图。

3、Spout：
Spout从来源处读取数据并放入topology。

Spout分成可靠和不可靠两种；当Storm接收失败时，可靠的Spout会对tuple（元组，数据项组成的列表）进行重发；而不可靠的Spout不会考虑接收成功与否只发射一次。而Spout中最主要的方法就是nextTuple（），该方法会发射一个新的tuple到topology，如果没有新tuple发射则会简单的返回。

4、Bolt：
Topology中所有的处理都由Bolt完成。Bolt从Spout中接收数据并进行处理，如果遇到复杂流的处理也可能将tuple发送给另一个Bolt进行处理。而Bolt中最重要的方法是execute（），以新的tuple作为参数接收。不管是Spout还是Bolt，如果将tuple发射成多个流，这些流都可以通过declareStream（）来声明。

5、Stream Groupings
Stream Grouping定义了一个流在Bolt任务中如何被切分。

Shuffle grouping：

//  随机分发tuple到Bolt的任务，保证每个任务获得相等数量的tuple。

Fields grouping

//  根据指定字段分割数据流，并分组。例如，根据“user-id”字段，相同“user-id”的元组总是分发到同一个任务，不同“user-id”的元组可能分发到不同的任务。

Partial Key grouping

//  根据指定字段分割数据流，并分组。类似Fields grouping。

All grouping

//  tuple被复制到bolt的所有任务。这种类型需要谨慎使用。

Global grouping

//  全部流都分配到bolt的同一个任务。明确地说，是分配给ID最小的那个task。

None grouping

//  无需关心流是如何分组。目前，无分组等效于随机分组。但最终，Storm将把无分组的Bolts放到Bolts或Spouts订阅它们的同一线程去执行（如果可能）。

Direct grouping

//  这是一个特别的分组类型。元组生产者决定tuple由哪个元组处理者任务接收。

Local or shuffle grouping

//  如果目标bolt有一个或多个任务在同一工作进程，tuples 会打乱这些进程内的任务。否则,这就像一个正常的 Shuffle grouping。

　　Apache-strom 必须要求Python 2.6以上
　　1、升级 Python 官方下载地址：
https://www.python.org/ftp/python/

wget http://www.python.org/ftp/python/2.7.6/Python-2.7.6.tgz

wget https://www.python.org/ftp/python/3.6.0/Python-3.6.0.tgz

# tar -xf Python-3.6..tgz

# mv Python-3.6. /usr/local/python

# cd /usr/local/python

# ./configure --prefix=/usr/local/python

# make

# make install

# mv /usr/bin/python /usr/bin/python_old

# ln -s /usr/local/python/bin/python3. /usr/bin/python

# python -V

2、如发现yum 异常则, 查看编辑 /usr/bin/yum 文件

将文件头部的

#!/usr/bin/python

改为以下:（因为系统默认是2.6）

#!/usr/bin/python2.6

三、storm 安集群配置；(具体根据线上环境资源进行设置)

系统：Centos6.

内核：2.6.-.el6.x86_64

安装目录：/opt/storm

数据日志目录：/opt/storm/{data,logs}

用户组权限：deploy

机器 hostname 需要在 hosts 里面配置关系映射:

zks1 - 192.168.1.101

zks2 - 192.168.1.102
zks3 - 192.168.1.103

zoo1 - 192.168.1.101 - myid1

zoo2 - 192.168.1.102 - myid2
zoo3 - 192.168.1.103 - myid2

四、集群说明

主节点 (nimbus) zks1
任务节点 (supervisor) zks2 zks3 等
注：storm主节点、任务节点安装配置完全一致。

1、下载安装配置：官方下载地址：
http://mirrors.hust.edu.cn/apache/storm/

http://www-eu.apache.org/dist/storm/apache-storm-1.0.3/apache-storm-1.0.3.tar.gz

http://mirrors.hust.edu.cn/apache/storm/apache-storm-1.0.2/apache-storm-1.0.2.tar.gz

# tar -xf apache-storm-1.0..tar.gz

# cd apache-storm

# cat apache-storm-0.9./conf/storm.yaml |grep -v ^# |grep -v ^$

// ********** //
storm.zookeeper.servers:

- "192.168.1.101"

- "192.168.1.102"

- "192.168.1.103"

nimbus.host: "192.168.1.101"

storm.zookeeper.port:

ui.port:

storm.local.dir: "/opt/apache-storm-0.9.6/data"

supervisor.slots.ports:

-

-

-

-

-

worker.childopts: "-Xmx2g"
# worker.heap.memory.mb: 2048
# // 调整分配给每个 worker 的内存 //

logviewer.port:

topology.max.spout.pending:

topology.message.timeout.secs:

storm.messaging.netty.server_worker_threads: 10
// **********　//

2、主节点启动测验：

启动 nimbus

# nohup ./bin/storm nimbus >/dev/null 2>&1 &

启动 UI

# nohup ./bin/storm ui >/dev/null 2>&1 &

3、任务节点启动脚步

# cat supervisor_logviewer.sh

nohup ./bin/storm supervisor >/dev/null >& &

nohup ./bin/storm logviewer >/dev/null >& &

4、进程检测

# ps -ef|grep storm

# netstat -ano |grep 8090

Storm 集群的更多相关文章

storm 集群配置
配置storm集群的过程中出现写问题,记录下来 1.storm是通过zookeeper管理的,先要安装zookeeper,从zk官网上下来,我这里下下来的的3.4.9,下载后移动到/usr/local ...
storm集群部署和配置过程详解
先整体介绍一下搭建storm集群的步骤: 设置zookeeper集群安装依赖到所有nimbus和worker节点下载并解压storm发布版本到所有nimbus和worker节点配置storm ...
在CentOS上搭建Storm集群
Here's a summary of the steps for setting up a Storm cluster: Set up a Zookeeper clusterInstall depe ...
Storm系列（三）：创建Maven项目打包提交wordcount到Storm集群
在上一篇博客中,我们通过Storm.Net.Adapter创建了一个使用Csharp编写的Storm Topology - wordcount.本文将介绍如何编写Java端的程序以及如何发布到测试的S ...
Storm集群安装部署步骤【详细版】
作者: 大圆那些事 | 文章可以转载,请以超链接形式标明文章原始出处和作者信息网址: http://www.cnblogs.com/panfeng412/archive/2012/11/30/how ...
Storm集群的安装配置
Storm集群的安装分为以下几步: 1.首先保证Zookeeper集群服务的正常运行以及必要组件的正确安装 2.释放压缩包 3.修改storm.yaml添加集群配置信息 4.使用storm脚本启动相应 ...
Storm集群部署
一. 说明 Storm是一个分布式实时计算系统,Storm对于实时计算的意义就相当于Hadoop对于批量计算的意义.对于实时性较高的系统Storm是不错的选择.Hadoop提供了map, reduce ...
Storm集群的安装与测试
首先安装zookeeper集群,然后安装storm集群. 我使用的是centos 32bit的三台虚拟机. MachineName ip namenode 192.168.99.110 datanod ...
Storm集群安装详解
storm有两种操作模式: 本地模式和远程模式. 本地模式:你可以在你的本地机器上开发测试你的topology, 一切都在你的本地机器上模拟出来; 远端模式:你提交的topology会在一个集群的机器 ...
Storm入门教程第三章Storm集群安装部署步骤、storm开发环境
一. Storm集群组件 Storm集群中包含两类节点:主控节点(Master Node)和工作节点(Work Node).其分别对应的角色如下: 主控节点(Master Node)上运行一个被称为N ...

随机推荐

js history
後退:退到歷史列表的前一個url,和瀏覽器點擊後退按鈕功能相同 history.back() 前進:進入歷史列表的後面一個url,和瀏覽器的前進按鈕功能相同 history.forward()
ref、out与params
ref 把值传递转换为引用传递,侧重于将一个值带到函数中进行改变,再将改变后的值带出去,ref参数在函数外必须为ref参数赋值 ; AddSalary(ref salary); //如果不写ref,s ...
BZOJ3569 DZY Loves Chinese II（随机化+树上差分+线性基）
上一题的强制在线版.对图跑出一个dfs树,给非树边赋上随机权值,树边的权值为覆盖他的非树边权值的异或.这样如果某条树边和覆盖他的非树边都被割掉(即图不连通),他们的异或值就为0.每次对询问看有没有子集 ...
BZOJ5010 FJOI2017矩阵填数（容斥原理）
如果只考虑某个子矩阵的话,其最大值为v的方案数显然是vsize-(v-1)size.问题在于处理子矩阵间的交叉情况. 如果两个交叉的子矩阵所要求的最大值不同,可以直接把交叉部分划给所要求的最大值较小的 ...
day22 ramdom 模块
import random #随机整数 random.randint(1,5) # 大于等于1且小于等于5之间的整数 random.randrange(1,10,2) # 大于等于1且小于10之间的奇 ...
Python向来以慢著称，为啥Instagram却唯独钟爱它？
PyCon 是全世界最大的以 Python 编程语言为主题的技术大会,大会由 Python 社区组织,每年举办一次.在 Python 2017 上,Instagram 的工程师们带来了一个有关 Py ...
Oracle11g创建表空间
第1步:创建临时表空间 create temporary tablespace pgenius_temp tempfile '\data\oracle\oracledata\pgenius_tem ...
架构师成长之路6.6 DNS服务器搭建（构建企业级DNS）
点击返回架构师成长之路架构师成长之路6.6 DNS服务器搭建(构建企业级DNS) 采用LVS-DR模式负载均衡,多IDC,多套DNS集群,通过master-slave技术保证dns配置的一致性. 1 ...
Canvas与javaScript特效笔记
第六章 Canvas与javaScript特效笔记 q <canvas>标签的用途 HTML5 canvas 提供了通过 JavaScript 绘制图形的方法,此方法使用简单但功能强 ...
List does not exist. The page you selected contains a list that does not exist. It may have been deleted by another user
当我在subsite里点击"Add a document",报这个错,后来一看event log: 在AAM里加上一条: 问题搞定:

Storm 集群

Storm 集群的更多相关文章

随机推荐

热门专题