Storm实现单词计数

 package com.mengyao.storm;

 import java.io.File;

 import java.io.IOException;

 import java.util.Collection;

 import java.util.HashMap;

 import java.util.List;

 import java.util.Map;

 import java.util.Map.Entry;

 import org.apache.commons.io.FileUtils;

 import backtype.storm.Config;

 import backtype.storm.LocalCluster;

 import backtype.storm.StormSubmitter;

 import backtype.storm.generated.AlreadyAliveException;

 import backtype.storm.generated.InvalidTopologyException;

 import backtype.storm.spout.SpoutOutputCollector;

 import backtype.storm.task.OutputCollector;

 import backtype.storm.task.TopologyContext;

 import backtype.storm.topology.OutputFieldsDeclarer;

 import backtype.storm.topology.TopologyBuilder;

 import backtype.storm.topology.base.BaseRichBolt;

 import backtype.storm.topology.base.BaseRichSpout;

 import backtype.storm.tuple.Fields;

 import backtype.storm.tuple.Tuple;

 import backtype.storm.tuple.Values;

 import backtype.storm.utils.Utils;

 /**

  * Storm中的单词计数，拓扑结构为InputSpout->SplitBolt->CountBolt = WordCountTopology

  * @author mengyao

  *

  */

 @SuppressWarnings("all")

 public class WordCountTopology {

     public static class InputSpout extends BaseRichSpout{

         private Map conf;

         private TopologyContext context;

         private SpoutOutputCollector collector;

         /**

          * 实例化该Spout时预处理，仅会被调用一次，类似于MapReduce中Mapper/Reducer的setup()方法

          */

         @Override

         public void open(Map conf, TopologyContext context,

                 SpoutOutputCollector collector) {

             this.conf = conf;

             this.context = context;

             this.collector = collector;

         }

         /**

          * 死循环发射每行消息

          */

         @Override

         public void nextTuple() {

             Collection<File> listFiles = FileUtils.listFiles(new File("D:/"), new String[]{"log"}, false);

             for (File file : listFiles) {

                 try {

                     List<String> lines = FileUtils.readLines(file);

                     for (String line : lines) {

                         this.collector.emit(new Values(line));

                         System.err.println("==== InputSpout："+line+" ====");

                     }

                     FileUtils.moveFile(file, new File(file.getAbsoluteFile()+".tmp"));

                 } catch (IOException e) {

                     e.printStackTrace();

                     throw new RuntimeException(e);

                 }

             }

         }

         /**

          * 声明字段“line”提供给下一个Bolt组件订阅

          */

         @Override

         public void declareOutputFields(OutputFieldsDeclarer declarer) {

             declarer.declare(new Fields("line"));

         }

     }

     public static class SplitBolt extends BaseRichBolt{

         private Map stormConf;

         private TopologyContext context;

         private OutputCollector collector;

         /**

          * 实例化该Bolt时预处理，仅会被调用一次，类似于MapReduce中Mapper/Reducer的setup()方法

          */

         @Override

         public void prepare(Map stormConf, TopologyContext context,

                 OutputCollector collector) {

             this.stormConf = stormConf;

             this.context = context;

             this.collector = collector;

         }

         /**

          * 死循环发送每个单词

          */

         @Override

         public void execute(Tuple input) {

             String line = input.getStringByField("line");

             String[] words = line.split("\t");

             for (String word : words) {

                 this.collector.emit(new Values(word));

                 System.err.println("==== SplitBolt:"+word+" ====");

             }

         }

         /**

          * 声明字段“word”提供给下一个Bolt组件订阅

          */

         @Override

         public void declareOutputFields(OutputFieldsDeclarer declarer) {

             declarer.declare(new Fields("word"));

         }

     }

     public static class CountBolt extends BaseRichBolt{

         private Map stormConf;

         private TopologyContext context;

         private OutputCollector collector;

         HashMap<String, Long> map = new HashMap<String, Long>();

         /**

          * 实例化该Bolt时预处理，仅会被调用一次，类似于MapReduce中Mapper/Reducer的setup()方法

          */

         @Override

         public void prepare(Map stormConf, TopologyContext context,

                 OutputCollector collector) {

             this.stormConf = stormConf;

             this.context = context;

             this.collector = collector;

         }

         @Override

         public void execute(Tuple input) {

             String word = input.getStringByField("word");

             Long value = map.get(word);

             if (value==null) {

                 value=0L;

             }

             value++;

             map.put(word, value);

             for (Entry<String, Long> entry : map.entrySet()) {

                 System.err.println("==== CountBolt:"+entry+" ====");

             }

         }

         @Override

         public void declareOutputFields(OutputFieldsDeclarer declarer) {

         }

     }

     public static void main(String[] args) throws AlreadyAliveException, InvalidTopologyException {

         String topologyName = WordCountTopology.class.getSimpleName();

         TopologyBuilder builder = new TopologyBuilder();

         builder.setSpout("input", new InputSpout());

         builder.setBolt("split", new SplitBolt()).shuffleGrouping("input");

         builder.setBolt("count", new CountBolt()).shuffleGrouping("split");

         Config config = new Config();

         config.setDebug(true);

         if (args!=null && args.length>0) {        //如果是生产环境中使用集群模式提交拓扑

             config.setNumWorkers(3);

             StormSubmitter.submitTopology(topologyName, config, builder.createTopology());

         } else {                                　　　　  //否则使用本地模式提交拓扑

             LocalCluster cluster = new LocalCluster();

             cluster.submitTopology(topologyName, config, builder.createTopology());

             Utils.sleep(1000*100);

             cluster.killTopology(topologyName);

             cluster.shutdown();

         }

     }

 }

 依赖的jar包如下图：

Storm实现单词计数的更多相关文章

大数据学习——Storm学习单词计数案例
需求:计算单词在文档中出现的次数,每出现一次就累加一次遇到的问题这个问题是<scope>provided</scope>作用域问题 https://www.cnblogs. ...
storm（5）-分布式单词计数例子
例子需求: spout:向后端发送{"sentence":"my dog has fleas"}.一般要连数据源,此处简化写死了. 语句分割bolt(Split ...
【Storm】storm安装、配置、使用以及Storm单词计数程序的实例分析
前言:阅读笔记 storm和hadoop集群非常像.hadoop执行mr.storm执行topologies. mr和topologies最关键的不同点是:mr执行终于会结束,而topologies永 ...
Storm实现单词统计代码
import java.io.File; import java.io.IOException; import java.util.Collection; import java.util.HashM ...
使用Scala实现Java项目的单词计数：串行及Actor版本
其实我想找一门“具有Python的简洁写法和融合Java平台的优势, 同时又足够有挑战性和灵活性”的编程语言. Scala 就是一个不错的选择. Scala 有很多语言特性, 建议先掌握基础常用的: ...
MapReduce之单词计数
最近在看google那篇经典的MapReduce论文,中文版可以参考孟岩推荐的 mapreduce 中文版中文翻译论文中提到,MapReduce的编程模型就是: 计算利用一个输入key/value ...
自定义实现InputFormat、OutputFormat、输出到多个文件目录中去、hadoop1.x api写单词计数的例子、运行时接收命令行参数，代码例子
一:自定义实现InputFormat *数据源来自于内存 *1.InputFormat是用于处理各种数据源的,下面是实现InputFormat,数据源是来自于内存. *1.1 在程序的job.setI ...
hadoop笔记之MapReduce的应用案例(WordCount单词计数)
MapReduce的应用案例(WordCount单词计数) MapReduce的应用案例(WordCount单词计数) 1. WordCount单词计数作用: 计算文件中出现每个单词的频数输入结果 ...
第一章 flex单词计数程序
学习Flex&Bison目标, 读懂SQLite中SQL解析部分代码 Flex&Bison简介Flex做词法分析Bison做语法分析第一个Flex程序, wc.fl, 单词计数程序 ...

随机推荐

MySQL创建新用户、增加账户的2种方法及使用实例
可以用两种方式创建MySQL账户:1.使用GRANT语句2.直接操作MySQL授权表最好的方法是使用GRANT语句,因为这样更精确,错误少.创建超级用户: mysql> GRANT ALL PR ...
Java基础知识强化29：String类之String类构造方法
1. 常用String构造方法使用: package cn.itcast_01; /* * 字符串:就是由多个字符组成的一串数据.也可以看成是一个字符数组. * 通过查看API,我们可以知道 * A: ...
RHEL7和RHEL6的主要变化
RHEL7和RHEL6的主要变化 RHEL7 RHEL6 文件系统 XFS EXT4 内核版本 3.10.x-x系列 2.6.x-x系列内核名称 Maipo Santiago 发布时间 2014 ...
css元素居中
水平居中若为行内元素,对其父元素用text-align:center即可: 若为块元素(无浮动),则一般有两种方法可实现对其的水平居中,一为margin:0 auto;二为通过css计算函数calc ...
java transient关键字和transaction的区别
transient:表示临时的,不会被持久化,保存进数据库 transaction:表示事务 <div style="background: #fff; color: #0ff;&qu ...
spring通过注解依赖注入和获取xml配置混合的方式
spring的xml配置文件中某个<bean></bean>中的property的用法是什么样的? /spring-beans/src/test/java/org/spring ...
PHP FTP
安装 PHP 的 Windows 版本内置了对 FTP 扩展的支持.无需加载任何附加扩展库即可使用 FTP 函数. 然而,如果您运行的是 PHP 的 Linux 版本,在编译 PHP 的时候请添加 - ...
WPF画N角芒星，正N角星
计算顶部三角形坐标方法: /// <summary> /// 获取顶三角形坐标 /// </summary> /// <param name="r"& ...
php中bindValue的批量提交sql语句
php预编译sql语句,可以批量提交sql,也可以实现防注入 <?php $dsn='mysql:host=127.0.0.1;port=3306;dbname=bisai'; $usernam ...
（四）Knockout - ViewModel 的使用3 - 对象属性变化的实时更新
ko.observableArray()就可以自动检测属性,其实他只是监控对象,而不是对象中的属性使用ko.observable()进行处理 DEMO1 实时更新属性 //定义user数据对象 va ...

Storm实现单词计数

Storm实现单词计数的更多相关文章

随机推荐

热门专题