Hadoop wordcount Demon

　　搭建完成Hadoop后，第一个demon,wordcount。此处参考：http://blog.csdn.net/wangjia55/article/details/53160679

　　wordcount是hadoop的入门经典.

　　1.在某个目录下新建若干文件，我在各个文件里都添加了一些英文文章段落：

　　２．在hadoop-2.7.3目录下创建一个wordcountTest目录：

　　bin/hdfs dfs -mkdir /wordcountTest

　　查看刚才建立的目录：

　　bin/hdfs dfs -ls /

　　可以发现，已经建立起了wordcountTest目录。

　　３．将步骤１中本地的text文件上传到hdfs中：

　　bin/hdfs dfs -put /home/hadoop/hadoop-2.7.3/hadoop_test/*.txt /wordcountTest

　　查看上传结果：

　　bin/hdfs dfs -ls /wordcountTest

　　显示上传已完成。

　　４．运行wordcount

 　　bin/hadoop jar share/hadoop/mapreduce/hadoop-mapreduce-examples-2.7.3.jar wordcount /wordcountTest/*.txt /wordcountTest/out.txt

　　运行结果截图：

　　查看运行结果：

　　 bin/hdfs dfs -ls /wordcountTest/out.txt/

　　其中运行结果存储在part-r-00000中。

　　查看part-r-00000文件内容：

　　 bin/hadoop fs -cat /wordcountTest/out.txt/part-r-00000

　　截图是部分wordcount结果：

Hadoop wordcount Demon的更多相关文章

hadoop wordcount
Mapper // map的数量与数的分片有关系 public class WCMapper extends Mapper<LongWritable, Text, Text, LongWrita ...
Eclipse执行Hadoop WordCount
前期工作我的Eclipse是安装在Windows下的,通过Eclipse执行程序连接Hadoop, 需要让虚拟机的访问地址和本机的访问地址保持在同一域内,虚拟机的地址更改前面的文章介绍过了,如果想改 ...
Hadoop WordCount程序
一.把所有Hadoop的依赖jar包导入buildpath,不用一个一个调,都导一遍就可以,因为是一个工程,所以覆盖是没有问题的二.写wordcount程序 1.工程目录结构如下: 2.写mappe ...
Hadoop WordCount单词计数原理
计算文件中出现每个单词的频数输入结果按照字母顺序进行排序编写WordCount.java 包含Mapper类和Reducer类编译WordCount.java javac -classpath ...
hadoop wordcount程序缺陷
在wordcount 程序的main函数中,没有读取运行环境中的各种参数的值,全靠hadoop系统的默认参数跑起来,这样做是有风险的,最突出的就是OOM错误. 自己在刚刚学习hadoop编程时,就是模 ...
Hadoop - WordCount代码示例
文章来源:http://www.itnose.net/detail/6197823.html import java.io.IOException; import java.util.Iterator ...
hadoop WordCount例子详解。
[学习笔记] 下载hadoop-2.7.4-src.tar.gz,拷贝hadoop-2.7.4-src.tar.gz中hadoop-mapreduce-project\hadoop-mapreduce ...
hadoop安装与WordCount例子
1.JDK安装下载网址: http://www.oracle.com/technetwork/java/javase/downloads/jdk-6u29-download-513648.html ...
hadoop的wordcount例子运行
可以通过一个简单的例子来说明MapReduce到底是什么: 我们要统计一个大文件中的各个单词出现的次数.由于文件太大.我们把这个文件切分成如果小文件,然后安排多个人去统计.这个过程就是”Map”.然后 ...

随机推荐

Mysql的跨服务器关联查询--Federated引擎
1.确认开启Federated引擎查询FEDERATED功能是否开启: show ENGINES; 2.如果状态为NO则需修改my.ini文件,增加一行federated配置: ...
关于redis服务无法启动问题
打开cmd终端找到redis安装路径下输入redis-server redis.windows.conf报错信息如下之后重新输入redis-cli.exe 运行结果然后输入 127.0.0.1: ...
第一周——数据分析之表示 —— Numpy入门
数据的维度从一个数据到一组数据一个数据:表达一个含义一组数据:表达一个或者多个含义维度:一组数据的组织形式一维数据由对等关系的有序或者无序数据构成,采用线性方式组织,对应列表.数组和集合等 ...
python的一些基本概念
1.为什么python被称为胶水语言?他是新一代的系统脚本参考博客:https://www.cnblogs.com/ningskyer/articles/5264172.html 2.python百度 ...
linux下 vi命令编辑/etc/my.cnf
把my.cnf配置文件加个max_connections包括(插入命令,删除命令,修改命令.退出保存命令) 你要有这个文件写权限,shell下输入: vi /etc/my.cnf 进入vi后,按i移动 ...
AC的故事大结局山寨版（下）
AC的故事大结局山寨版(下) TimeLimit:2000MS MemoryLimit:128MB 64-bit integer IO format:%lld Problem Descripti ...
iOS 中的屏幕旋转shouldAutorotate和supportedInterfaceOrientations的先后关系
这2个UIViewController的属性,都和旋转相关, 当设备发生旋转时,首先会查看根controller的shouldAutorotate是否允许旋转,如果允许,再通过 supportedIn ...
一期末架构1 centos7 简介
一 centos7 安装和差异虚拟机配置好硬件第一张网卡NAT添加第二张网卡选择LAN区段安装前修改内核变更网卡名 net.ifnames=0 biosdevname=0 回车 ...
论文阅读笔记四十二：Going deeper with convolutions (Inception V1 CVPR2014 )
论文原址:https://arxiv.org/pdf/1409.4842.pdf 代码连接:https://github.com/titu1994/Inception-v4(包含v1,v2,v4) ...
Python学习笔记三
一. 为什么要使用函数? 函数可以方便阅读代码. 函数可以减少重复代码. 函数可以减少管理操作,减少修改操作. 二. 函数分类: 内置函数:len() sum() max() min() ...

Hadoop wordcount Demon

Hadoop wordcount Demon的更多相关文章

随机推荐

热门专题