Hadoop下MapReduce实现Pi值的计算

Hadoop自带的例子中，有一个计算Pi值的例子。

这个程序的原理是这样的。假如有一个边长为1的正方形。以正方形的一个端点为圆心，以1为半径，画一个圆弧，于是在正方形内就有了一个直角扇形。在正方形里随机生成若干的点，则有些点是在扇形内，有些点是在扇形外。正方形的面积是1，扇形的面积是0.25*Pi。设点的数量一共是n，扇形内的点数量是nc，在点足够多足够密集的情况下，会近似有nc/n的比值约等于扇形面积与正方形面积的比值，也就是nc/n= 0.25*Pi/1，即Pi = 4*nc/n。

在正方形内生成的样本点越多，计算Pi值越精确，这样，这个问题就很适合用Hadoop来处理啦。假设要在正方形内生成1000万个点，可以设置10个Map任务，每个Map任务处理100万个点，也可以设置100个Map任务，每个Map任务处理10万个点。

package mapreduce1;

/*

 *  @create by 刘大哥

 *  2019年9月3日

   *       利用MapReduce计算pi值

 * */

import java.io.IOException;

import java.util.StringTokenizer;

import org.apache.hadoop.fs.Path;

import org.apache.hadoop.io.IntWritable;

import org.apache.hadoop.io.Text;

import org.apache.hadoop.mapreduce.Job;

import org.apache.hadoop.mapreduce.Mapper;

import org.apache.hadoop.mapreduce.Reducer;

import org.apache.hadoop.mapreduce.lib.input.FileInputFormat;

import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;

import PI.Pi;  

    public class WordCount {

        public static void main(String[] args) throws IOException, ClassNotFoundException, InterruptedException {

            Job job = Job.getInstance();

            job.setJobName("WordCount");

            job.setJarByClass(WordCount.class);

            job.setMapperClass(doMapper.class);

            job.setReducerClass(doReducer.class);

            job.setOutputKeyClass(Text.class);

            job.setOutputValueClass(IntWritable.class);

            Path in = new Path("hdfs://192.168.100.129:9000/user/hadoop/p1i.txt");   //输入路径

            Path out = new Path("hdfs://192.168.100.129:9000/user/hadoop/out_pi1");  //输出路径

            FileInputFormat.addInputPath(job, in);

            FileOutputFormat.setOutputPath(job, out);

            System.exit(job.waitForCompletion(true) ?  : );

        }

        public static class doMapper extends Mapper<Object, Text, Text, IntWritable>{

            private static final IntWritable one = new IntWritable();

            @Override

            protected void map(Object key, Text value, Context context) throws IOException, InterruptedException {

                String line =  value.toString();

                String word = line.toString();         //读取每个map的数值

                //System.out.println(word);

                int num = Integer.parseInt(word);      //转化为int类型

                //System.out.println(num);

                int[] base = {,};

                Pi test = new Pi(base);

                int a= ;         // 是否在扇形区域内的标志符  1：在扇形区域内 2：不在扇形区域内

                int count = ;  // 统计在扇形区域内点的个数

                for(int x = ; x < num; x++){

                    double[] t = test.getNext();

                    if(t[]*t[]+t[]*t[]<) {  //在扇形区域内

                        a=;

                        count++;                 //在扇形区域内的个数加+

                    }

                    else {                       //不在扇形区域内

                        a=;

                    }

                }

                double result= count*4.00000000/num;    //每个map计算出pi的值

                String strresule = String.valueOf(result);

                Text textresult = new Text();              /*转换类型为Text */

                textresult.set(strresule);

                context.write(textresult, one);         //写入

            }

        }

        public static class doReducer extends Reducer<Text, IntWritable, Text, IntWritable>{   //reduce 整合输出

            private IntWritable result = new IntWritable();

            @Override

            protected void reduce(Text key, Iterable<IntWritable> values, Context context)

            throws IOException, InterruptedException {

            int sum = ;

            for (IntWritable value : values) {

                sum += value.get();

            }

                result.set(sum);

                context.write(key, result);

            }

        }

    }

Hadoop下MapReduce实现Pi值的计算的更多相关文章

Mapreduce案例之Pi值估算
题目: 这个程序的原理是这样的.假如有一个边长为1的正方形.以正方形的一个端点为圆心,以1为半径,画一个圆弧,于是在正方形内就有了一个直角扇形.在正方形里随机生成若干的点,则有些点是在扇形内,有些点是 ...
从Hadoop骨架MapReduce在海量数据处理模式（包括淘宝技术架构）
从hadoop框架与MapReduce模式中谈海量数据处理前言几周前,当我最初听到,以致后来初次接触Hadoop与MapReduce这两个东西,我便稍显兴奋,认为它们非常是神奇.而神奇的东西常能勾 ...
Mapreduce求气温值项目
Mapreduce前提工作简单的来说map是大数据,reduce是计算<运行时如果数据量不大,但是却要分工做这就比较花时间了> 首先想要使用mapreduce,需要在linux中进行一些 ...
Hadoop基础-MapReduce的工作原理第二弹
Hadoop基础-MapReduce的工作原理第二弹作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.Split(切片) 1>.MapReduce处理的单位(切片) 想必 ...
Hadoop基础-MapReduce的工作原理第一弹
Hadoop基础-MapReduce的工作原理第一弹作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 在本篇博客中,我们将深入学习Hadoop中的MapReduce工作机制,这些知识 ...
Hadoop 新 MapReduce 框架 Yarn 详解【转】
[转自:http://www.ibm.com/developerworks/cn/opensource/os-cn-hadoop-yarn/] 简介: 本文介绍了 Hadoop 自 0.23.0 版本 ...
Hadoop解析--MapReduce
从本篇博客開始咱们一起来具体了解Hadoop的每一个部分.我们在上篇博客中介绍了HDFS,MapReduce,MapReduce为了更有效率事实上是建立在HDFS之上的.有了分布式的文件系统,我们就能 ...
hadoop的mapReduce和Spark的shuffle过程的详解与对比及优化
https://blog.csdn.net/u010697988/article/details/70173104 大数据的分布式计算框架目前使用的最多的就是hadoop的mapReduce和Spar ...
hadoop之mapreduce详解（进阶篇）
上篇文章hadoop之mapreduce详解(基础篇)我们了解了mapreduce的执行过程和shuffle过程,本篇文章主要从mapreduce的组件和输入输出方面进行阐述. 一.mapreduce ...

随机推荐

[转帖]postgres 创建新用户并授权-- 非常好的
postgres 创建新用户并授权 https://blog.csdn.net/XuHang666/article/details/81506297 原作者总结的挺好的可以用来学习一下. grant ...
python列表与字符串、元组的区别以及列表引用的方式
一.字符串字符串也可以用下标取值.切片.for循环.len()取长度以及 in 和 not in 来进行操作. 但字符串是不可变的,不能被更改.只能构造一个“新的”字符串来存取你想要修改后的数据. ...
X-UA-Compatibles
今天在看京东网页代码的时候,发现了X-UA-Compatibles 这个元信息属性,不是很清楚,百度了一下,做下记录 X-UA-Compatible 属性是 IE 浏览器在 IE8 版本开始提供的一个 ...
《深入理解 Java 虚拟机》学习笔记 -- 内存区域
<深入理解 Java 虚拟机>学习笔记 -- 内存区域运行时数据区域主要分为 6 部分: 程序计数器虚拟机栈本地方法栈 Java 堆方法区如图所示: 1. 程序计数器(线程私有 ...
idea2019 Tomcat9 Tomcat Localhost log 乱码
网上一顿搜索,基本没用,可能版本不一样. idea2019 tomcat9解决方案: 找到Tomcat的安装目录,进入conf目录打开logging.properties 找到java.util.l ...
java代码实现图片内容转文字
前言现在的手机已经可以实现拍照转文字了.作为一名程序员,得使用java代码实现这一功能,虽然可能没啥用!!! pom.xml 添加依赖 <dependency> <groupId& ...
Delphi 10.3.2来了！
昨晚,官方正式发布了Delphi 10.3.2,增加对Mac 64应用的开发,支持Linux桌面开发,这个是通过集成fmxlinux实现的,同时修正400个bug,编译器,102个ide,84个fmx ...
第十章、time模块
目录第十章.模块第十章.模块 time模块 import time 时间戳表示:是从1970年1月1日00:00:00开始按秒计算的偏移量. time_stamp = time.time() p ...
使用Django开发简单接口：文章增删改查
目录 1.一些准备工作安装django 创建django项目创建博客应用(app) 2.models.py 3.django admin 登录创建超级用户 4.修改urls.py 5.新增文章接 ...
fastadmin Excel导出时数字被科学计数
/public/assets/libs/bootstrap-table/dist/extensions/export/bootstrap-table-export.min.js //exportOpt ...

Hadoop下MapReduce实现Pi值的计算

Hadoop下MapReduce实现Pi值的计算的更多相关文章

随机推荐

热门专题