词频统计-part2

　　看到这个问题为之一愣，这简单多了，在第一部分的基础上把那些存储结构删了，把排序算法删了，设置一个变量，遇到则加一，直到读到文件尾。最后输出单词出现次数。

　　程序比较简单也比较，下面就把程序贴出来：

 package note1;

 import java.io.BufferedReader;

 import java.io.FileReader;

 import java.io.FileNotFoundException;

 import java.io.IOException;

 import java.util.*;

 import java.util.regex.*;

 import java.util.Comparator;

 public class part2 {

     public static void main(String[] args)

     {

         //input

         Map<String,Integer> numcount=new HashMap<String,Integer>();

         Pattern pat=Pattern.compile("\\b[A-Za-z][A-Za-z0-9]*\\b");

         String filename="";

         String keyWord="";

         int count=0;

         for(int i=0;i<args.length-1;i++)

         {

             if(args[i].equals("-f"))

             {

                 filename+=args[i+1];

             }

             else if(args[i].equals("-w"))

             {

                 keyWord+=args[i+1];

             }

         }

         try{

         BufferedReader in=new BufferedReader(new FileReader(filename));

         //process

         String temp;

         while((temp=in.readLine())!=null)

         {

             Matcher mth=pat.matcher(temp);

             boolean tf=mth.find();

             while(tf)

             {

                 String buffer=mth.group().toLowerCase();

                 if(buffer.equals(keyWord.toLowerCase()))

                 {

                     count+=1;

                 }

                 tf=mth.find();

             }

         }

         in.close();

         //output

         System.out.println("keyword "+keyWord+" occurred "+count+" times !");

         }catch(FileNotFoundException e)

         {

             System.out.println("Cannot find the specified file");

         }

         catch(IOException e)

         {

             System.out.println(e.getMessage());

         }

     }

 }

运行结果：

　　如果想要的是这种方式的话：

　　Over.

词频统计-part2的更多相关文章

作业3-个人项目<词频统计>
上了一天的课,现在终于可以静下来更新我的博客了. 越来越发现,写博客是一种享受.来看看这次小林老师的“作战任务”. 词频统计单词: 包含有4个或4个以上的字 ...
C语言实现词频统计——第二版
原需求 1.读取文件,文件内包可含英文字符,及常见标点,空格级换行符. 2.统计英文单词在本文件的出现次数 3.将统计结果排序 4.显示排序结果新需求: 1.小文件输入. 为表明程序能跑 2.支持命 ...
c语言实现词频统计
需求: 1.设计一个词频统计软件,统计给定英文文章的单词频率. 2.文章中包含的标点不计入统计. 3.将统计结果以从大到小的排序方式输出. 设计: 1.因为是跨专业0.0···并不会c++和java, ...
软件工程第一次个人项目——词频统计by11061153柴泽华
一.预计工程设计时间明确要求: 15min: 查阅资料: 1h: 学习C++基础知识与特性: 4-5h: 主函数编写及输入输出部分: 0.5h: 文件的遍历: 1h: 编写两种模式的词频统计函数: ...
python瓦登尔湖词频统计
#瓦登尔湖词频统计: import string path = 'D:/python3/Walden.txt' with open(path,'r',encoding= 'utf-8') as tex ...
Hadoop上的中文分词与词频统计实践（有待学习 http://www.cnblogs.com/jiejue/archive/2012/12/16/2820788.html）
解决问题的方案 Hadoop上的中文分词与词频统计实践首先来推荐相关材料:http://xiaoxia.org/2011/12/18/map-reduce-program-of-rmm-word-c ...
pyspark进行词频统计并返回topN
Part I:词频统计并返回topN 统计的文本数据: what do you do how do you do how do you do how are you from operator imp ...
使用storm分别进行计数和词频统计
计数直接上代码 public class LocalStormSumTopology { public static void main(String[] agrs) { //Topology是通过 ...
jieba库分词词频统计
代码已发至github上的python文件词频统计结果如下(词频为1的词组数量已省略): {'是': 5, '风格': 4, '擅长': 4, '的': 4, '兴趣': 4, '宣言': 4, ' ...

随机推荐

C#中XML文档注释编译DLL引用到其它项目
引用地址:http://zhidao.baidu.com/link?url=jSGYEBysE4gBExtNsHCVk3vd2OK2cMlaf02cS79GdRuGueTBdFJB0btOdBYkg_ ...
java正则表达式实战例子，持续更新，记下来后面就不用重新写了。。。
1.去掉HTML标签: /** * 去掉HTML外面的标签 * @author CY * */ public class TrimHTML { public static void main(Stri ...
Spring MVC @ResponseBody和@RequestBody使用
@ResponseBody用法: 作用:该注解用于将Controller的方法返回的对象,根据HTTP Request Header的Accept的内容,通过适当的HttpMessageConvert ...
request 里面参数设置 (有空瞄下)
Requests 是用python语言编写的第三方库,基于 urllib,采用 Apache2 Licensed 开源协议的 HTTP 库.它比 urllib 更加方便,完全满足 HTTP 测试需求, ...
Python基础之文件
输出一行一行的,效率更高一个任务: 主函数:
Bootstrap的介绍和响应式媒体查询
Bootstrap的介绍凡是使用过Bootstrap的开发者,都不在乎做这么两件事情:复制and粘贴.哈哈~,是的使用Bootstrap非常简单,但是在复制粘贴之前,需要先对Bootstrap的用法 ...
WCF传输大数据 --断点续传（upload、download)
using System; using System.IO; using System.Runtime.Serialization; using System.ServiceModel; namesp ...
centos6挂载U盘
一.FAT格式的U盘插入U盘 [root@localhost ~]# dmesg | grep usb usbcore: registered new interface driver usbfs ...
solr搜索之搜索精度问题我已经尽力了！！！
solr搞了好久了,没啥进展,没啥大的突破,但是我真的尽力了! solr7可能是把默认搜索方式去掉了,如下: 在solr7里找了半天以及各种查资料也没发现这个默认搜索方式,后来想,可能是被edisma ...
Redis Windows环境安装
1.下载Windows 版本 Redis: https://github.com/ServiceStack/redis-windows 2. 解压文件: F:\开源代码学习\01_Redis 打开目 ...

词频统计-part2

词频统计-part2的更多相关文章

随机推荐

热门专题