kwic--Java统计单词个数并按照顺序输出

是一个统计文件中单词个数，并按照个数从大到小输出的。输入文件名OK 了

单词是按照首字母排序的，，，里面用到映射等，，，注意重写比较函数，因为我们是要按值排序，而不是一般的按照键排序，，，，我们要输出的由多到少的个数，，，有个数是重复的

由于我们要按照个数多少排序，所以记得重写比较函数，为啥不能让数字做键，因为键不能重复，所以这里单词是键，OK 。

1 str.split("\\s+");这里记录分隔符

2 正则表达式,
\\d表示 0-9 的数字,
\\s表示空格,回车,换行等空白符,
\\w表示单词字符(数字字母下划线)
+号表示一个或多个的意思

代码：

 package calnum;

 import java.io.BufferedReader;

 import java.io.FileNotFoundException;

 import java.io.FileReader;

 import java.io.IOException;

 import java.nio.Buffer;

 import java.nio.ShortBuffer;

 import java.util.ArrayList;

 import java.util.Collections;

 import java.util.Comparator;

 import java.util.HashMap;

 import java.util.Iterator;

 import java.util.List;

 import java.util.Map;

 import java.util.Map.Entry;

 import java.util.Scanner;

 import java.util.TreeMap;

 import javax.swing.Spring;

 import javax.swing.text.html.parser.Entity;

 public class calwordnum{

     public String readfile() throws IOException {

         String all = null;

         // System.out.print("##########################");

         Scanner cin = new Scanner(System.in);

         System.out.print("plz input file name:");

         String filename = cin.next();

         FileReader read = new FileReader(filename);

         BufferedReader re = new BufferedReader(read);

         StringBuffer strbuf = new StringBuffer();

         String ss;

         while ((ss = re.readLine()) != null) {

             strbuf.append(ss);

         //读全文

         }

         return strbuf.toString();

     }

     //

     public String[] input(String str) {

         String[] arr = str.split("\\s+");

         return arr;

     }

     public void putmap(List<String> ls) {

         String temp, theword = null;

         int flage = 0;

         theword = ls.get(0);

         Map<String, Integer> map = new HashMap<String, Integer>();

         Iterator it = ls.iterator();

         while (it.hasNext()) {

             // System.out.println("sss"+it.next().toString());

             temp = it.next().toString();

             if (temp.equals(theword)) {

                 flage++;

                 continue;

             } else {

                 map.put(theword, flage);

                 flage = 1;

                 theword = temp;

             }

         }

         map.put(theword, flage);

         //重写比较方法，treemap按值排序。用两个map 比较函数需要参数

         ValueComparator bvc =  new ValueComparator(map);

        Map<String,Integer> map2 = new TreeMap<String,Integer>(bvc);

        map2.putAll(map);

         Iterator mapit = map2.entrySet().iterator();

         while (mapit.hasNext()) {

             Entry tr = (Entry) mapit.next();

             String num = (String) tr.getKey();

             int sa = (Integer) tr.getValue();

             System.out.println("this word:"+num + " has:" + sa + "个");

         }

     }

     // /

     public static void main(String[] args) throws IOException {

         // TODO Auto-generated method stub

         List<String> ls = new ArrayList<String>();

         calwordnum ca = new calwordnum();

         String allword = ca.readfile();

         String[] arr = ca.input(allword);

         for (int i = 0; i < arr.length; i++) {

             ls.add(arr[i].toLowerCase());

         }

         Collections.sort(ls);

         display(ls);

         ca.putmap(ls);

     }

     @Override

     public boolean equals(Object obj) {

         // TODO Auto-generated method stub

         return super.equals(obj);

     }

     private static void display(List<String> ls) {

         // TODO Auto-generated method stub

         for (String s : ls)

             System.out.println(s);

     }    

 }

 //

 class ValueComparator implements Comparator<String> {  

     Map<String, Integer> base;

     public ValueComparator(Map<String, Integer> base) {

         this.base = base;

     }  

     public int compare(String a, String b) {

         if (base.get(a) >=base.get(b)) {

             return -1;  //注意   不要返回0 会删除重复

         } 

         else {

             return 1;

         }

     }

 }

不截图了，运行了之后输入文件名就行，如果你的分隔符不是//s+能满足的，麻烦自行修改。出来的结果就是单词，单词个数，有考虑步骤的地方。望批评指正

kwic--Java统计单词个数并按照顺序输出的更多相关文章

Java实现蓝桥杯VIP 算法训练统计单词个数
题目描述给出一个长度不超过200的由小写英文字母组成的字母串(约定;该字串以每行20个字母的方式输入,且保证每行一定为20个).要求将此字母串分成k份 (1< k< =40),且每份中 ...
第六章第一个linux个程序：统计单词个数
第六章第一个linux个程序:统计单词个数从本章就开始激动人心的时刻——实战,去慢慢揭开linux神秘的面纱.本章的实例是统计一片文章或者一段文字中的单词个数. 第 1 步:建立 Linu x 驱 ...
第六章第一个Linux驱动程序：统计单词个数
现在进入了实战阶段,使用统计单词个数的实例让我们了解开发和测试Linux驱动程序的完整过程.第一个Linux驱动程序是统计单词个数. 这个Linux驱动程序没有访问硬件,而是利用设备文件作为介质与应用 ...
NOIP200107统计单词个数
NOIP200107统计单词个数难度级别: A: 编程语言:不限:运行时间限制:1000ms: 运行空间限制:51200KB: 代码长度限制:2000000B 试题描述给出一个长度不超过200的由 ...
NOIP2001 统计单词个数
题三统计单词个数(30分) 问题描述给出一个长度不超过200的由小写英文字母组成的字母串(约定;该字串以每行20个字母的方式输入,且保证每行一定为20个).要求将此字母串分成k份(1<k&l ...
Codevs_1040_[NOIP2001]_统计单词个数_(划分型动态规划)
描述 http://codevs.cn/problem/1040/ 与Codevs_1017_乘积最大很像,都是划分型dp. 给出一个字符串和几个单词,要求将字符串划分成k段,在每一段中求共有多少单词 ...
luogu P1026 统计单词个数
题目链接 luogu P1026 统计单词个数题解贪心的预处理母本串从i到j的最大单词数然后dp[i][j] 表示从前i个切了k次最优解转移显然代码 #include<cstdio&g ...
Codevs 1040 统计单词个数
1040 统计单词个数 2001年NOIP全国联赛提高组时间限制: 1 s 空间限制: 128000 KB 题目等级 : 黄金 Gold 题目描述 Description 给出一个长度不超过200的 ...
codevs1040统计单词个数（区间+划分型dp）
1040 统计单词个数 2001年NOIP全国联赛提高组时间限制: 1 s 空间限制: 128000 KB 题目等级 : 黄金 Gold 题目描述 Description 给出一个长度不超 ...

随机推荐

IIS 配置1
[转]HTTP 错误 401.2 - Unauthorized 由于身份验证头无效,您无权查看此页. IIS7.0解决办法 (2010-11-01 00:58:54) 原网址 http://blog. ...
基于nginx和tengine的tcp反向代理，负载均衡安装和配置
先下载nginx_tcp_proxy_module模块. wget https://github.com/yaoweibin/nginx_tcp_proxy_module/archive/master ...
ExtJS自定义事件
1.开发ExtJS组件UI的时候,基本上对于一些操作,就是与后台交互之类的多数都是用户进行点击触发一个事件,在事件的处理器handler里面调具体的业务方法,完成业务数据的处理以及业务流程的流转机制, ...
GlusterFS PERFORMANCE TUNING
众所周知,glusterfs对小文件而言,就是个鸡肋,特别是在一个目录下有过W的小文件图片时,ls简单就是个坑,下面我对线上的glusterfs参数做一些优化调整,调整的命令: gluster vol ...
Mongodb下载、安装、配置与使用
记得在管理员模式下运行CMD,否则服务将启动失败一.下载官网下载地址:https://www.mongodb.com/download-center?jmp=nav#community 为了方便下 ...
django-template-forloop
forloop.counter0 # 是每次循环的index 红色的div标签,居然可以这样写. ex:第一次循环的结果 <div class="item active" ...
28. 表单css样式定义格式
form>table>tbody>tr>td{padding:5px;font-size:14px;font-family:"Microsoft YaHei" ...
HTML5 Canvas ( 绘制一轮弯月, 星空中的弯月 )
<!DOCTYPE html> <html> <head> <meta charset="UTF-8"> <title> ...
leetcode237
/** * Definition for singly-linked list. * public class ListNode { * public int val; * public ListNo ...
Spring MVC 异常处理 - ExceptionHandler
通过HandlerExceptionResolver 处理程序异常,包括Handler映射, 数据绑定, 以及目标方法执行时的发生的异常实现类如下 /** * 1. 在 @ExceptionHand ...

kwic--Java统计单词个数并按照顺序输出

kwic--Java统计单词个数并按照顺序输出的更多相关文章

随机推荐

热门专题