[改善Java代码]不推荐使用binarySearch对列表进行检索

对一个列表进行检索时,我们使用的最多的是indexOf方法,它简单好用,而且也不会出错,虽然它只能检索到第一个符合条件的值,但是我们可以生成子列表后再检索.这样也就可以查找到所有符合条件的值了.

Collections工具类也提供了一个检索的方法:binarySearch,这个是干什么的?该方法也是对一个列表进行检索的,可以查找出指定的索引值,但是在使用这个方法时就有一些注意事项,看代码:

 import java.util.ArrayList;

 import java.util.Collections;

 import java.util.List;

 public class Client {

     public static void main(String[] args) {

         List<String> cities = new ArrayList<String>();

         cities.add("上海");

         cities.add("广州");

         cities.add("广州");

         cities.add("北京");

         cities.add("天津");

         //indexOf方法取得索引值

         int index1 = cities.indexOf("广州");

         //binarySearch查找到索引值

         int index2 = Collections.binarySearch(cities, "广州");

         System.out.println("索引值(indexOf)："+index1);

         System.out.println("索引值（binarySearch)："+index2);

     }

 }

运行结果:

索引值(indexOf)：1

索引值（binarySearch)：2

结果不一样,虽然有两个"广州"这样的元素.但是返回的结果都应该是1才对,为何binarySearch返回的结果是2,问题就出现在2分法搜索上,二分法搜索就是"折半折半再折半"简单,效率高.

看JDK中源码是如何实现的:

 private static final int BINARYSEARCH_THRESHOLD   = 5000;

 public static <T> int binarySearch(List<? extends Comparable<? super T>> list, T key) {

    if (list instanceof RandomAccess || list.size()<BINARYSEARCH_THRESHOLD)

             return Collections.indexedBinarySearch(list, key);//随机存取列表或者元素数量少于5000的顺序列表

         else

             return Collections.iteratorBinarySearch(list, key);//元素数量大于50000的顺序存取列表

 }

ArrayList实现了RandomAccess接口,是一个顺序存取列表,使用了indexBinarySearch方法,代码如下:

     private static <T>

     int indexedBinarySearch(List<? extends Comparable<? super T>> list, T key)

     {

         int low = 0;//默认上界

         int high = list.size()-1;//默认下界

         while (low <= high) {

             int mid = (low + high) >>> 1;//中间索引,无符号右移1位

             Comparable<? super T> midVal = list.get(mid);//中间值

             int cmp = midVal.compareTo(key);//比较中间值

11             //重置上界和下界

             if (cmp < 0)

                 low = mid + 1;

             else if (cmp > 0)

                 high = mid - 1;

             else

                 return mid; // key found   找到元素

         }

         return -(low + 1);  // key not found 没有找到元素,返回负值

     }

     private static <T>

     int iteratorBinarySearch(List<? extends Comparable<? super T>> list, T key)

     {

         int low = 0;

         int high = list.size()-1;

         ListIterator<? extends Comparable<? super T>> i = list.listIterator();

         while (low <= high) {

             int mid = (low + high) >>> 1;

             Comparable<? super T> midVal = get(i, mid);

             int cmp = midVal.compareTo(key);

             if (cmp < 0)

                 low = mid + 1;

             else if (cmp > 0)

                 high = mid - 1;

             else

                 return mid; // key found

         }

         return -(low + 1);  // key not found

     }

以上就是二分法搜索的Java版实现,首先是获得中间索引值,我们的例子中是2,那么索引值是2的元素值是多少?正好是"广州",于是返回索引值2.正确没有问题.

那么再看indexOf的实现:

     public int indexOf(Object o) {

         if (o == null) {

             for (int i = 0; i < size; i++)

                 if (elementData[i]==null)

                     return i;

         } else {

             for (int i = 0; i < size; i++)

                 if (o.equals(elementData[i]))

                     return i;

         }

         return -1;

     }

indexOf方法就是一个遍历,找到第一个元素值相等则返回.

两者的算法都没有问题,是我们用错了binarySearch的用法,因为二分法查询要有一个首要的前提,数据集已经实现了升序排列,否则二分法查找的值是不准确的.不排序怎么确定是在比中间值小的区域还是比中间值大的区域呢?

二分法排序首先要排序,这是二分法的首要条件.

问题清楚了,使用Collection.sort排序即可,但是这样真的可以解决吗?元素数据是从Web或数据库中传过来的,原本是一个有规则的业务数据,为了查找一个元素对其排序,改变了元素在列表中的位置.那谁来保证业务规则的正确性呢?

所以binarySearch在此处首先了.当然可以拷贝一个数组,然后再排序,再使用binarySearch查找指定值,也是可以解决问题.

当然使用binarySearch的二分法查找比indexOf遍历算法性能上高很多,特别是在大数据集而且目标值又接近尾部时,binarySearch方法与indexOf相比,性能上会提升几十倍,因此在从性能的角度考虑时可以选择binarySearch.

//==================测试binarySearch()和indexOf的时间=========

 import java.util.ArrayList;

 import java.util.Collections;

 import java.util.List;

 public class Client {

     public static void main(String[] args) {

         int max =1200000;

         List<String> cities = new ArrayList<String>();

         for(int i=0;i<max;i++){

             cities.add(i+"");

         }

         //indexOf方法取得索引值

         long start = System.nanoTime();

         int index1 = cities.indexOf((max-5)+"");

         long mid = System.nanoTime();

         System.out.println(mid - start);

         //binarySearch查找到索引值

         int index2 = Collections.binarySearch(cities, (max-5)+"");

         long end = System.nanoTime();

         System.out.println(end - mid);

         System.out.println("索引值(indexOf)："+index1);

         System.out.println("索引值（binarySearch)："+index2);

     }

 }

运行输出:

16876685

408528

索引值(indexOf)：1199995

索引值（binarySearch)：-1201

这个地方binarySearch输出负值....我没有调查...如果把这个max改的小一点就没有任何问题.

两种方式的索引值都一样.

binarySearch()的索引效率比indexOf高很多...(具体还要看要查找的值在list中的前后位置)

[改善Java代码]不推荐使用binarySearch对列表进行检索的更多相关文章

[改善Java代码]不推荐覆写start方法
多线程比较简单的方式是继承Thread类,然后覆写run()方法,在客户端程序中通过调用对象的start方法即可启动一个线程,这个是多线程程序的标准写法. 错误代码: public class Cli ...
[改善Java代码]避开基本类型数组转换列表陷阱
开发中经常用到Arrays和Collections这两个工具类. 在数组和列表之间进行切换.非常方便.但是也会遇到一些问题. 看代码: import java.util.Arrays; import ...
[改善Java代码]提防包装类型的null值
建议26: 提防包装类型的null值我们知道Java引入包装类型(Wrapper Types)是为了解决基本类型的实例化问题,以便让一个基本类型也能参与到面向对象的编程世界中.而在Java 5中泛型 ...
[改善Java代码]易变业务使用脚本语言编写
建议16: 易变业务使用脚本语言编写 Java世界一直在遭受着异种语言的入侵,比如PHP.Ruby.Groovy.JavaScript等,这些“入侵者”都有一个共同特征:全是同一类语言—脚本语言,它们 ...
[改善Java代码]非稳定排序推荐使用List
我们知道Set与List的最大区别就是Set中的元素不可以重复(这个重复指的equals方法的返回值相等),其他方面则没有太大的区别了,在Set的实现类中有一个比较常用的类需要了解一下:TreeSet ...
[改善Java代码]推荐覆写toString方法
建议49: 推荐覆写toString方法为什么要覆写toString方法,这个问题很简单,因为Java提供的默认toString方法不友好,打印出来看不懂,不覆写不行,看这样一段代码: public ...
[改善Java代码]推荐使用枚举定义常量
枚举和注解都是在Java1.5中引入的,虽然他们是后起之秀,但是功能不容小觑,枚举改变了常量的声明方式,注解耦合了数据和代码. 建议83:推荐使用枚举定义常量一.分析常量的声明是每一个项目中不可或 ...
[改善Java代码]推荐在复杂字符串操作中使用正则表达式
一.分析字符串的操作,诸如追加.合并.替换.倒序.分隔等,都是在编码过程中经常用到的,而且Java也提供了append.replace.reverse.split等方法来完成这些操作,它们使用起来 ...
[改善Java代码] 推荐使用序列化实现对象的拷贝
建议44: 推荐使用序列化实现对象的拷贝上一个建议说了对象的浅拷贝问题,实现Cloneable接口就具备了拷贝能力,那我们来思考这样一个问题:如果一个项目中有大量的对象是通过拷贝生成的,那我们该如何 ...

随机推荐

B+树|MYSQL索引使用原则
MySQL一直了解得都不多,之前写sql准备提交生产环境之前的时候,老员工帮我检查了下sql,让修改了一下存储引擎,当时我使用的是Myisam,后面改成InnoDB了.为什么要改成这样,之前都没有听过 ...
PHP网站简单架构 – 单独跑php-fpm
这个架构比较简单,不做过多的说明前端1台Nginx:负载均衡+nfs 中间2台php:php-fpm 后端1台数据库:MySQL 安装略,参考<lnmp最新源码一键安装包> 192.16 ...
Spark SQL概念学习系列之Spark SQL的简介（一）
Spark SQL提供在大数据上的SQL查询功能,类似于Shark在整个生态系统的角色,它们可以统称为SQL on Spark. 之前,Shark的查询编译和优化器依赖于Hive,使得Shark不得不 ...
用JS查看修改CSS样式（cssText,attribute('style'),currentStyle,getComputedStyle）
CSS样式定义方法大家都知道,在为HTML设置样式的时候,通常有三种方法:内联样式,内部样式表,外部样式表. 1.内联样式: 内联样式表就是在HTML元素中的行内直接添加style属性. <d ...
Struts2在Action中访问WEB资源
什么是WEB资源? 这里所说的WEB资源是指:HttpServletRequest, HttpSession, ServletContext 等原生的 Servlet API. 为什么需要访问WEB资 ...
iPhone各种尺寸
iPhone 6 Plus 736x414 points 2208x1242 pixels 3x scale 1920x1080 physical pixels ...
Spring EL method invocation example
In Spring EL, you can reference a bean, and nested properties using a 'dot (.)' symbol. For example, ...
有关static静态修饰符的学习心得
初学java,面对着这个static修饰符,愣是琢磨了两天时间,还在今天琢磨透了,现在将悟到的东西记录下来: 1.static修饰符表示静态修饰符,其所修饰的内容(变量.方法.代码块暂时学到这三种)统 ...
ADO.NET 快速入门（四）：从数据库填充 DataSet
从数据库获取数据很容易,处理数据更容易.如果想要从数据库获取只进.只读的数据流结果集,你可以使用 DataReader 执行命令并且检索它.关于如何使用 DataReader,请参考:使用 OLE D ...
exe文件当前目录搜索文件
方法: //std::string dir = "C:\\Users\\xzd\\Documents\\KinectFile\\2014-09-07\\Select\\mengyue\\&q ...

[改善Java代码]不推荐使用binarySearch对列表进行检索

[改善Java代码]不推荐使用binarySearch对列表进行检索的更多相关文章

随机推荐

热门专题