iso data 聚类算法

isodata算法就是先拟定一个预期类，再选取一些聚类中心，通过不断合并或者分裂聚类，达到分类的目的

关键就是在于，如何分裂，合并

要合并或者分裂必须要确定一些指标

所以第一步就是要确定某些指标

1.设置参数，

a，确定样本 {xn} ，

b，设置一个预期的分类数C，

c，确定聚类中心的个数Nc，（Nc不一定要等于C）

d ,确定每一个类最少数目

e，每个类样本维度的分量维度的标准差

f，类间最小距离

g 合并分裂次数

2.观察样本点与拟定聚类中心的关系

样本点{Xn} 与聚类中心{Nc} 哪一个近就归为哪一类

3.分裂或者合并

分裂的条件：

a.类太少

b，类中样本的某一维度的标准差过大，即超过我设置的标准值

c 类内样本平均距离大于所有类平均距离（你这个聚类太分散了）

d 类中元素太多

合并条件：

a 一个类里面点太少.

b 两个类距离太近

c 类的数目太多

一次分裂或者合并不够，需要多次迭代才能得到较好结果

4.设置迭代循环条件

递归的方式重复步骤三

以上是通俗的话

用教材的原文是

不要在乎加加减减你高兴你可以自己改参数

iso data 聚类算法的更多相关文章

挑子学习笔记：两步聚类算法（TwoStep Cluster Algorithm）——改进的BIRCH算法
转载请标明出处:http://www.cnblogs.com/tiaozistudy/p/twostep_cluster_algorithm.html 两步聚类算法是在SPSS Modeler中使用的 ...
K-Means 聚类算法
K-Means 概念定义: K-Means 是一种基于距离的排他的聚类划分方法. 上面的 K-Means 描述中包含了几个概念: 聚类(Clustering):K-Means 是一种聚类分析(Clus ...
K-均值聚类算法
K-均值聚类算法聚类是一种无监督的学习算法,它将相似的数据归纳到同一簇中.K-均值是因为它可以按照k个不同的簇来分类,并且不同的簇中心采用簇中所含的均值计算而成. K-均值算法算法思想 K-均值是 ...
k-means聚类算法python实现
K-means聚类算法算法优缺点: 优点:容易实现缺点:可能收敛到局部最小值,在大规模数据集上收敛较慢使用数据类型:数值型数据算法思想 k-means算法实际上就是通过计算不同样本间的距离来判断他 ...
聚类算法之BIRCH（Java实现）转载
http://www.cnblogs.com/zhangchaoyang/articles/2200800.html http://blog.csdn.net/qll125596718/article ...
转载： scikit-learn学习之K-means聚类算法与 Mini Batch K-Means算法
版权声明:<—— 本文为作者呕心沥血打造,若要转载,请注明出处@http://blog.csdn.net/gamer_gyt <—— 目录(?)[+] ================== ...
Matlab中K-means聚类算法的使用（K-均值聚类）
K-means聚类算法采用的是将N*P的矩阵X划分为K个类,使得类内对象之间的距离最大,而类之间的距离最小. 使用方法:Idx=Kmeans(X,K)[Idx,C]=Kmeans(X,K) [Idx, ...
SPARK在linux中的部署，以及SPARK中聚类算法的使用
眼下,SPARK在大数据处理领域十分流行.尤其是对于大规模数据集上的机器学习算法.SPARK更具有优势.一下初步介绍SPARK在linux中的部署与使用,以及当中聚类算法的实现. 在官网http:// ...
聚类算法K-Means, K-Medoids, GMM, Spectral clustering,Ncut
原文请戳:http://blog.csdn.net/abcjennifer/article/details/8170687 聚类算法是ML中一个重要分支,一般采用unsupervised learni ...

随机推荐

ROW_NUMBER() OVER()函数用法;(分组，排序），partition by
转载:https://www.cnblogs.com/alsf/p/6344197.html 1.row_number() over()排序功能: (1) row_number() over()分组排 ...
[android]android下apk的安装过程
/********************2016年4月23日更新********************************/ 知乎:有什么apk分析工具? 拿到了一个apk文件,怀疑不安全,在 ...
Linux 查找最大文件
1.使用命令df -h 查看硬盘空间 2.使用命令du -h –max-depth=1 /var/log/* 查看/var/log路径下文件的大小 du -sh /* 查看哪个目录最大,一步一步的查 ...
【转】三个案例带你看懂LayoutInflater中inflate方法两个参数和三个参数的区别
关于inflate参数问题,我想很多人多多少少都了解一点,网上也有很多关于这方面介绍的文章,但是枯燥的理论或者翻译让很多小伙伴看完之后还是一脸懵逼,so,我今天想通过三个案例来让小伙伴彻底的搞清楚这个 ...
Java 学习笔记线程控制
题目一本质上来说,线程是不可控制的,线程的执行是由CPU资源分配决定的,我们无法干预系统CPU的资源分配,但我们可以增加条件来让线程按照我们的预想顺序来执行. 比如.如果当前的执行的线程不满足我们所 ...
Java学习笔记之——集合
集合是类,用来存储多个数据,有属性.方法集合是一个可变数组,保存相同元素并且长度可变 1. 体系 (1)Collection:存储一个一个的值 Iterable: Iterable<T> ...
【.Net Core】处理静态文件
静态文件存储在项目的 Web 根目录中. 默认目录是 <content_root>/wwwroot,但可通过 UseWebRoot 方法更改目录. public class Program ...
Chrome 下input的默认样式
一.去除默认边框以及padding border: none;padding:0 二.去除聚焦蓝色边框 outline: none; 三.form表单自动填充变色 1.给input设置内置阴影,至少要 ...
第五课 Css3旋转放大属性，正六边形的绘制
---恢复内容开始--- 一.效果二.知识点 1.background-color: rgba(0,0,0,.4); (红色.绿色.蓝色.透明度(0-1)) 2.position: absolu ...
python 练习 simple_server 判断路径及返回函数
函数 routers 返回一个 urlpatterns 元组,里面包含了路径名和函数名:在函数 application 中遍历 urlpatterns 元组,路径存在则返回函数名,不存在则返回 40 ...

iso data 聚类算法

iso data 聚类算法的更多相关文章

随机推荐

热门专题