第一周-调用weka算法进行数据挖掘

简单数据集data.txt

@relation weather

@attribute outlook {sunny, overcast, rainy}

@attribute temperature numeric

@attribute humidity numeric

@attribute windy {TRUE, FALSE}

@attribute play {yes, no}

@data

sunny,85,85,FALSE,no

sunny,80,90,TRUE,no

overcast,83,86,FALSE,yes

rainy,70,96,FALSE,yes

rainy,68,80,FALSE,yes

rainy,65,70,TRUE,no

overcast,64,65,TRUE,yes

sunny,72,95,FALSE,no

sunny,69,70,FALSE,yes

rainy,75,80,FALSE,yes

sunny,75,70,TRUE,yes

overcast,72,90,TRUE,yes

overcast,81,75,FALSE,yes

rainy,71,91,TRUE,no

在eclipse中新建项目导入weka.jar包，调用weka中的一些算法。

package test;

import java.io.BufferedReader;

import java.io.FileNotFoundException;

import java.io.FileReader;

import weka.classifiers.Classifier;

import weka.classifiers.Evaluation;

import weka.classifiers.evaluation.NominalPrediction;

import weka.classifiers.rules.DecisionTable;

import weka.classifiers.rules.PART;

import weka.classifiers.trees.DecisionStump;

import weka.classifiers.trees.J48;

import weka.core.FastVector;

import weka.core.Instances;

@SuppressWarnings("deprecation")

public class WeakTest {

	public static BufferedReader readDataFile(String filename) {

		BufferedReader inputReader = null;

		try {

			inputReader = new BufferedReader(new FileReader(filename));

		} catch (FileNotFoundException ex) {

			System.err.println("File not found: " + filename);

		}

		return inputReader;

	}

	public static Evaluation classify(Classifier model,

			Instances trainingSet, Instances testingSet) throws Exception {

		Evaluation evaluation = new Evaluation(trainingSet);

		model.buildClassifier(trainingSet);

		evaluation.evaluateModel(model, testingSet);

		return evaluation;

	}

	public static double calculateAccuracy(FastVector predictions) {

		double correct = 0;

		for (int i = 0; i < predictions.size(); i++) {

			NominalPrediction np = (NominalPrediction) predictions.elementAt(i);

			if (np.predicted() == np.actual()) {

				correct++;

			}

		}

		return 100 * correct / predictions.size();

	}

	public static Instances[][] crossValidationSplit(Instances data, int numberOfFolds) {

		Instances[][] split = new Instances[2][numberOfFolds];

		for (int i = 0; i < numberOfFolds; i++) {

			split[0][i] = data.trainCV(numberOfFolds, i);

			split[1][i] = data.testCV(numberOfFolds, i);

		}

		return split;

	}

	public static void main(String[] args) throws Exception {

		BufferedReader datafile = readDataFile("E:\\yuce/data.txt");

		Instances data = new Instances(datafile);

		data.setClassIndex(data.numAttributes() - 1);

		// Do 10-split cross validation

		Instances[][] split = crossValidationSplit(data, 10);

		// Separate split into training and testing arrays

		Instances[] trainingSplits = split[0];

		Instances[] testingSplits = split[1];

		// Use a set of classifiers

		Classifier[] models = {

				new J48(), // a decision tree

				new PART(),

				new DecisionTable(),//decision table majority classifier

				new DecisionStump() //one-level decision tree

		};

		// Run for each model

		for (int j = 0; j < models.length; j++) {

			// Collect every group of predictions for current model in a FastVector

			FastVector predictions = new FastVector();

			// For each training-testing split pair, train and test the classifier

			for (int i = 0; i < trainingSplits.length; i++) {

				Evaluation validation = classify(models[j], trainingSplits[i], testingSplits[i]);

				predictions.appendElements(validation.predictions());

				// Uncomment to see the summary for each training-testing pair.

				//System.out.println(models[j].toString());

			}

			// Calculate overall accuracy of current classifier on all splits

			double accuracy = calculateAccuracy(predictions);

			// Print current classifier's name and accuracy in a complicated,

			// but nice-looking way.

			System.out.println("Accuracy of " + models[j].getClass().getSimpleName() + ": "

					+ String.format("%.2f%%", accuracy)

					+ "\n---------------------------------");

		}

	}

}

运行截图

第一周-调用weka算法进行数据挖掘的更多相关文章

第一周总结笔记 / 斯坦福-Machine Learning-Andrew Ng
课程主页:https://www.coursera.org/learn/machine-learning/home/welcome 收集再多的资料也没用,关键是要自己理解总结,做笔记就是一个归纳总结的 ...
Weka算法Classifier-tree-J48源代码分析（一个）基本数据结构和算法
大约一年,我没有照顾的博客,再次拿起笔不知从何写上,想来想去手从最近使用Weka要正确书写. Weka为一个Java基础上的机器学习工具.上手简单,并提供图形化界面.提供如分类.聚类.频繁项挖掘等工具 ...
20172328 2018-2019《Java软件结构与数据结构》第一周学习总结
20172328 2018-2019<Java软件结构与数据结构>第一周学习总结概述 Generalization 本周学习了软件质量.数据结构以及算法分析的具体内容,主要依托于所用教材 ...
20172306 2018-2019 《Java程序设计与数据结构》第一周学习总结
20172306 2018-2019 <Java程序设计与数据结构(下)>第一周学习总结教材学习内容总结第一章概述 (程序=数据结构+算法软件=程序+软件工程) 1.1 软件质量 ...
20172302 《Java软件结构与数据结构》第一周学习总结
2018下半年学习总结博客总目录:第一周教材学习内容总结第一章概述 1.软件质量软件工程(Software Engineering)是一门关于高质量软件开发的技术和理论的学科. 软件质量从以下 ...
20172308《Java软件结构与数据结构》第一周学习总结
教材学习内容总结第 1 章概述软件质量的特征:正确性.可靠性.健壮性.可用性.可维护性.可重用性(别人写的组件自己可以拿过来用).可移植性.运行效率数据结构:计算机存储.组织数据的方式程序 ...
20172329 2018-2019《Java软件结构与数据结构》第一周学习总结
2018-2019-20172329 <Java软件结构与数据结构>第一周学习总结在这学期就已经大二了,也已经步入了学习专业课的核心时间,在这个阶段,我们应该了解自己的学习情况,针对自己 ...
20172305 2018-2019-1 《Java软件结构与数据结构》第一周学习总结
20172305 2018-2019-1 <Java软件结构与数据结构>第一周学习总结教材学习内容总结本周内容主要为书第一章和第二章的内容: 第一章软件质量: 正确性(软件达到特定需 ...
在Eclipse中调用weka包实现分类
1.如题. 最近写了一个FCM的聚类算法,希望能够可视化结果,因此一个想法是调用weka中的包,使自己的程序可以可视化.这里参考了网络上的方法,首先实现在Eclipse中调用weka包实现分类的功能. ...

随机推荐

轻量级监控平台之cpu监控
轻量级监控平台之cpu监控脚本 #!/bin/bash #进程监控脚本 #功能需求: 上报机器的硬件层面-cpu负载数据 . /etc/profile . ~/.bash_profile pushur ...
Day12- Python基础12 线程、GIL、Lock锁、RLock锁、Semaphore锁、同步条件event
http://www.cnblogs.com/yuanchenqi/articles/6248025.html 博客地址本节内容: 1:进程和线程的说明 2:线程的两种调用方式 3:threadi ...
ora-12505报错解决方法（转）
用oracle数据库新建连接时遇到ora-12505,此问题解决后又出现ora-12519错误,郁闷的半天,经过一番折腾问题解决,下面小编把我的两种解决方案分享给大家,仅供参考. 解决方案一: 今天工 ...
flex.css声明式布局
flex.css能完美的运行在移动端的各种浏览器,甚至能运行在ie10+的各种PC端浏览器中 flex和data-flex flex.css 有两个版本,一个是flex.css一个是data-flex ...
【CodeForces】CodeForcesRound594 Div1 解题报告
点此进入比赛 \(A\):Ivan the Fool and the Probability Theory(点此看题面) 大致题意: 给一个\(n\times m\)的矩阵\(01\)染色,使得不存在 ...
Update 19.11 for Azure Sphere
今天,微软发布了面向Azure Sphere的19.11更新,其主要亮点就是加入了对开发工具Visual Studio Code和Linux开发环境的支持.具体来讲,本次更新包含3个部分: 1. Az ...
重载&重写的区别
重载(Overload) 1.重载(Overload)是让类以统一的方式处理不同类型数据的一种手段.多个同名函数同时存在,具有不同的参数个数/类型. 2.重载(Overload)是一个类中多态性的一种 ...
如何查看laravel门脸类包含方法的源码
以Route门脸类为例,我们定义路由时使用的就是Route门脸类,例如我们在web.php中定义的路由 use Illuminate\Support\Facades\Route; Route::get ...
HTTP 状态码及含义
来自 Koa.js 官方文档中关于设置请求响应的部分 response.status=,列出了从 1xx ~ 5xx HTTP 状态码及含义,现摘录如下: 100 "continue&quo ...
PlayJava Day007
今日所学: /* 2019.08.19开始学习,此为补档. */ 1.String类实例化:①String name1 = "张三" ; ②String name2 = new ...

第一周-调用weka算法进行数据挖掘

第一周-调用weka算法进行数据挖掘的更多相关文章

随机推荐

热门专题