ARFF文件格式
Attribute -Relation File Format (ARFF)
此文档翻译自http://www.cs.waikato.ac.nz/~ml/weka/arff.html。文档写的比较粗糙,敬请原谅。
可以推荐一篇文档写的还不错:http://www.cnblogs.com/htynkn/archive/2012/03/30/weka_2.html
1、ARFF 头章节包括关系声明和属性声明
关系声明(@ralation Declaration)
关系声明在ARFF文件的第一行定义。格式如下:
@relation <ralation-name>
<ralation-name>是一个字符串。如果名字包含空格,那么这个字符串必须加引号。
属性声明(The @attribute Decarations)
属性声明是以一个有序的属性陈列的形式表述的。数据中的每一个属性都有它自己的@attribute声明,以确保独立的定义那个属性和它的数据类型。
@attribute声明的格式为
@attribute <attribute-name> <datatype>
此处,<attribute-name>必须以字母开头。如果名字中包含空格,那么整个名字必须加引号。
<datatype> 可以是以下weka(version 3.2.1)包含的任意的数据形式
- numeric 
- <nominal-specification> - 这种类型主要标注类别名称 
- string 
- date [<date-format>] 
2、然后就是ARFF 数据章节也就是数据部分@data Declaration
数据声明是以@data作为一个单独的行来分割文件的。
下面给出一个ARFF
文件格式的例子
% 1. Title: Iris Plants Database
%
% 2. Sources:
% (a) Creator: R.A. Fisher
% (b) Donor: Michael Marshall (MARSHALL%PLU@io.arc.nasa.gov)
% (c) Date: July, 1988
%
@RELATION iris @ATTRIBUTE sepallength NUMERIC
@ATTRIBUTE sepalwidth NUMERIC
@ATTRIBUTE petallength NUMERIC
@ATTRIBUTE petalwidth NUMERIC
@ATTRIBUTE class {Iris-setosa,Iris-versicolor,Iris-virginica}
The Data of the ARFF file looks like the following:
@DATA
5.1,3.5,1.4,0.2,Iris-setosa
4.9,3.0,1.4,0.2,Iris-setosa
4.7,3.2,1.3,0.2,Iris-setosa
4.6,3.1,1.5,0.2,Iris-setosa
5.0,3.6,1.4,0.2,Iris-setosa
5.4,3.9,1.7,0.4,Iris-setosa
4.6,3.4,1.4,0.3,Iris-setosa
5.0,3.4,1.5,0.2,Iris-setosa
4.4,2.9,1.4,0.2,Iris-setosa
4.9,3.1,1.5,0.1,Iris-setosa
ARFF文件格式的更多相关文章
- Weka中数据挖掘与机器学习系列之数据格式ARFF和CSV文件格式之间的转换(五)
		不多说,直接上干货! Weka介绍: Weka是一个用Java编写的数据挖掘工具,能够运行在各种平台上.它不仅提供了可以直接用于数据挖掘的软件,还提供了src代码,使用者可以修改源代码,进行二次开发. ... 
- 生成arff文件,csv转为arff
		一.什么是arff格式文件 1.arff是Attribute-Relation File Format缩写,从英文字面也能大概看出什么意思.它是weka数据挖掘开源程序使用的一种文件模式.由于weka ... 
- weka数据挖掘拾遗(一)---- 生成Arff格式文件
		一.什么是arff格式文件 1.arff是Attribute-Relation File Format缩写,从英文字面也能大概看出什么意思.它是weka数据挖掘开源程序使用的一种文件模式.由于weka ... 
- Weka里如何将arff文件或csv文件批量导入MySQL数据库(六)
		这里不多说,直接上干货! 前提博客是 Weka中数据挖掘与机器学习系列之数据格式ARFF和CSV文件格式之间的转换(四) 1.将arff文件批量导入MySQL数据库 我在这里,arff文件以Weka安 ... 
- RIFF和WAVE音频文件格式
		RIFF file format RIFF全称为资源互换文件格式(Resources Interchange File Format),是Windows下大部分多媒体文件遵循的一种文件结构.RIFF文 ... 
- JavaSe:Properties文件格式
		Properties文件格式说明 Properties继承自Hashtable,是由一组key-value的集合. 在Java中,常用properties文件作为配置文件.它的格式是什么样的呢? 下图 ... 
- Dotnet文件格式解析
		0x0.序 解析过程并没有介绍对pe结构的相关解析过程,网上此类相关资料很多可自行查阅,本文只介绍了网上资料较少的从pe结构的可选头中的数据目录表中获取dotnet目录的rva和size,到完全解析d ... 
- Reverse Core 第二部分 - 13章 - PE文件格式
		@date: 2016/11/24 @author: dlive  PE (portable executable) ,它是微软在Unix平台的COFF(Common Object File For ... 
- iOS 图片文件格式判断、圆角图片
		1.圆角图片 // 设置圆形图片(放到分类中使用) - (UIImage *)cutCircleImage { UIGraphicsBeginImageContextWithOptions(self. ... 
随机推荐
- (用微信扫的静态链接二维码)微信native支付模式官方提供的demo文件中的几个bug修正
			native支付模式一demo(用微信扫的静态链接二维码)BUG修复,一共4个BUG 1.native_call_qrcode.php这个文件中的代码无法生存native支付的短地址2.WxPayPu ... 
- PHP学习心得(六)——变量
			PHP 中的变量用一个美元符号后面跟变量名来表示.变量名是区分大小写的.一个有效的变量名由字母或者下划线开头,后面跟上任意数量的字母,数字,或者下划线.$this 是一个特殊的变量,它不能被赋值.PH ... 
- hdu 5654 xiaoxin and his watermelon candy 树状数组维护区间唯一元组
			题目链接 题意:序列长度为n(1<= n <= 200,000)的序列,有Q(<=200,000)次区间查询,问区间[l,r]中有多少个不同的连续递增的三元组. 思路:连续三元组-& ... 
- Oracle控制文件丢失,日志文件丢失
			控制文件丢失: alter database backup controlfile to traces; shutdown immediate; @j:\db\script\orcl_ora_ctl_ ... 
- NGUI系列教程六(技能冷却的CD效果)
			今天来学习一下,如何利用NGUI做技能冷却的CD效果. 1,首先按之前的教程Create Your UI,Camera为Simple 2D 最终如下图: 2,添加一个按钮,Background 为一张 ... 
- CODEVS 2055 集合划分
			[题目描述] 对于从1到N(1<=N<=39)的连续整数集合,划分成两个子集合,使得每个集合的数字之和相等. 举个例子,如果N=3,对于{1,2,3}能划分成两个子集合,他们每个的所有数字 ... 
- to debug asp.net mvc4
			Go to Tools -> Options -> Debugger -> General Uncheck the option Enable Just My Code (Manag ... 
- Adapting to views using css or js
			using css @media screen and (-ms-view-state: fullscreen-landscape) { } @media screen and (-ms-view-s ... 
- 安装ubuntu12.04LTS卡住以及花屏问题
			昨天在XP下用grub4dos安装了ubuntu12.04LTS,总体上还算比较顺利,中途有碰到两个异常问题,解决了记录一下. 问题一:安装过程中读取ISO镜像文件时,卡在"checking ... 
- C#.NET连接mysql方法
			C#访问MySQL数据库的方法 (1)首先需要下载C#访问MySQL数据库的ADO.NET驱动程序 下载地址为: http://dev.mysql.com/downloads/connector/ne ... 
