r table
一、table 函数对应的就是统计学中的列联表,是一种记录频数的方法,对于统计来说有非常重要的应用,下面的例子都是针对维数为2的情况举例,多维的情况是类似的
下面看一个例子:
- > ct <- data.frame(
- + Vote.for.X = factor(c("Yes", "Yes", "No", "Not Sure", "No"), levels = c("Yes", "No", "Not Sure")),
- + Vote.for.X.Last.Time = factor(c("Yes", "No", "No", "Yes", "No"), levels = c("Yes", "No"))
- + )
- > ct
- Vote.for.X Vote.for.X.Last.Time
- 1 Yes Yes
- 2 Yes No
- 3 No No
- 4 Not Sure Yes
- 5 No No
- > cttab <-table(ct)
- > cttab
- Vote.for.X.Last.Time
- Vote.for.X Yes No
- Yes 1 1
- No 0 2
- Not Sure 1 0
首先我们创建了一个示例数据集合,其中我们指定我们的因子的水平,然后 table 函数则是统计所有因子对出现的情况的频数
下面看一下 cttab 的特点:
- > mode(cttab)
- [1] "numeric"
- > str(cttab)
- 'table' int [1:3, 1:2] 1 0 1 1 2 0
- - attr(*, "dimnames")=List of 2
- ..$ Vote.for.X : chr [1:3] "Yes" "No" "Not Sure"
- ..$ Vote.for.X.Last.Time: chr [1:2] "Yes" "No"
- > summary(cttab)
- Number of cases in table: 5
- Number of factors: 2
- Test for independence of all factors:
- Chisq = 2.9167, df = 2, p-value = 0.2326
- Chi-squared approximation may be incorrect
- > attributes(cttab)
- $dim
- [1] 3 2
- $dimnames
- $dimnames$Vote.for.X
- [1] "Yes" "No" "Not Sure"
- $dimnames$Vote.for.X.Last.Time
- [1] "Yes" "No"
- $class
- [1] "table"
二、table对象的操作
一个必须要掌握的操作,addmargins
- > addmargins(cttab)
- Vote.for.X.Last.Time
- Vote.for.X Yes No Sum
- Yes 1 1 2
- No 0 2 2
- Not Sure 1 0 1
- Sum 2 3 5
下面取出各维度的名字,也就是各个的水平
- > dimnames(cttab)
- $Vote.for.X
- [1] "Yes" "No" "Not Sure"
- $Vote.for.X.Last.Time
- [1] "Yes" "No"
下面提取感兴趣的子表:subtable 类比 subset
subtable(tbl,subnames) tbl 感兴趣的表,subnames 一个类表,列出自己各个维度感兴趣的水平, subtable 实现如下
- subtable <- function(tbl, subnames) {
- #将 table 转换称 array 获得 table 里面的所有元素
- tblarray <- unclass(tbl)
- #将 tblarray 以及 subnames 组合到一个list中
- dcargs <- list(tblarray)
- ndims <- length(subnames)
- for(i in 1:ndims) {
- dcargs[[i+1]] <- subnames[[i]]
- }
- #等价与执行 dcargs[[1]][dcargs[[2]][i], dcargs[[3]][j]] i,j 取遍所有该属性的元素
- subarray <- do.call("[", dcargs)
- #对list中的每一个属性调用 length
- dims <- lapply(subnames, length)
- subtbl <- array(subarray, dims, dimnames = subnames)
- class(subtbl) <- "table"
- return(subtbl)
- }
下面给出一个例子:可能很有用的
- > as.data.frame(cttab)
- Vote.for.X Vote.for.X.Last.Time Freq
- 1 Yes Yes 1
- 2 No Yes 0
- 3 Not Sure Yes 1
- 4 Yes No 1
- 5 No No 2
- 6 Not Sure No 0
tabdom 计算table的统计频率
- tabdom <- function(tbl, k) {
- tbldf <- as.data.frame(tbl)
- freqord <- order(tabldf$Freq, decreasing=TRUE)
- dom <- tbldf[freqord, ][1:k]
- return(dom)
- }
注意:aggregate() 函数 cut() 函数
r table的更多相关文章
- JQuery操作TABLE,及console.info问题。
还用alert 吗?看看console.info吧,代码的测试平台:ie9, firefox12 1. [代码][JavaScript]代码<!DOCTYPE html><html ...
- bzoj1266最短路+最小割
本来写了spfa wa了 看到网上有人写Floyd过了 表示不开心 ̄へ ̄ 改成Floyd试试... 还是wa ヾ(。`Д´。)原来是建图错了(样例怎么过的) 结果T了 于是把Floyd改回spfa 还 ...
- HBase 数据模型(Data Model)
HBase Data Model--HBase 数据模型(翻译) 在HBase中,数据是存储在有行有列的表格中.这是与关系型数据库重复的术语,并不是有用的类比.相反,HBase可以被认为是一个多维度的 ...
- javascript基础05
javascript基础05 1.变量的作用域 变量既可以是全局,也可以是局部的. 全局变量:可以在脚本中的任何位置被引用,一旦你在某个脚本里声明了全局变量,你就可以 在这个脚本的任何位置(包括函数内 ...
- lua52 C API测试代码
//这是一篇lua与C++交互的情景测试 #include <lua.hpp> #include <lauxlib.h> #include <lualib.h> # ...
- [python] 常用正则表达式爬取网页信息及分析HTML标签总结【转】
[python] 常用正则表达式爬取网页信息及分析HTML标签总结 转http://blog.csdn.net/Eastmount/article/details/51082253 标签: pytho ...
- (WPF) 基本题
What is WPF? WPF (Windows Presentation foundation) is a graphical subsystem for displaying user inte ...
- Mysql 关键字及保留字
Table 10.2 Keywords and Reserved Words in MySQL 5.7 ACCESSIBLE (R) ACCOUNT[a] ACTION ADD (R) AFTER A ...
- hbase scan 的例子
/** * Created by han on 2016/1/28. */ import org.apache.hadoop.conf.Configuration; import org.apache ...
随机推荐
- SaaS多租户模式数据存储方案
云计算多租户几乎用于所有软件即服务 (Software as a Service, SaaS) 应用程序,因为计算资源是可伸缩的,而且这些资源的分配由实际使用决定.话虽如此,用户可以通过 Intern ...
- Android自己定义ViewGroup(二)——带悬停标题的ExpandableListView
项目里要加一个点击可收缩展开的列表,要求带悬停标题,详细效果例如以下图: watermark/2/text/aHR0cDovL2Jsb2cuY3Nkbi5uZXQv/font/5a6L5L2T/fon ...
- Javascript的&&和||的另类用法
Javascript的&&和||的另类用法. 又开始研究起 Titanium 来,发现其官方出品的MVC框架(Alloy)还是挺不错的,刚开始苦于没有好的代码来学习,文档又少,所以一直 ...
- git提交本地代码到新分支
背景: 从branchA分支拉了一份代码,做了一些修改,但是不想提交到branchA分支,想新建一个分支branchB保存代码. 操作方法: 添加本地需要提交代码 git add . 提交本地代码 g ...
- (原)logstash-forwarder + logstash + elasticsearch + kibana
[logstash-forwarder + logstash + elasticsearch + kibana]-------------------------------------------- ...
- DIOCP开源项目-高效稳定的服务端解决方案(DIOCP + 无锁队列 + ZeroMQ + QWorkers) 出炉了
[概述] 自从上次发布了[DIOCP开源项目-利用队列+0MQ+多进程逻辑处理,搭建稳定,高效,分布式的服务端]文章后,得到了很多朋友的支持和肯定.这加大了我的开发动力,经过几个晚上的熬夜,终于在昨天 ...
- 【Linux技术】Windows与Linux系统下的库·初探
库的定义 库文件是一些预先编译好的函数的集合,那些函数都是按照可再使用的原则编写的.它们通常由一组互相关联的用来完成某项常见工作的函数构成,从本质上来说库是一种可执行代码的二进制形式,可以被操作系统 ...
- IntelliJ IDEA 14.1.4破解方法-通过程序根据用户名生成注册码
将下面的代码拷贝到Eclipse或者其他的开发工具中,在main方法中指定自己的用户名(随意),运行main方法,在控制台即可生成注册码.然后启动IntelliJ IDEA 14.1.4,然后根据提示 ...
- vs code 快捷键的使用
vs code 快捷键的使用 shift + f12 快速查找函数的生成Ctrl+F12 查看单个函数的定义Shift+F12 查看所有函数的定义ctrl + ` 是打开运行的程序ctrl + Tab ...
- vue中$router和$route的区别
$router是VueRouter的实例,在script标签中想要导航到不同的URL,使用$router.push方法. 返回上一个历史history用$router.to(-1) $route为当前 ...