###################################################

问题:数据框 data.frame 查、排序等,   18.4.27

怎么对数据框 data.frame实施 查询位置、查询满足条件的个案数、、排序、 ???

解决方案:

#查询位置

weizhi <- which(iris$Sepal.Length >= 6.9)   #返回一个向量,显示的是所有 >=6.9的行的行号

max(iris$Sepal.Length)    #[1] 7.9

which(iris$Sepal.Length == max(iris$Sepal.Length))   #[1] 132

which(iris$Species == "setosa" & iris$Sepal.Length >= 5.1)   #which 返回满足其内条件的元素的位置。

x[x==3] <- 25;x    #将x中等于3的元素值变为25

x[x=1] <- 12;x    #将x的第1个元素数值变为12

which.max(a)    # 找出最大元素的下标

which.min(a)    # 找出大小的元素下标

which(a==2)    # 等于2的元素的下标

which(a>5)     # 大于5的元素的下标

a[which.max(a)]    # 找出最大的元素

a[which(a>5)]    # 所有的值大于5的元素

#查询满足条件的个案数

length(which(iris$Species == "setosa" & iris$Sepal.Length >= 5.1))

sum(iris$Sepal.Length >= 6)    #统计个数,统计 iris$Sepal.Length 中大于等于6的数有多少个

#排序

#order();   #输出原行号,按照要求排序后的向量  order返回的是排序后的索引。

order(iris$Sepal.Length)    #[1]  9  4  7  3  2 10  5  8  1  6 ;返回原来的行号按照iris$Sepal.Length排序后的向量

inew = iris[order(iris$Sepal.Length),]   #由于要对行排序,所以条件要写在 中括号内 行的位置。

inew2 = iris[order(iris$Sepal.Length,-iris2$Sepal.Width),]  #默认升序  本例按iris$Sepal.Length升序,按iris$Sepal.Width降序。

#sort();   #直接输出排序后的结果。

讨论扩展:

另请参阅:

###################################################

问题:筛选子集(行子集)   18.4.24

根据 data.frame 中某列,如何筛选满足条件的行,组成一个子集

解决方案:

cond <-  iris$Species == "setosa" & iris$Sepal.Length >= 5.1   #筛选条件,返回一个与 iris$Species 长度相同的布尔向量。满足条件的为TRUE。

# 和&  或|  不等于!=  大于>  小于< ,自由组合      #如果筛选对象是因子变量,需要带引号    == “”

筛选子集 法一:用 subset 选子集

iris_setosa1 <- subset(iris,cond);

iris_setosa1 <- subset(iris,cond,select = c(1:3));   #select 用来选择 “只取select内的列” 。

iris.del.col2 <- subset(iris,cond,select = -Sepal.Width)

iris.del.col2 <- subset(iris,cond,select = c(-Sepal.Width,-Petal.Width))    #以下均可:select = c(Sepal.Width,Petal.Width)  select = c(Sepal.Width,5)

筛选子集 法二:

iris_setosa2 <- iris[cond,];

newdata <- iris[which(cond),c(1,2,5)]   #选择满足条件的行和列,一并生成新变量

讨论扩展:

对列筛选:

subset(dfrm,select=c(colname1,colname2,...,colnames),subset = (temp));   #同时实现对行、列的筛选。。内部subset对行进行筛选。

student[which(student$Gender==”F”),”Age”]     #筛选后,只取“Age列”,条件得到一个布尔向量:FALSE FALSE  TRUE,然后使用which函数可以将布尔向量中TRUE的Index返回,

iris.Species2 = iris[iris$Species == "setosa",]    #等价,更常用。和& 或| 不等于!= 大于> 小于< ,自由组合

#如果筛选对象是因子变量,需要带引号 == “”

newdata <- iris[which(iris$Species =='setosa' & iris$Sepal.Length > 5.0),c(1,2,5)]

iris_6 <- subset(iris,iris$Sepal.Length >6 | iris$Sepal.Width>4,select = c(1:3))

另请参阅:

R: data.frame 数据框的:查询位置、排序(sort、order)、筛选满足条件的子集。。的更多相关文章

  1. R语言Data Frame数据框常用操作

    Data Frame一般被翻译为数据框,感觉就像是R中的表,由行和列组成,与Matrix不同的是,每个列可以是不同的数据类型,而Matrix是必须相同的. Data Frame每一列有列名,每一行也可 ...

  2. 转载:R语言Data Frame数据框常用操作

    Data Frame一般被翻译为数据框,感觉就像是R中的表,由行和列组成,与Matrix不同的是,每个列可以是不同的数据类型,而Matrix是必须相同的. Data Frame每一列有列名,每一行也可 ...

  3. 用R语言提取数据框中日期对应年份(列表转矩阵)

    用R语言提取数据框中日期对应年份(列表转矩阵) 在数据处理中常会遇到要对数据框中的时间做聚类处理,如从"%m/%d/%Y"中提取年份. 对应操作为:拆分成列表——列表转矩阵——利用 ...

  4. R语言中将数据框(data.frame)中字符型数据转化为数值型

    as.data.frame(lapply(data,as.numeric))

  5. R语言学习——数据框

    > #数据框可以包含不同模式(数值型.字符型.逻辑型等)的数据,是R中最常处理的数据结构.数据框可以通过函数data.frame()创建:mydata<-data.frame(coll,c ...

  6. 2-7 R语言基础 数据框

    #数据框 > df <- data.frame(id=c(1,2,3,4),name=c("a","b","c","d ...

  7. R: data.frame 生成、操作数组。重命名、增、删、改

    ################################################### 问题:生成.操作数据框   18.4.27 怎么生成数据框 data.frame.,,及其相关操 ...

  8. R Data Frame

    https://www.datamentor.io/r-programming/data-frame/ Check if a variable is a data frame or not We ca ...

  9. R语言中数据框的横向合并与纵向合并

    #横向合并ID<-c(1,2,3,4)name<-c("Jim","Tony","Lisa","Tom")s ...

随机推荐

  1. python 删除文件中指定行

    代码适用情况:xml文件,循环出现某几行,根据这几行中的某个字段删掉这几行这段代码的作用删除jenkins中config.xml中在自动生成pipline报错的时的回滚 start = '<se ...

  2. 在Ubuntu上为Android系统的Application Frameworks层增加硬件访问服务【转】

    本文转载自:http://blog.csdn.net/luoshengyang/article/details/6578352 在数字科技日新月异的今天,软件和硬件的完美结合,造就了智能移动设备的流行 ...

  3. java深入探究07-jsp

    RequestDispatcher是web资源包装类<jsp:include>只能实现固定jsp文件名他可以翻译为:RequestDispatcher(filename).include( ...

  4. Logstash的插件

    Logstash的插件: input插件: File:从指定的文件中读取事件流: 使用FileWatch(Ruby Gem库)监听文件的变化. .sincedb:记录了每个被监听的文件的inode, ...

  5. Python- 贪婪与非贪婪

    python运行匹配时,如果没有人为限定,默认是贪婪模式. import re a = 'python 22222java34bigdata' r = re.findall('[a-z]{3}',a) ...

  6. linux rpm包的编译

    有些软件包的特性是编译者选定的,如果编译未选定此特性,将无法使用.rpm包的版本落后于源码包. 因此需要定制安装,也就是手动编译安装. 编译需要编译环境. 编译的过程如下: 1.下载源码 2.执行 t ...

  7. 兼容IE8及其他浏览器的回车事件

    //阻止默认浏览器行为 function stopDefault(e) { //如果提供了事件对象,则这是一个非IE浏览器 if(e && e.preventDefault) { // ...

  8. spring.jar的下载地址

    http://repo.spring.io/release/org/springframework/spring/

  9. jQuery应用之eraser.js使用,实现擦除、刮刮卡效果

    jquery.eraser是一款使用鼠标或触摸的动作来擦除画布显示真正图片的插件.jquery.eraser插件的原理是用一个画布遮住图片,然后根据触摸或鼠标输入来擦除画布显示图片,您可以在参数中指定 ...

  10. java 任务调度实现的总结

    Timer Timer的核心是Timer和TimerTask,Timer负责设定TimerTask的起始与间隔执行时间,使用者需要建立一个timeTask的继承类,实现run方法,然后将其交给Time ...