R语言重要数据集分析研究——R语言数据集的字段含义

 

R语言数据集的字段含义

作者:马文敏

 

选择一种数据结构来储存数据

将数据输入或导入到这个数据结构中

数据集的概念

数据集通常是有数据结构的一个矩形数组,行表示规则,列表示变量。

不同的行业对数据集的行和列的叫法不同

统计学家称他们为观测和变量

数据库分析为记录和字段

示例分析者叫他们示例

R语言可以处理的数据类型有很多种包括数据型,字符型,逻辑性,原生性。

2.数据结构

R语拥有很多用于储存数据的对象类型,包括标量,向量,矩阵,数组,数据框和列表。

向量

向量数据必须要有相同的类型和模式的数据,通过给定的元素数值可以访问向量中的元素,用函数c()可创建向量。

myymatrix<-

Matrix(vector.nrow=number

其中vector包含了矩阵的元素,nrow和ncol用于指定的行和列的维数,dimnames包含了可选的,以字符型的向量表示行名和列名,选型byrows则表明矩阵应当按行填充。

矩阵

矩阵是一个二维数组,他通过函数matrix()创建,每一个元素都拥有相同的模式(数值型,字符型,逻辑型)

提取矩阵中的元素时用[.],其中逗号前后分辨率是,行数和列数。

两行的矩阵。

X #查看矩阵内容

数组

数组和矩阵比较类似,但是维度可以大于2。但是他是一个数值型向量,可通过函数ayyay来创建,形式为myarry<-array(vector,dimensions,dimnames0000)其中vector包含了数组中的数据,dimensions是一个数值型向量,给出了各个维度下标的最大值,而dimnames是可选的,各维度名称标签的列表。

数据框

 

数据框是在R语中比较常见的数据结构。他的作用是当数据有多种模式而无法将这些数据放在一个矩阵中时,这时候就可以选择数据框,同一行列的数据模式必须相同,可通过data,frame()来创建。

使用¥来提取数据库中的特定元素,但是每次输入数据框名,有点麻烦。

列表

列表是R的数据类型中最为复杂的一种,列表就是一些对象的有序集合。列表允许整合若干的对象到单个对象名下。例如,某个列表中可能是若干向量,矩阵,数据框,甚至其他列表组合。可以使用函数list()创建列表。

列表是R中重要的数据结构

列表允许以一种简单的方式组织和重新调用不相干的信息

许多R函数的运行结果都是以列表的形式返回的。

3.数据输入

 

数据输入可以使用read.table()文本文件中导入数据。

算数表达式。他是直接输入的,输入完成之后按下回车键显示结果,如果想保存输入结果,直接将其命名一个变量即可。

样本数据输入。最常使用的是c()函数,括号内的内容可以是数字或文本,也可以是储存结果的变量,内容间用逗号分隔,如果既有文本也有数字,那么数字将会被强制转换为文本。

数据导入。当数据量较大时,使用c函数和scan函数就会不太方便,虽然scan函数也可以进行文件导输但是主要针对一维数据,当遇到复杂一些数据时,需要使用其他的函数。

参考文献:

百度---E书联盟

火狐---科普中国百科科学词条

火狐---CSDN博客

posted @ 2017-05-30 16:42  酷酷的腾  阅读(1527)  评论(2编辑  收藏  举报