数据分析 --数据的认识

数据集由数据对象组成

一个数据对象代表一个实体(entity)
数据对象又称为样本、实例、数据点、或对象
数据行对应数据对象; 列对应属性
数据对象用属性(attribute)描述
属性(attribute)是一个数据字段,表示数据对象的一个特征

类型

标称属性(nominal)

标称属性(nominal attribute) 其值是一些符号或者事物的名称。

二元属性(binary)

是一种标称属性,只有两个状态:0或1。
对称的(symmetric): 两种状态具有同等价值,携带相同权重。
非对称的(asymmetric): 其状态的结果不是同样重要

序数属性(ordinal)

其可能的值之间具有有意义的序或者秩评定(ranking),但是相继值之间的 差是未知的。

数值属性(numeric)

区间标度(interval-scaled)属性
比率标度(ratio-scaled)属性

离散属性(discrete Attribute)

具有有限或者无限可数个值。
如: 邮编、省份数目具有有限个值,customer_Id是无 限可数的。
可以用或者不用整数表示。

连续属性(Continuous Attribute)

属性值为实数。
一般用浮点变量表示。

目的

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值