2021-05-10

【R语言--dcast--errors】Aggregation function missing: defaulting to length; 转化后的值变成了0,1

详情参见微信公众号【 阿呆ForFun

https://mp.weixin.qq.com/s/6TSjndPie_RSwyzidYyXyA

 

dcast函数

dcast函数是 reshape2包中的一个常用函数,主要功能是将长格式数据转换为宽格式数据(Long- to wide-format data),类似Excel的数据透视表的操作。

 

Usage

dcast(  data,  formula,  fun.aggregate = NULL,  sep = "_",  ...,  margins = NULL,  subset = NULL,  fill = NULL,  drop = TRUE,  value.var = guess(data),  verbose = getOption("datatable.verbose"))

说明

图片

An illustration of the dcast function

图片来源:https://seananderson.ca/2013/10/19/reshape/

 


Bugs:

利用dcast函数做数据转化时,出现如下提示,并且转化后的值变成了0,1

Aggregation function missing: defaulting to length

举例说明:

# 原始数据head(data)student    test    scoreAdam      Exam1     80Adam      Exam2     90John      Exam1     70John      Exam2     60
dcast(data,student~test,value.var='score')# 期望利用dcast 将数据转化Student    Exam1     Exam2Adam        0          0John        0          1

所有的值都变成了 0,1;还给出如下提示

Aggregation function missing: defaulting to length

 

Solutions:

很大可能是原始数据有重复,例如

student    test    scoreAdam      Exam1     80Adam      Exam1     85Adam      Exam2     90John      Exam1     70John      Exam2     60

检查数据是否有重复,如下(检查第一列,第二列是否有重复的行)

dupli<-data[duplicated(data[,1:2]),]

如果有重复,去掉重复,或者增加一个聚合函数 fun.aggregate

因为默认的聚合函数是 length,所以会出现所有值变成 0,1的情况。

可以设置 fun.aggregate = [sum| mean| sd ]等。

例如:

data1<-dcast(data,var1~var2,value.var = "var3",fun.aggregate = mean)

 

 

参考:

(1)https://www.codenong.com/33051386/

(2)https://stackoverflow.com/questions/30463591/r-reshape2-aggregation-function-missing-defaulting-to-length/34882664

(3)  https://stackoverflow.com/questions/6986657/find-duplicated-rows-based-on-2-columns-in-data-frame-in-r

(4) https://www.rdocumentation.org/packages/maditr/versions/0.7.4/topics/dcast

  • 3
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
这个数据可以使用Python进行解析和处理。可以按照以下步骤进行: 1. 将数据分割成每个数据项。 ``` data_items = data.split(',') ``` 2. 对于每个数据项,将其按#分割成四个小项,并存储到一个列表中。 ``` data_list = [] for item in data_items: item_list = item.split('#') data_list.append(item_list) ``` 3. 对于每个小项,进行相应的类型转换。 ``` for item in data_list: item[0] = int(item[0]) # 题号转换为整数 item[1] = datetime.datetime.strptime(item[1], '%Y-%m-%d %H:%M:%S') # 时间转换为datetime类型 if item[2] != '': # 操作类型转换为整数 item[2] = int(item[2]) item[3] = str(item[3]) # 科目转换为字符串类型 ``` 4. 可以按照需要对数据进行进一步处理,如按照题号、时间等进行排序、筛选等操作。 完整的Python代码如下: ``` import datetime data = '''1#2021-05-18 14:31:55##初级会计实务,2#2021-05-18 14:31:57#12#初级会计实务,2#2021-05-18 14:32:08##初级会计实务,3#2021-05-18 14:32:09#12#初级会计实务,4#2021-05-18 14:32:34#12#初级会计实务,4#2021-05-18 14:32:45##初级会计实务,5#2021-05-18 14:32:46#12#初级会计实务,5#2021-05-18 14:32:57##初级会计实务,6#2021-05-18 14:33:00#12#初级会计实务,7#2021-05-18 14:33:44#12#初级会计实务,7#2021-05-18 14:34:42##初级会计实务,8#2021-05-18 14:34:43#12''' # 将数据分割成每个数据项 data_items = data.split(',') # 对于每个数据项,将其按#分割成四个小项,并存储到一个列表中 data_list = [] for item in data_items: item_list = item.split('#') data_list.append(item_list) # 对于每个小项,进行相应的类型转换 for item in data_list: item[0] = int(item[0]) # 题号转换为整数 item[1] = datetime.datetime.strptime(item[1], '%Y-%m-%d %H:%M:%S') # 时间转换为datetime类型 if item[2] != '': # 操作类型转换为整数 item[2] = int(item[2]) item[3] = str(item[3]) # 科目转换为字符串类型 print(data_list) ```

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值