2024年最全用python进行数据分析葡萄酒,哪里最好_3898 葡萄酒 kaggle

区域2(Region 2):有时在葡萄酒产区内有更具体的区域,但是这个值有时可能是空白的。本想把有缺失值的记录去掉,去掉后发现只有US的葡萄酒信息,所以没去除存在缺失值的记录。描述(Description):侍酒师的几句话描述酒的味道,气味,外观,感觉等。这样就可以看到,大部分的价格是在0-100(好像数据集提供者没告诉我价格的单位)发现评分相同的葡萄酒,价格还是差异挺大,特别是评分较高的葡萄酒价格的差异。发现价格集中在图示的最左端,因为有特殊离群值的影响,所以区间给的特别宽。
摘要由CSDN通过智能技术生成

我就去kaggle上瞄了一眼

打开了新世界的大门!

kaggle上有世界各国网友提供的数据集

https://www.kaggle.com/datasets

我这次选了个葡萄酒评分的数据

下载下来之后

内容是这样的

一共有150929条记录

数据集的描述是这样的:

在观看Somm(侍酒师纪录片)之后,数据及提供者想知道如何创建一个预测模型,通过像侍酒师那样的盲品来鉴别葡萄酒。 第一步是收集一些数据来训练一个模型。 他打算根据品酒的描述/评论中使用的单词利用深度学习来预测葡萄酒品种。 该模型虽然不能品尝葡萄酒,但理论上可以基于侍酒师可以给出的描述来识别葡萄酒。

小编百度了一下Somm的影片信息如下:

我们看看各字段含义:

评分(Points):评分为1-100

品种(Variety):用来制作葡萄酒的葡萄品种

描述(Description):侍酒师的几句话描述酒的味道,气味,外观,感觉等。

国家(Co

  • 4
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值