数据清洗
文章平均质量分 88
金砖数据清洗
黑神666
这个作者很懒,什么都没留下…
展开
-
python数据处理快速入门9~10
9.1简介 pandas提供了一些用于将表格型数据读取为DataFrame对象的函数。下面的图片对它们进行了总结,其中read_csv和read_table可能会是你今后用得最多的。 我将大致介绍一下这些函数在将文本数据转换为DataFrame时所用到的一些技术。这些函数的选项可以划分为以下几个大类: 索引:将一个或多个列当做返回的DataFrame处理,以及是否从文件、用户获取列名。 类型推断和数据转换:包括用户定义值的转换、和自定义的缺失值标记列表等。 日期解析:包括组合功能,比.转载 2021-06-29 09:03:32 · 250 阅读 · 0 评论 -
python数据处理快速入门11~12
11.1字符串对象方法 Python能够成为流行的数据处理语言,部分原因是其简单易用的字符串和文本处理功能。大部分文本运算都直接做成了字符串对象的内置方法。对于更为复杂的模式匹配和文本操作,则可能需要用到正则表达式。pandas对此进行了加强,它使你能够对整组数据应用字符串表达式和正则表达式,而且能处理烦人的缺失数据。 对于许多字符串处理和脚本应用,内置的字符串方法已经能够满足要求了。例如,以逗号分隔的字符串可以用split拆分成数段: val = 'a,b, guido' val...转载 2021-06-29 09:06:16 · 223 阅读 · 0 评论