第6章 数据加载,存储与文件格式

6.1 读写文本格式的数据

在这里插入图片描述
读取数据函数的选项可分为以下几大类:

  • 索引: 将一个或多个列当做返回的DataFrame处理,以及是否从文件、用户获 取列名。
  • 类型推断和数据转换:包括用户定义值的转换、和自定义的缺失值标记列表 等。
  • 日期解析:包括组合功能,比如将分散在多个列中的日期时间信息组合成结果 中的单个列。
  • 迭代:支持对大文件进行逐块迭代。
  • 不规整数据问题:跳过一些行、页脚、注释或其他一些不重要的东西(比如由 成千上万个逗号隔开的数值数据)。
逐块读取文本文件
  • 读大文件之前,先设置最大的显示行数:
pd.options.display.max_rows = 10
  • 如果只想读取几行,而不是读取整个文件,通过nrows进行指定即可:
pd.read_csv('examples/ex6.csv', nrows=5)
  • 逐块读取文件,可指定chunksize(行数):
chunker = pd.read_csv('ch06/ex6.csv', chunksize = 1000)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值