read_csv()参数之encoding——看这篇就够了

前言

最近被问到:为什么CSV文件读不出来?

一看报错:'utf-8' codec can't decode byte 0xb3 in position 0: invalid start byte

其实这个问题很常见,解决起来也很简单。也顺便介绍一下 read_csv() encoding 参数。走起!!!

正文

首先,介绍一下 encoding 参数。该参数指的是文件的编码方式,Python 中或者是 pandas 中默认是 'utf-8' 的编码方式,所以在读取CSV文件时也是使用 utf-8 的方式进行解码。但不是所有的文件都是 utf-8 的编码方式,因此,pandas.read_csv() 中设置了一个 encoding 参数来专门处理之一情况。

编码方式有哪些呢?这篇文章不回答这个问题,如果感兴趣可以移步:codecs — Codec registry and base classes — Python 3.11.2 documentationSource code: Lib/codecs.py This module defines base classes for standard Python codecs (encoders and decoders) and provides access to the internal Python codec registry, which manages the codec and...https://docs.python.org/3/library/codecs.html#standard-encodings

这里只介绍解决方法 :重点!重点!重点!

步骤一:用记事本打开CSV文件,看右下角

步骤二:这里避开水印放大展示,这个CSV文件是 ANSI 的编码方式,utf-8 不能成功解码,因此,需要手动修改默认参数。

 步骤三:传递参数。将编码方式以字符串的形式传递给 encoding 参数,如下:

import pandas as pd
df = pd.read_csv('D:\Document\CSV\city.csv', encoding = 'ANSI') 
# ANSI 小写也可以

 最后当然就是顺利运行代码,读取到你想要的数据。

  • 6
    点赞
  • 19
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
要提取CSV文件中的身份证号,你可以使用Pythonpandas库来读取CSV文件并提取所需的字段。以下是一个示例代码: ```python import pandas as pd def extract_id_number(csv_file): df = pd.read_csv(csv_file, encoding='GB18030') # 读取CSV文件 id_numbers = df\['身份证号'\] # 提取身份证号字段,假设该字段名为'身份证号' return id_numbers if __name__ == "__main__": id_numbers = extract_id_number('your_csv_file.csv') # 替换为你的CSV文件路径 print(id_numbers) ``` 在这个示例中,我们定义了一个`extract_id_number`函数,它接受一个CSV文件路径作为参数。函数使用pandas的`read_csv`函数读取CSV文件,并通过指定`encoding='GB18030'`来处理中文乱码。然后,我们提取了名为'身份证号'的字段,并将结果返回。你可以将`'your_csv_file.csv'`替换为你实际的CSV文件路径。最后,我们打印提取到的身份证号码。 请注意,你需要根据你的CSV文件的实际情况修改字段名和文件路径。 #### 引用[.reference_title] - *1* *2* [python读取csv文件](https://blog.csdn.net/qq_22464799/article/details/128023434)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^koosearch_v1,239^v3^insert_chatgpt"}} ] [.reference_item] - *3* [Python基础——从csv文件中读取数据,提取数据的方法](https://blog.csdn.net/lucky_shi/article/details/105321149)[target="_blank" data-report-click={"spm":"1018.2226.3001.9630","extra":{"utm_source":"vip_chatgpt_common_search_pc_result","utm_medium":"distribute.pc_search_result.none-task-cask-2~all~insert_cask~default-1-null.142^v91^koosearch_v1,239^v3^insert_chatgpt"}} ] [.reference_item] [ .reference_list ]
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值