admin管理员组文章数量:1611135
在读取带有中文字符的文件时报了题目中的错误,代码如下:
import pandas as pd
file=pd.read_csv(file_path)
报错原因:文件读取时默认编码为utf-8,而中文字符的Unicode编码0x0800-0xFFFF之间,utf-8只包含了部分汉字,当你试图将该“中文字符”转成U码的utf-8时超出了其范筹。
解决办法:设定encoding=“gbk”,GBK规范收录了所有汉字和符号.
file=pd.read_csv(file_path,encoding="gbk")
版权声明:本文标题:解决‘utf-8‘ codec can‘t decode byte 0xba in position 2: invalid start byte导致的bug 内容由热心网友自发贡献,该文观点仅代表作者本人, 转载请联系作者并注明出处:https://www.elefans.com/dongtai/1728605862a1165442.html, 本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容,一经查实,本站将立刻删除。
发表评论