admin管理员组

文章数量:1612152

已解决UnicodeEncodeError: ‘utf-8’ codec can’t encode character ‘\ud9b9’ in position 38: surrogates not allowed






文章目录

  • 报错代码
  • 报错翻译
  • 报错原因
  • 解决方法
  • 千人全栈VIP答疑群联系博主帮忙解决报错





报错代码



粉丝群里面的一个小伙伴想用python读取文件,但是发生了报错(当时他心里瞬间凉了一大截,跑来找我求助,然后顺利帮助他解决了,顺便记录一下希望可以帮助到更多遇到这个bug不会解决的小伙伴),报错代码如下:


 print("词库名:", byte2str(data[0x130:0x338]))  # .encode('GB18030')
 print("词库类型:", byte2str(data[0x338:0x540]))
 print("描述信息:", byte2str(data[0x540:0xd40]))
 print("词库示例:", byte2str(data[0xd40:startPy]))

报错信息截图







报错翻译



报错信息翻译

Unicode编码错误:“utf-8”编解码器无法对位置38中的字符“\ud9b9”进行编码:不允许使用代理




报错原因



报错原因

一些字符串无法被utf-8解码,所以可以把无法转化为utf-8格式的字符‘ignore’掉,再进行解码。




解决方法



遇到这种报错在字符串后面加上如下代码即可:

.encode('UTF-8', 'ignore').decode('UTF-8')

修改写入代码即可:
print("词库名:", byte2str(data[0x130:0x338]).encode('UTF-8', 'ignore').decode('UTF-8')) 
print("词库类型:", byte2str(data[0x338:0x540]).encode('UTF-8', 'ignore').decode('UTF-8'))
print("描述信息:", byte2str(data[0x540:0xd40]).encode('UTF-8', 'ignore').decode('UTF-8'))
print("词库示例:", byte2str(data[0xd40:startPy]).encode('UTF-8', 'ignore').decode('UTF-8'))

再次写入就成功了!

以上是此问题报错原因的解决方法,欢迎评论区留言讨论是否能解决,如果有用欢迎点赞收藏文章谢谢支持,博主才有动力持续记录遇到的问题!!!

千人全栈VIP答疑群联系博主帮忙解决报错

由于博主时间精力有限,每天私信人数太多,没办法每个粉丝都及时回复,所以优先回复VIP粉丝,可以通过订阅限时9.9付费专栏《100天精通Python从入门到就业》进入千人全栈VIP答疑群,获得优先解答机会(代码指导、远程服务),白嫖80G学习资料大礼包,专栏订阅地址:https://blog.csdn/yuan2019035055/category_11466020.html

  • 优点作者优先解答机会(代码指导、远程服务),群里大佬众多可以抱团取暖(大厂内推机会),此专栏文章是专门针对零基础和需要进阶提升的同学所准备的一套完整教学,从0到100的不断进阶深入,后续还有实战项目,轻松应对面试!

  • 专栏福利简历指导、招聘内推、每周送实体书、80G全栈学习视频、300本IT电子书:Python、Java、前端、大数据、数据库、算法、爬虫、数据分析、机器学习、面试题库等等

  • 注意:如果希望得到及时回复,订阅专栏后私信博主进千人VIP答疑群

免费资料获取,更多粉丝福利,关注下方公众号获取

本文标签: CodecencodeUnicodeEncodeErrorUTFcharacter