【问题标题】:Python decode and encode with utf-8Python 使用 utf-8 解码和编码
【发布时间】:2014-01-24 17:07:10
【问题描述】:

我正在尝试使用 utf-8 进行编码和解码。奇怪的是我收到一条错误引用,说我正在使用 gbk。

oneword.decode("utf-8")]

以下是错误引用。

UnicodeEncodeError: 'gbk' codec can't encode character '\u2769' in position 1: illegal multibyte sequence

谁能告诉我该怎么做?我好像decode参数没有效果。

【问题讨论】:

  • 什么是oneword?请使用print(oneword)的结果更新您的帖子。
  • 其实repr(oneword) 可能更有用。 UnidoceEncodeError 使它看起来像是在解码之前尝试首先对 oneword 进行编码,就好像 oneword 是一个 bytes 对象一样。不过,我之前在 Python 3 中从未见过这种行为。

标签: python python-3.x decode encode python-3.3


【解决方案1】:

我解决了。 实际上,我打算输出到文件而不是控制台。在这种情况下,我必须明确指出输出目标文件的解码。我没有使用open,而是使用codecs.open

import codecs

f = codecs.open(filename, mode='w', encoding='utf-8')

希望它对某人有所帮助。

【讨论】:

  • 在python3中没有需要导入codecs模块。只需将encoding 参数传递给内置的open 函数即可。您可以使用io.open 在python2 中实现相同的行为。
猜你喜欢
  • 2013-05-11
  • 2018-02-18
  • 2019-09-15
  • 2021-03-22
  • 1970-01-01
  • 2021-08-08
  • 1970-01-01
  • 1970-01-01
  • 2020-08-02
相关资源
最近更新 更多