【发布时间】:2013-03-18 16:50:04
【问题描述】:
我正在使用 R 从旧的名声数据库中读取数据。这通常工作得很好,但是在阅读描述时我得到了意想不到的编码。例如:
a <- "\U3e34653c"
# is supposed to be
"ä"
我尝试iconv我自己解决这个问题,但尽管尝试了许多可能性,但我无法以正确的方式显示它。我的语言环境:en_US.UTF-8。有没有办法替换(子)这样的字符串?
【问题讨论】:
-
我遇到了类似的问题,并成功地首先转换为“latin1”。可能值得一试
-
这似乎是由您的数据库引起的,而不是 R。字符 ä 在 Unicode 中是 0x000000e4,而不是 0x3e34653c(未定义)。