【发布时间】:2017-04-18 04:28:37
【问题描述】:
尝试使用 read_csv2() 从 readr 包中读取 csv 文件。
问题是 read_csv2() 无法正确识别字符,而 R 的默认 read.csv2 成功识别。
例如:
原始值:KOZYATAĞI
read_csv2() 如何识别:KOZYATA<'d0'>I
我检查了帮助文件并尝试了下面列出的编码;但是没能实现。
第一次尝试:以错误的字符结束
my_df <- read_csv2("my_path/my_file.csv")
第二次尝试:手动说明编码。
my_df <- read_csv2("my_path/my_file.csv", locale(encoding = "UTF-8"))
Error: `col_names` must be TRUE, FALSE or a character vector
第 3 次尝试:由于上述错误消息,添加到第 2 次尝试。
my_df <- read_csv2("my_path/my_file.csv", locale(encoding = "UTF-8"), col_names = TRUE, col_types = NULL)
这个没有给出错误,但仍然不能正确识别字符。
怎么做?让我知道是否需要任何其他信息。提前致谢。
【问题讨论】:
-
给我们提供前几条故障线的数据来试试。否则...我也会尝试其他代码集...其他 utfs...有时 ANSI 出于某种奇怪的原因工作