【发布时间】:2014-03-04 16:34:27
【问题描述】:
我有一个开头带有字节顺序标记 (U+FEFF) 的文本文件。我正在尝试在 R 中读取文件。是否可以避免字节顺序标记?
函数fread(来自data.table包)读取文件,但在第一个变量名的开头添加:
> names(frame_pers)[1]
[1] "reg_date"
read.csv 函数也是如此。
目前我已经制作了一个从第一列名称中删除 BOM 的函数,但我相信应该有一种方法可以自动剥离 BOM。
remove.BOM <- function(x) setnames(x, 1, substring(names(x)[1], 4))
> names(frame_pers)[1]
[1] "reg_date"
> remove.BOM(frame_pers)
> names(frame_pers)[1]
[1] "reg_date"
我正在为 R 会话使用本机编码:
> options("encoding" = "")
> options("encoding")
$encoding
[1] ""
【问题讨论】:
标签: r unicode utf-8 character-encoding byte-order-mark