【发布时间】:2012-10-23 12:27:05
【问题描述】:
ID_REF GSM133971 GSM133972 GSM133973
244901_at 5.95461158752441E+001 1.88836498260498E+001 1.98215045928955E+001
244902_at 7.25400314331055E+001 2.65250205993652E+001 1.95321922302246E+001
244903_at 2.23291015625000E+002 1.78133636474609E+002 5.38166885375977E+001
244904_at 3.65505447387695E+001 3.04016351699829E+000 6.80462265014648E+000
244905_at 4.07523269653320E+001 2.58869285583496E+001 1.18088026046753E+001
244906_at 1.50184860229492E+002 5.39840278625488E+001 4.14917945861816E+001
244907_at 2.65190029144287E+001 1.39808797836304E+000 2.08662915229797E+000
244908_at 3.50156021118164E+000 1.05003893375397E+000 4.57657009363174E-001
244909_at 1.02663551330566E+002 1.42618169784546E+001 1.61735534667969E+001
244910_s_at 7.20161895751953E+001 1.57578134536743E+001 1.31729679107666E+001
244911_at 3.26349411010742E+001 7.23858451843262E+000 6.47778940200806E+000
以上是MAS5.0归一化的数据,我需要读取R中的数据却得到如下错误:
mydat=read.csv("trans.csv",header=T)
Error in make.names(col.names, unique = TRUE) :invalid multibyte string at '<ff><fe>I'
【问题讨论】:
-
文件编码是什么?也许您可以将 ist 传递给 read.table()... 或尝试 iconv gnu.org/savannah-checkouts/gnu/libiconv/documentation/…
-
你试试
read.table("trans.csv", <optionalargumentshere>, encoding = "UTF-8")? -
我猜测
是 0 宽度的不间断空格字符。看起来它一开始就是正确的。不完全是一种编程解决方案,但尝试通过第一个字段的第一个字符退格几次并重新保存。 -
我设法通过以下方式解决了这个问题:转到文件 -> 另存为并将 CSV 文件另存为 ODF 电子表格(在“另存为类型”下拉菜单中)。再次转到文件 -> 另存为并再次将 ODF 文件另存为 CSV(文本 CSV)。如果系统提示您保持当前格式或以 ODF 格式保存,请选择保持当前格式。现在将提示您选择字符集,因此从下拉列表中选择 UTF-8。新保存的 CSV 文件现在将采用 UTF-8 编码,所有特殊字符都已正确转换。
标签: r