【发布时间】:2015-03-13 11:56:24
【问题描述】:
数据有一个字符列,其中还包含字符串“NA”。如果我根据该列执行数据子集,我会得到那些在该列中具有“NA”的行。所有这些行都被 NA 填充,替换了实际数据。
给出下面的数据样本:
sample.csv
SYMBOL,SERIES,CLOSE,TIMESTAMP
A2ZMES,EQ,10.8,4/1/2014
IIFLFIN,NA,999.2,4/1/2014
SCIT,NA,1150,4/1/2014
IIFLFIN,NA,1019.81,8/1/2014
IRFC,NA,1098.09,8/1/2014
AICHAMP,BE,14.15,4/1/2014
我为此目的使用的代码。
data = read.csv('sample.csv', as.is = T)
subdata = data [ data $SERIES=='EQ', ]
我只想在 SERIES 列中获取与 EQ 匹配的那些行,不希望那些 'NA' 行破坏它。 EQ 只是一个代表,有时我需要一些其他的字符串匹配,甚至可能是'NA'。
请帮助或任何指针来解决这个琐碎的问题。 如果这可以通过基本 R 解决,则最好,否则我愿意使用任何包。感谢阅读。
【问题讨论】: