这主要基于@Roman 的回答,但 (1) 向您展示了一种“查看”空格的不同方式,并且 (2) 向您展示了一种不同的制表理念:
html_1 <- c("I'm working here", " ", "", " ", "No", NA, "")
html_2 <- as.data.frame(html_1)
print 有一个 quote 参数,可让您在列周围加上引号,以便更轻松地查看前导和尾随空格。这在这里也很有帮助。
print(html_2, quote = TRUE)
# html_1
# 1 "I'm working here"
# 2 " "
# 3 ""
# 4 " "
# 5 "No"
# 6 NA
# 7 ""
制表就像寻找一个看起来像""的字符串一样简单:
html_2$html_1 == ""
# [1] FALSE FALSE TRUE FALSE FALSE NA TRUE
table(html_2$html_1 == "")
#
# FALSE TRUE
# 4 2
或者,您可以计算每个项目中有多少个字符以获得相同的信息。在这里,0 显然是感兴趣的字符串(但我不喜欢 NA 被计为两个字符)。
table(nchar(as.character(html_2$html_1)))
#
# 0 1 2 16
# 2 2 2 1