【发布时间】:2018-12-21 07:21:20
【问题描述】:
我使用的代码来自: https://www.r-bloggers.com/htmltotext-extracting-text-from-html-via-xpath/ cos在github上:
https://github.com/tonybreyal/Blog-Reference-Functions/blob/master/R/htmlToText/htmlToText.R
它创建一个从 html 中提取文本的命令:
htmlToText
我有一个循环如下:
for(i in 1:10000){
input <- URL[i]
txt <- htmlToText(input)
write.table(txt, file = paste0(URL[i], ".txt", sep=""))
}
当出现以下错误时,我希望 ito 转到下一个 i:
Error in function (type, msg, asError = TRUE) : "Could not resolve host: NA"
有没有办法做到这一点? 使用此代码可能会帮助许多其他人 谢谢
【问题讨论】:
-
在
read_html之前添加if(is.na(input)) next? -
这个问题与您删除的previous question 有何不同?同样,您没有提供足够的详细信息。
read_html来自哪里?谷歌告诉我rvest和textreadr都有一个read_html函数。 -
当它得到一个不同的错误时怎么办?它应该继续还是应该停止?
-
我尝试了以下方法,但没有成功:status
-
这是我每次遇到的唯一错误类型。
标签: r loops error-handling skip