【发布时间】:2021-03-14 14:47:32
【问题描述】:
我对这个结构不变的excel文件感兴趣:https://rigcount.bakerhughes.com/static-files/cc0aed5c-b4fc-440d-9522-18680fb2ef6a
我可以从这个页面获得:https://rigcount.bakerhughes.com/na-rig-count
最后一个网址不会随时间变化,而第一个网址会。
但我猜文件的url位于固定网页的元素中的某个地方,即使它被改变了,并且文件名的生成遵循一个重复的过程。
因此,在 R 中,有没有一种方法可以自动获取文件(大约每周更新一次),而无需每次手动下载?
【问题讨论】:
标签: r web-scraping download data-mining