【问题标题】:Javascript to download contents from a folder of webpage [closed]Javascript从网页文件夹下载内容[关闭]
【发布时间】:2012-01-11 11:59:02
【问题描述】:

我可以访问我网站的公共文件夹。上面有很多文件。假设网址是

http://www.abc.com/step-b/Prints/

上面的网址在浏览器中打开时显示:

**Index of /step-b/Prints

    Name    Last modified   Size    Description
    Parent Directory         -
    L/  05-Jan-2006 23:59    -
    L2/ 05-Jan-2006 23:51    -
    R/  05-Jan-2006 23:41    -
    R2/ 05-Jan-2006 23:32    -
    Thumbs.db   30-Jan-2007 09:00    81K
    hpothb07.dat    27-Aug-2008 07:00    0
    hpothb07.tif    27-Aug-2008 07:00    0**

现在我希望运行一个循环进入每个文件夹 L、L2、R、R2,从中提取大约 200 个文件。

我不知道如何开始。如果即使是 JS 也是最好的选择。

任何人都可以指导我或建议我.. 我不想要代码,而是想要指导如何做这些事情。

【问题讨论】:

  • 如果您需要指导,您可能来错地方了。这不是一个论坛或辅导的招聘场所,而是一个编程问答。
  • 首先,您只在浏览器中写入用户脚本或一些 javascript。在你编写任何 javascript 代码之后。
  • @LightnessRacesinOrbit 哇.. 一个很长的手柄.. 无论如何.. 我只是想要一个提示.. 我知道这是一个前卫。 QnA,但我相信它不仅仅针对“编写代码并寻求帮助”,我相信我的问题是编程领域,因此适合这里。
  • @gmunkhbaatarmn 是的,我知道 .. 我喜欢 JS 的原因是,它非常强大且易于集成到任何主机中。
  • @typedef1:但这不是问题。

标签: javascript download web-crawler userscripts


【解决方案1】:

由于同源策略,在 JS 中执行您想要的操作可能有点困难(例如,您无法通过 AJAX 下载此页面)。

但如果您已经知道如何访问该页面,那么您必须解析它。您在浏览器中看到的显然是 HTML 代码。因此,您需要知道如何检索这些文件夹名称。如果 HTML 是基于表格的,那么这应该不难。

最后,当您解析页面并获得文件夹名称时,您需要知道其中的内容。可能下面的 url http://www.abc.com/step-b/Prints/L2/ 会告诉你 L2 里面有什么。如果它不会,那么你现在可以停下来,因为它不可能做到。 :) 除非您现在以某种方式通过 http 检索文件夹中的文件列表。

循环中的下一步,您将遍历所有文件夹并像以前一样解析它们。然后你将文件名附加到像http://www.abc.com/step-b/Prints/L2/myfile.txt 这样的url 的末尾(它可能无法工作 - 请参阅之前的评论)。此时您可以轻松下载它们。

请记住,这只是理论,它取决于 Web 服务器如何响应请求。我可以向您保证,您要执行的任务绝不容易。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2017-07-12
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多