【发布时间】:2016-01-30 05:06:08
【问题描述】:
我对此进行了一些研究,但没有确定的答案。
这个问题提供了一些解决方法:How can I download only part of a page?
但话又说回来,我不想只下载页面的随机部分,而是第一个标签,头部。
是否有可能以某种方式查询页面,并将其内容流式传输到缓冲区并在您发现标签更接近</head> 时立即停止下载(丢弃其余部分)?
编辑: 向页面本身添加内容是不可能的,因为我想在我的应用程序上提取网站的标题。
想象http://stackoverflow.com 作为参数输入。整个页面大约 240kb,但如果我在点击</head> 的那一刻停止下载,它只有 5kb。让我可以为这个页面节省大约 97% 的带宽。
【问题讨论】:
-
这个问题是假设这个人想在页面中放一些东西,比如当前时间或用户名,它改变了字节的顺序,所以很难猜测哪个字节范围有你的信息,如果页面是由 asp.net 或类似的东西生成哦,伙计
-
是的,提供字节范围肯定不在计划之内。这就是为什么我认为如果我可以流式传输结果并在我匹配
</head>时立即停止,这可能是一个很好的方法。现在,问题仍然存在:我们可以流式传输页面字符吗?
标签: java http web download get