【发布时间】:2011-03-04 09:46:30
【问题描述】:
这更像是一个尝试了解 HTTP 的真正工作原理然后实施它的问题。
我需要一个 HTTP 分析器,它能够从一些 HTTP 日志数据中分离出主页请求和“后台”请求。这个想法是将用户发出的 HTTP 请求与在后台自动发生的 HTTP 请求(松散地使用这个术语)分开。因此,从我看到的 HTTP 数据的最初印象来看,当我访问任何普通网站时,似乎会获取一个 text/html 对象,然后是许多其他对象,如 css、xml、javascript、图像等。
现在,问题是如何在用户主动不生成请求的情况下分离这些“后台”请求。据我所知,这主要是广告获取、重定向和一些基于 Ajax 的东西。
有没有人对此有任何想法。一些、经验或可能是您可以指导我开始进行此分析的资源?
【问题讨论】:
-
我认为通常(也是最简单)的方法是按文件类型将它们分开:
html、php等。请求是真正的命中,css、js、图像文件等是“背景”命中。当然这不考虑 Ajax 请求,它也可能会命中html和php文件。
标签: http httpwebrequest content-type