【发布时间】:2018-08-30 11:23:33
【问题描述】:
我目前正在尝试这样做:一旦网页加载,找出 URL 是否具有某种模式(例如 www.wikipedia.com/*),然后,如果是,则解析该网页的 HTML 内容,就像可以做的那样BeautifulSoup,并检查网页是否有 div 类 foo 和 id boo。知道我可以在哪里编写这段代码,也就是说,我在哪里可以访问 URL,我需要在哪里听才能知道网页已经完成加载,然后我可以查找 URL 和 HTML 内容,以及在哪里和如何解析 HTML?
我尝试查看src/chrome/browser/tab_contents 中的代码,但找不到任何合理的地方可以完成所有这些操作。
【问题讨论】:
-
Chromium 使用多进程架构,网页的渲染是在渲染进程中完成的。页面加载完成后,将调用此方法:cs.chromium.org/chromium/src/content/renderer/…。如果您想了解更多信息,您可能需要从那里进行调试
-
谢谢阿塞什。知道如何访问整个网页的 HTML 吗?
-
您想在调试时访问源代码还是通过 API 访问源代码?
-
根据您的需要,Tampermonkey 的用户脚本可能就足够了:openuserjs.org/about/Tampermonkey-for-Chromium
-
谢谢大家。我一直在寻找一种原生方式,通过 C++,而不是通过脚本或扩展。
标签: google-chrome chromium webviewchromium