【发布时间】:2011-02-23 17:43:06
【问题描述】:
我有一个 iframe,用于从其父页面生成 PDF。 PDF 制作器 (ABCpdf) 需要一个 HTML 文件,然后将其转换。
我目前所做的是使用以下方法抓取父母的 HTML:
var temp;
temp=parent.document.body.parentNode.innerHTML;
然后我使用 iframe 中的表单将其提交到服务器,在服务器上对其进行按摩以删除 iframe 部分等内容,然后将其保存为 PDF 制作者的临时 HTML 文件。
但是生成的 HTML 代码被破坏了,<BODY> 而不是 <body> 等,并且删除了 ID 周围的引号等。
有没有更好的方法来获取 HTML?
我不只是将页面重新生成为 HTML 的原因是父页面是一个复杂的报表。它包含各种控件以允许用户显示/隐藏部分或对表格中的行进行排序。所以我得到的 HTML 必须反映用户的自定义。
谢谢
【问题讨论】:
-
我必须做的几乎和你用 ABCPdf 描述的一样。我最终要做的是创建页面外观的自定义 JSON 标记,然后使用该信息重新生成页面。我知道这很痛苦,但它也为您提供了一些灵活性来执行诸如添加自定义页眉或页脚之类的事情。
标签: javascript html scrape