【发布时间】:2021-04-17 22:39:54
【问题描述】:
我想在未压缩的 pdf 中编辑几行。 我发现了一个类似的problem,但由于我需要扫描文件几次以获得我想要更改的确切行位置,这并不适合(并且正则表达式匹配的纯数量超过了预期)。 pdf 包含 utf-8 可编码行(其中一些我想编辑,特别是书签目标 ID) 和很多斑点(猜测图像等)。 当我用记事本编辑文件时,它工作正常,但是当我以编程方式进行时(读入,更改几行,回写) 图像和一些格式丢失。 (因为他们一开始没有被读入,忽略选项)
with codecs.open("merged-uncompressed.pdf", "r", encoding='ascii', errors='ignore') as f:
我可以使用errors="surrogateescape" 读取文件,并想从上面导入映射行,但不知道这种方法是否可行。
有谁知道如何处理这个问题?
最好的,卢卡斯
【问题讨论】: