【发布时间】:2015-10-09 03:43:56
【问题描述】:
好的,这里有一个简短的:
目标:检测字符串是否包含十六进制值,并正确提取或删除它们。
问题:我希望能够使用 openpyxl 将我的字符串写入 Excel 工作表,而不会引发非法字符异常错误。
有问题的字符串示例:
'\xc2\x87,QGLYLGXDO\x03ZLWK\x03EUHDVW\x03FDQFHU\x03\xc2\x9435
或者:
'5LVN\x03VWDWXV\x1d\x033RRU\x10ULVN\x1e\x03&\\WRJHQHWLFV\x1d\x03&RPSOH[\x03\x0b\xc2\x95\x03\x16\x03FORQDO\x03FKURPRVRPDO\x03DEQRUPDOLWLHV\x0c\x1e\x030RQRVRPDO\x03
我尝试过的:我尝试在写入之前检查每个元素,无论它是否是有效字符串,通过执行 if type(element) == str: 或 isinstance(element) == unicode 但没有效果。
我该如何解决这个问题?
额外信息: 我做了什么:
- 通过互联网上免费提供的软件将 PDF 文件转换为 xls 格式。 [不幸的是,该软件只是声称将其转换为 xls,而实际上数据是用 xml 写入的]
- 现在,我使用这些 xml 文件并编写一个 解析器 以从中提取数据。
- 第三,我使用提取的数据并使用 openpyxl 包将其写入 Excel 工作表。
【问题讨论】:
标签: python excel exception pdf openpyxl