【发布时间】:2013-04-29 18:54:16
【问题描述】:
使用docsplit gem,我可以从 PDF 或任何其他文件类型中提取文本。例如,使用以下行:
Docsplit.extract_pages('doc.pdf')
我可以拥有 PDF 文件的文本内容。
我目前正在使用 Rails,PDF 是通过请求发送并存在于内存中的。查看 API 和源代码,我找不到从内存中提取文本的方法,只能从文件中提取。
有没有办法获取此 PDF 的文本以避免创建临时文件?
如果重要的话,我正在使用attachment_fu。
【问题讨论】:
标签: ruby-on-rails ruby attachment-fu docsplit