代码之家  ›  专栏  ›  技术社区  ›  Anil

如何从PDF文件中提取图像?[闭门]

  •  19
  • Anil  · 技术社区  · 17 年前

    如何使用Perl、PHP或任何其他基于UNIX的应用程序(我将使用PHP中的exec函数调用这些应用程序)来实现这一点?

    3 回复  |  直到 15 年前
        1
  •  23
  •   brian d foy    17 年前

    pdfimages 就是这样。它是poppler utils和xpdf utils包的一部分。

    从手册页:

    Pdfimages将来自便携式文档格式(PDF)文件的图像保存为便携式Pixmap(PPM)、便携式位图(PBM)或JPEG文件。

    注意:pdfimages从PDF文件中提取原始图像数据,而不执行任何其他转换。PDF内容流所做的任何旋转、剪切、颜色反转等都将被忽略。

        2
  •  11
  •   Kent Fredric    17 年前

    关于Perl,您检查过了吗 CPAN ?

        3
  •  2
  •   Oliver Oliver    17 年前

    PDF图像来自包“poppler utils”或更大的“xpdf utils”。至少在Ubuntu中,“poppler utils”已经预装了。poppler utils 10.0.3(Ubuntu9.04 Jaunty)中的pdfimages仍然对选项“-j”提取“.jpg”没有反应。它总是提取“.ppm”。

    作为一种解决方法,您可以将“poppler utils”替换为“xpdf utils”: $sudo apt get安装xpdf utils

    +++奥利弗