|
|
1
13
我找了一下就找到了这个。看起来很有希望。 http://www.unixuser.org/~euske/python/pdfminer/index.html
从现场:
|
|
|
2
8
我试过了
MuPDF中还有一个工具名为
下面介绍如何使用mutool提取TOC
|
|
|
3
3
|
|
|
4
0
PHP's PDFLib 是个很好的开始。如果你向下滚动,你会看到许多用户发布的解决方案,用于将PDF转换为HTML或PDF转换为文本。在转换之后,一个相对简单的匹配函数可以提取标记的TOC项,并将它们放入一个数组中,然后您可以随意操作它。 希望这有帮助。 |