我正在使用pdf.js来解析一个从谷歌文档使用谷歌脚本生成的PDF。我最终需要在一个给定的pdf页面上产生一个超链接列表。
我需要一个与pdf.js函数PDFpage.getTextContent等效的函数,但它包含超链接信息,而不仅仅是文本信息。pdf.js中任何输出超链接信息的函数都是一个开始,但我似乎找不到任何东西。
我不需要显示PDF,只需从其中提取最少的信息。
我当前的代码只记录页面的文本内容:
function numbersLinks(blob) {
PDFJS.getDocument({data: blob}).then(function (PDFdoc) {
for (var i=1; i<=PDFdoc.numPages; i++) {
PDFdoc.getPage(i).then(function (PDFpage) {
var page_number = PDFpage.pageIndex + 1;
PDFpage.getTextContent().then(function (text) {
for (var j in text.items) {
var item = text.items[j]
console.log(item)
}
})
})
}
})
}发布于 2017-10-25 10:42:55
这对你有用吗?
您可以使用url的key从getAnnotations()获取的annotationData中获取URL。
function numbersLinks(blob) {
PDFJS.getDocument({data: blob}).then(function (PDFdoc) {
for (var i=1; i<=PDFdoc.numPages; i++) {
PDFdoc.getPage(i).then(function (PDFpage) {
PDFpage.getAnnotations().then(function (annotationData) {
for (var j=0; j<annotationData.length; j++) {
console.log(annotationData[j].url);
}
})
})
}
})
}https://stackoverflow.com/questions/46916486
复制相似问题