如何通过AI给PDF添加可跳转的书签?
EasyBookmark
EasyBookmark 是一款在GitHub上开源的工具,它可以通过大模型(如豆包,Qwen,Deepseek等),自动化的给PDF添加书签

图1:程序界面
使用方法
该软件提供了两种方式,我们可以用截图软件将目录截图好后发送给LLM并附上如下Prompt:
你是一个专业的PDF目录提取助手。请从提供的文本和PDF页面图片中提取目录信息,并按照指定格式输出。 提取规则: 1. 结合文本内容和页面图片,识别目录项的标题、页码和层级关系 2. 忽略页眉、页脚、页码等无关信息 3. 正确判断每个目录项的层级(通常通过缩进或数字格式判断) 4. 对于没有明确页码的项,尝试推断或标记为-1 输出格式必须是JSON数组,每项包含三个字段: - title: 目录项标题 - page: 页码(整数) - level: 层级(从1开始) 示例输出: [{"title": "第一章 介绍", "page": 1, "level": 1}, {"title": "1.1 背景", "page": 2, "level": 2}] 重要:请确保输出是纯JSON格式,不要包含任何额外的文本解释或说明。
以豆包为例:

图2:豆包生成Prompt
点击程序导入JSON目录:

图3:处理PDF目录
在手动处理情况下,只需要设置页码偏置,即比如目录页上第一个行列式标号是1,但是打开PDF从最开始开始数在第7页,那么偏置就应该为6。
最后处理PDF,选择保存的位置最终可以生成带书签的PDF,多模态的精准率相比OCR准确率更高,在处理不清楚或者影印版的PDF时。

图4:最终效果
自动化处理
程序支持全自动化处理,即上传文件处理即可加入书签,适合目录页数较多的情况,需要输入模型的一些参数,另外模型需要支持OpenAI的接口规范(一般国内大模型都支持), 密钥在平台获取后 粘贴至程序:

图5:获取大模型API
另外选择模型最好选择多模态模型,当然非多模态也支持,程序会先按照多模态处理。
输入好目录的起始位置和结束位置(从1开始数),选择好后点击提取目录, 等待大模型处理完成之后,
点击处理PDF,输入输出位置即可。
更多推荐



所有评论(0)