PDF Extraction MCP Server (Claude Code Fork) 简介
这是一个专为 PDF 文档处理 设计的 MCP(Model Context Protocol)服务器,能够从 PDF 文件中精准提取文本内容,并支持 OCR 光学字符识别 与 指定页码范围 提取。无论是扫描件、图片型 PDF,还是只想要某个章节的局部文字,都能轻松应对。
它能做什么
- 文字提取:快速读取 PDF 中的文本层内容,保留基本结构与排版。
- OCR 识别:处理扫描件或图片型 PDF,将图像中的文字转为可编辑文本。
- 指定页码:按页码区间提取内容,无需每次处理整份文档,省时高效。
- 局部内容提取:支持精准定位特定章节、段落或页面区域。
关于密钥
该 MCP 通常不需要 API 密钥,本地部署即可使用。若用于调用云端 OCR 服务,可能需要相应服务商的账号配置;具体请以官方文档为准。