它会保留合理的阅读顺序、表格、标题、列表、链接和代码,并在需要时选择性使用 OCR。
开始转换
PDF Inspector 将文档分析与转换结合起来,让每一页采用合适的提取路径。
从设备选择的文件会在本地处理,并生成可在下载前预览的 Markdown。
添加您的 PDF
从设备选择 PDF,或提供公开文件 URL,然后将其加入转换队列。
检查页面结构
让 PDF Inspector 识别文档类型、复杂版式、需要 OCR 的页面以及潜在的字体编码问题。
使用选择性 OCR 转换
直接转换嵌入文本;启用自动 OCR 后,仅将被标记的扫描页或图片页交由 OCR 处理。
检查并下载 Markdown
预览重建后的标题、段落、列表、表格、链接和代码块,然后将结果下载为 Markdown 文件。
添加您的 PDF
从设备选择 PDF,或提供公开文件 URL,然后将其加入转换队列。
检查页面结构
让 PDF Inspector 识别文档类型、复杂版式、需要 OCR 的页面以及潜在的字体编码问题。
使用选择性 OCR 转换
直接转换嵌入文本;启用自动 OCR 后,仅将被标记的扫描页或图片页交由 OCR 处理。
检查并下载 Markdown
预览重建后的标题、段落、列表、表格、链接和代码块,然后将结果下载为 Markdown 文件。
PDF 描述的是内容在页面上的位置,而不是这些内容在 Markdown 中应当如何阅读。
PDF Inspector 会先检查视觉页面背后的信号,再决定如何提取内容。

PDF Inspector 只加载一次文档,并在分析和提取之间共享解析结果,使页面判断与最终 Markdown 保持一致。
它不会假设所有页面都相同,而是结合 PDF 分类、空间文本分析、结构恢复和可选 OCR 路由。

先依据 PDF 的实际信号作出判断,再生成更易核对、编辑和复用的 Markdown。