跳到主内容

PDF 转文本

选择 PDF,提取可选择文字,并可选择使用本地 OCR 识别扫描页,然后复制结果或下载 TXT 文件。

选择 PDF

拖入或选择一个 PDF。文字提取和可选 OCR 都在浏览器本地完成。

留空表示全部页面。可用逗号分隔页码和范围。

提取文本

先读取 PDF 中已有的文字,再根据需要,仅对所选页面中没有可提取文字的页面运行 OCR。

PDF 转文本

快速开始

1
选择 PDF
2
按需设置页面
3
提取文本,并在需要时对扫描页运行 OCR
4
复制或下载 TXT

常见使用场景

复制文字

将 PDF 中可选择或扫描的文字提取到笔记、邮件或其他编辑器中。

按页提取

仅从长 PDF 中读取所需页面,或对这些页面运行 OCR。

归档

不上传文件,也能保存一份本地 PDF 的轻量 TXT 副本。

输入与输出

输入:一个包含可选择文字、扫描页或两者兼有的本地 PDF。
页面:默认全部页面,也可输入 1-3,5 这类范围。
输出:可复制的纯文本,也可下载为 TXT 文件。

使用建议

对于有可选择文字的 PDF,请关闭 OCR;当所选页面为扫描件或图片时再启用。
处理很长或特殊 PDF 时,先提取少量页面检查结果。
超大 PDF 可能耗时较久,也可能触发浏览器内存或文本上限。

限制与兼容性

OCR 为可选功能,仅用于所选页面中没有可提取文字的页面。手写文字、低分辨率扫描件和复杂版式可能降低识别准确率。
纯文本结果不会保留复杂版式、分栏、表格、字体或批注。
加密或特殊 PDF 可能因 PDF.js 或浏览器无法解码而失败。

隐私与安全

处理在浏览器本地运行。CrateX.app 不上传 PDF 或提取文本。启用 OCR 时,系统会下载语言资源以便在本地识别;PDF 和结果仍保留在页面内存中,默认不会同步。

常见问题

9

可继续使用这些相关工具,完成后续步骤。

所有工具处理都在您的浏览器本地完成。