PDF 转文本
选择 PDF,提取可选择文字,并可选择使用本地 OCR 识别扫描页,然后复制结果或下载 TXT 文件。
选择 PDF
拖入或选择一个 PDF。文字提取和可选 OCR 都在浏览器本地完成。
留空表示全部页面。可用逗号分隔页码和范围。
提取文本
先读取 PDF 中已有的文字,再根据需要,仅对所选页面中没有可提取文字的页面运行 OCR。
PDF 转文本选择 PDF按需设置页面提取文本,并在需要时对扫描页运行 OCR复制或下载 TXT
快速开始
1
2
3
4
常见使用场景
复制文字
将 PDF 中可选择或扫描的文字提取到笔记、邮件或其他编辑器中。
按页提取
仅从长 PDF 中读取所需页面,或对这些页面运行 OCR。
归档
不上传文件,也能保存一份本地 PDF 的轻量 TXT 副本。
输入与输出
输入:一个包含可选择文字、扫描页或两者兼有的本地 PDF。
页面:默认全部页面,也可输入 1-3,5 这类范围。
输出:可复制的纯文本,也可下载为 TXT 文件。
使用建议
对于有可选择文字的 PDF,请关闭 OCR;当所选页面为扫描件或图片时再启用。
处理很长或特殊 PDF 时,先提取少量页面检查结果。
超大 PDF 可能耗时较久,也可能触发浏览器内存或文本上限。
限制与兼容性
OCR 为可选功能,仅用于所选页面中没有可提取文字的页面。手写文字、低分辨率扫描件和复杂版式可能降低识别准确率。
纯文本结果不会保留复杂版式、分栏、表格、字体或批注。
加密或特殊 PDF 可能因 PDF.js 或浏览器无法解码而失败。
隐私与安全
处理在浏览器本地运行。CrateX.app 不上传 PDF 或提取文本。启用 OCR 时,系统会下载语言资源以便在本地识别;PDF 和结果仍保留在页面内存中,默认不会同步。
常见问题
可以。启用 OCR 并选择文档语言后,没有可选择文字的页面会在本地完成识别。
在页面输入框中填写页码或范围,例如 1-3,5。
不会。PDF 会在你的浏览器本地读取。
可以。提取后可复制结果,也可下载 TXT 文件。
不能。本工具用于将 PDF 文字提取为纯文本;启用 OCR 时也可处理扫描页。