本文へスキップ

PDFをテキストに変換

PDFを選び、選択可能な文字を抽出します。スキャンページは必要に応じてローカルOCRで認識し、結果をコピーまたはTXTで保存できます。

PDFを選択

PDFを1つドラッグまたは選択します。文字抽出と必要に応じたOCRはブラウザー内で行われます。

空欄なら全ページです。ページ番号と範囲はカンマで区切ります。

テキストを抽出

まずPDF内の既存テキストを読み取り、必要に応じて、選択したページのうち抽出可能な文字がないページだけにOCRを実行します。

PDFをテキストに変換

かんたんスタート

1
PDFを選択
2
必要ならページを指定
3
テキストを抽出し、必要ならスキャンページをOCRで認識
4
コピーまたはTXT保存

よくある利用シーン

コピー

PDF内の選択可能な文字やスキャンされた文字を、メモ、メール、エディターへ移します。

ページ指定

長いPDFから必要なページだけを読み取り、またはOCRで認識します。

保存

PDFをアップロードせず、ローカルPDFの軽量なTXTコピーを残します。

入力と出力

入力: 選択可能な文字、スキャンページ、またはその両方を含むローカルPDF 1件。
ページ: 既定は全ページ。1-3,5 のような範囲も使えます。
出力: コピー可能なプレーンテキストとTXTファイル。

使い方のヒント

選択可能な文字があるPDFではOCRをオフにし、選択したページがスキャン画像の場合に有効にしてください。
長いPDFや特殊なPDFでは、まず少ないページで結果を確認してください。
大きなPDFは時間がかかり、メモリや文字数上限に達することがあります。

制限事項と互換性

OCRは任意で、選択したページのうち抽出可能な文字がないページだけに実行されます。手書き文字、低解像度のスキャン、複雑なレイアウトでは精度が下がる場合があります。
プレーンテキスト出力は複雑なレイアウト、段組み、表、フォント、注釈を保持しません。
パスワード付きや特殊なPDFは、PDF.jsまたはブラウザーで読み取れない場合があります。

プライバシーとセキュリティ

処理はブラウザー内で行われます。CrateX.appはPDFや抽出テキストをアップロードしません。OCRを有効にするとローカル認識用の言語データがダウンロードされますが、PDFと結果はページメモリ内に残り、既定では同期されません。

よくある質問

9

次の作業に役立つ関連ツールです。

すべてのツール処理はブラウザ内でローカルに行われます。