PDFをテキストに変換
PDFを選び、選択可能な文字を抽出します。スキャンページは必要に応じてローカルOCRで認識し、結果をコピーまたはTXTで保存できます。
PDFを選択
PDFを1つドラッグまたは選択します。文字抽出と必要に応じたOCRはブラウザー内で行われます。
空欄なら全ページです。ページ番号と範囲はカンマで区切ります。
テキストを抽出
まずPDF内の既存テキストを読み取り、必要に応じて、選択したページのうち抽出可能な文字がないページだけにOCRを実行します。
PDFをテキストに変換PDFを選択必要ならページを指定テキストを抽出し、必要ならスキャンページをOCRで認識コピーまたはTXT保存
かんたんスタート
1
2
3
4
よくある利用シーン
コピー
PDF内の選択可能な文字やスキャンされた文字を、メモ、メール、エディターへ移します。
ページ指定
長いPDFから必要なページだけを読み取り、またはOCRで認識します。
保存
PDFをアップロードせず、ローカルPDFの軽量なTXTコピーを残します。
入力と出力
入力: 選択可能な文字、スキャンページ、またはその両方を含むローカルPDF 1件。
ページ: 既定は全ページ。1-3,5 のような範囲も使えます。
出力: コピー可能なプレーンテキストとTXTファイル。
使い方のヒント
選択可能な文字があるPDFではOCRをオフにし、選択したページがスキャン画像の場合に有効にしてください。
長いPDFや特殊なPDFでは、まず少ないページで結果を確認してください。
大きなPDFは時間がかかり、メモリや文字数上限に達することがあります。
制限事項と互換性
OCRは任意で、選択したページのうち抽出可能な文字がないページだけに実行されます。手書き文字、低解像度のスキャン、複雑なレイアウトでは精度が下がる場合があります。
プレーンテキスト出力は複雑なレイアウト、段組み、表、フォント、注釈を保持しません。
パスワード付きや特殊なPDFは、PDF.jsまたはブラウザーで読み取れない場合があります。
プライバシーとセキュリティ
処理はブラウザー内で行われます。CrateX.appはPDFや抽出テキストをアップロードしません。OCRを有効にするとローカル認識用の言語データがダウンロードされますが、PDFと結果はページメモリ内に残り、既定では同期されません。
よくある質問
はい。OCRを有効にして文書の言語を選ぶと、選択可能な文字がないページがブラウザー内で認識されます。
ページ欄に 1-3,5 のような番号または範囲を入力します。
いいえ。PDFはブラウザー内で読み取られます。
はい。抽出後にコピーするかTXTファイルとして保存できます。
いいえ。このツールはPDFの文字をプレーンテキストとして抽出し、OCRを有効にした場合はスキャンページも処理します。