Lewati ke konten

PDF ke teks

Pilih PDF, ekstrak teks yang dapat dipilih, lalu kenali halaman pindaian dengan OCR lokal opsional sebelum menyalin atau mengunduh file TXT.

Pilih PDF

Jatuhkan atau pilih satu PDF. Ekstraksi teks dan OCR opsional berjalan secara lokal di browser.

Biarkan kosong untuk semua halaman. Gunakan nomor dan rentang halaman yang dipisahkan koma.

Ekstrak teks

Baca teks PDF yang tersedia terlebih dahulu, lalu jalankan OCR secara opsional hanya pada halaman terpilih tanpa teks yang dapat diekstrak.

PDF ke teks

Mulai cepat

1
Pilih PDF
2
Atur halaman jika perlu
3
Ekstrak teks dan gunakan OCR untuk pindaian bila perlu
4
Salin atau unduh TXT

Skenario umum

Menyalin

ambil teks yang dapat dipilih atau teks pindaian dari PDF ke catatan, email, atau editor lain.

Ekstraksi selektif

baca atau gunakan OCR hanya pada halaman yang Anda perlukan dari PDF panjang.

Pengarsipan

simpan salinan TXT ringan dari PDF lokal tanpa mengunggah file.

Input dan output

Input: satu PDF lokal yang berisi teks yang dapat dipilih, halaman pindaian, atau keduanya.
Halaman: semua halaman secara default, atau rentang seperti 1-3,5.
Output: teks biasa yang dapat disalin atau diunduh sebagai file TXT.

Saran penggunaan

Biarkan OCR nonaktif untuk teks PDF yang dapat dipilih. Aktifkan jika halaman terpilih berupa pindaian atau gambar.
Ekstrak rentang halaman kecil terlebih dahulu saat memeriksa PDF panjang atau tidak biasa.
PDF yang sangat besar dapat memerlukan waktu dan mungkin mencapai batas memori browser atau teks.

Batasan & kompatibilitas

OCR bersifat opsional dan hanya berjalan pada halaman terpilih tanpa teks yang dapat diekstrak. Tulisan tangan, pindaian beresolusi rendah, dan tata letak kompleks dapat mengurangi akurasi.
Output teks biasa tidak mempertahankan tata letak PDF yang kompleks, kolom, tabel, font, atau anotasi.
PDF yang dilindungi kata sandi atau tidak biasa dapat gagal jika PDF.js atau browser tidak dapat mendekodenya.

Privasi & keamanan

Pemrosesan berjalan di browser Anda. CrateX.app tidak mengunggah PDF atau teks hasil ekstraksi. Saat OCR diaktifkan, sumber daya bahasa diunduh untuk pengenalan lokal; PDF dan hasilnya tetap berada di memori halaman dan tidak disinkronkan secara default.

Pertanyaan umum

9

Lanjutkan langkah berikutnya dengan alat terkait ini.

Seluruh pemrosesan alat terjadi secara lokal di browser Anda.