OCR PDF

Buat PDF dapat dicari dan disalin.

Cara kerjanya:

  • Ekstrak Teks: Menggunakan Tesseract OCR untuk mengenali teks dari gambar atau PDF yang dipindai.
  • Output Bisa Dicari: Membuat PDF baru dengan lapisan teks tak terlihat, membuat dokumen Anda sepenuhnya bisa dicari sambil mempertahankan tampilan asli.
  • Penyaringan Karakter: Gunakan whitelist untuk memfilter karakter yang tidak diinginkan dan meningkatkan akurasi untuk jenis dokumen tertentu (faktur, formulir, dll.).
  • Dukungan Multi-bahasa: Pilih beberapa bahasa untuk dokumen yang berisi konten bahasa campuran.

Klik untuk memilih file atau seret dan jatuhkan

File Anda tidak pernah meninggalkan perangkat Anda.

Cara Menjalankan OCR pada PDF

1

Pilih file PDF hasil scan

Klik kotak di atas atau seret satu file PDF yang teksnya belum bisa dipilih.

2

Pilih bahasa dokumen

Centang semua bahasa yang ada di dokumen, misalnya Indonesia dan Inggris. Paket bahasa diunduh saat pertama kali dipakai.

3

Pilih resolusi lalu mulai

Tinggi (bawaan) cocok untuk dokumen kantor biasa. Pilih Ultra untuk tulisan kecil atau scan buram, Standar bila ingin lebih cepat.

4

Unduh hasilnya

Unduh PDF yang sudah bisa dicari, atau salin dan unduh teks hasil OCR sebagai file .txt.

Tips Agar Hasil OCR Akurat

Alat PDF Terkait

Pertanyaan Seputar OCR PDF

Bagaimana tahu PDF saya perlu OCR?

Coba blok satu baris teks di aplikasi pembaca. Kalau tidak bisa dipilih atau pencarian tidak menemukan apa pun, halamannya hanya gambar dan perlu OCR.

Apakah bahasa Indonesia didukung?

Ya. Tersedia lebih dari 100 bahasa, termasuk Indonesia. Centang semua bahasa yang muncul di dokumen agar halaman berbahasa campuran terbaca sekaligus.

Apakah tampilan dokumen berubah setelah OCR?

Tidak. Halaman asli tetap sama, lalu ditambahkan lapisan teks tak terlihat tepat di atas tulisan pada scan. Tampilannya sama, tetapi teks kini bisa dicari dan disalin.

Bisakah membaca tulisan tangan?

Kurang andal. Mesin OCR dilatih untuk teks cetak, jadi tulisan tangan umumnya menghasilkan teks yang kacau.

Bisakah hanya mengambil teksnya saja?

Bisa. Setelah OCR selesai, teks hasil pengenalan tampil di kotak yang bisa disalin atau diunduh sebagai file .txt, terpisah dari unduhan PDF.

Apakah scan saya di-upload?

Tidak. Mesin OCR berjalan di browser Anda. Yang diunduh hanya mesin OCR dan paket bahasa yang dipilih; halaman scan dan teksnya tetap di perangkat Anda.

Apakah bisa dipakai di HP?

Bisa, di Chrome, Safari, atau browser modern lain di Android maupun iPhone. Untuk file besar, laptop atau komputer akan terasa lebih cepat.