Apa itu PDF OCR?
PDF OCR (optical character recognition) adalah proses mengubah teks yang di dalam PDF hasil pindai hanya muncul sebagai gambar menjadi teks yang bisa diseleksi, dicari, dan dibaca oleh mesin.
Berkas PDF ada dua jenis: dengan lapisan teks (lahir digital, mis. diekspor dari Word atau LaTeX) — teks bisa dibaca langsung; dan hasil pindai (foto kertas atau melewati pemindai) — halaman hanya berupa gambar huruf. Tanpa OCR, jenis kedua tak bisa dicari, disalin, atau dirangkum.
Unggah PDF berbasis teks hingga 50 MB dan 1.000 halaman. Pindaian yang hanya berisi gambar memerlukan OCR sebelum diunggah. Setelah itu tersedia ringkasan terstruktur dan obrolan dengan konteks yang tersedia; lihat Kebijakan Privasi.
Akurasi OCR bergantung pada kualitas pindaian, tata letak, bahasa, dan font; periksa hasil penting secara manual.
Unggah PDF berbasis teks hingga 50 MB dan 1.000 halaman. Pindaian yang hanya berisi gambar memerlukan OCR sebelum diunggah. Setelah itu tersedia ringkasan terstruktur dan obrolan dengan konteks yang tersedia; lihat Kebijakan Privasi.
Pelajari lebih lanjut tentang SummioPertanyaan umum
Apakah PDF OCR gratis?
Harga dan ketentuan OCR bergantung pada alat eksternal yang dipilih. Unggah PDF berbasis teks hingga 50 MB dan 1.000 halaman. Pindaian yang hanya berisi gambar memerlukan OCR sebelum diunggah. Setelah itu tersedia ringkasan terstruktur dan obrolan dengan konteks yang tersedia; lihat Kebijakan Privasi.
Seberapa akurat OCR pada buku hasil pindai?
Akurasi OCR bergantung pada kualitas pindaian, tata letak, bahasa, dan font; periksa hasil penting secara manual.
Apakah OCR bekerja pada PDF tulisan tangan?
Mesin lama kewalahan dengan tulisan tangan. Mesin baru berbasis machine learning tampil cukup baik pada tulisan rapi yang mendekati cetakan; pada tulisan tangan berantakan kurang efektif.
