Apakah PDF OCR?
PDF OCR (optical character recognition) ialah proses menukar teks yang dalam PDF terimbas hanya wujud sebagai imej menjadi teks yang boleh dipilih, dicari dan dibaca mesin.
Fail PDF terdapat dalam dua jenis: dengan lapisan teks (lahir digital, contohnya dieksport daripada Word atau LaTeX) — teks boleh dibaca terus; dan terimbas (foto kertas atau melalui pengimbas) — halaman hanya terdiri daripada imej huruf. Tanpa OCR, jenis kedua tidak boleh dicari, disalin atau diringkaskan.
Muat naik PDF berasaskan teks sehingga 50 MB dan 1,000 halaman. Imbasan yang hanya mengandungi imej memerlukan OCR sebelum dimuat naik. Selepas itu tersedia ringkasan berstruktur dan sembang dengan konteks yang ada; lihat Dasar Privasi.
Ketepatan OCR bergantung pada kualiti imbasan, susun atur, bahasa dan fon; semak hasil penting secara manual.
Muat naik PDF berasaskan teks sehingga 50 MB dan 1,000 halaman. Imbasan yang hanya mengandungi imej memerlukan OCR sebelum dimuat naik. Selepas itu tersedia ringkasan berstruktur dan sembang dengan konteks yang ada; lihat Dasar Privasi.
Ketahui lebih lanjut tentang SummioSoalan lazim
Adakah PDF OCR percuma?
Harga dan terma OCR bergantung pada alat luaran yang dipilih. Muat naik PDF berasaskan teks sehingga 50 MB dan 1,000 halaman. Imbasan yang hanya mengandungi imej memerlukan OCR sebelum dimuat naik. Selepas itu tersedia ringkasan berstruktur dan sembang dengan konteks yang ada; lihat Dasar Privasi.
Sejauh manakah tepat OCR pada buku terimbas?
Ketepatan OCR bergantung pada kualiti imbasan, susun atur, bahasa dan fon; semak hasil penting secara manual.
Adakah OCR berfungsi pada PDF tulisan tangan?
Enjin lama bergelut dengan tulisan tangan. Enjin baharu berasaskan pembelajaran mesin berprestasi baik pada tulisan yang kemas dan hampir cetakan; pada tulisan tangan tidak teratur, ia kurang berkesan.
