Ano ang PDF OCR?
Ang PDF OCR (optical character recognition) ay ang proseso ng pag-convert ng teksto na sa isang scanned PDF ay nasa anyo lamang ng larawan tungo sa tekstong maaaring i-select, hanapin, at basahin ng makina.
May dalawang uri ng PDF: may text layer (isinilang nang digital, halimbawa, na-export mula sa Word o LaTeX) — direktang nababasa ang teksto; at scanned (litrato ng papel o pinadaan sa scanner) — ang pahina ay binubuo lamang ng mga larawan ng mga letra. Kung walang OCR, hindi mahahanap, makokopya, o maibubuod ang pangalawang uri.
Mag-upload ng text-based PDF na hanggang 50 MB at 1,000 pahina. Kailangan munang i-OCR ang image-only scan bago i-upload. Pagkatapos ay may nakabalangkas na buod at chat gamit ang available na konteksto; tingnan ang Patakaran sa Privacy.
Nakadepende ang katumpakan ng OCR sa kalidad ng scan, layout, wika, at font; manu-manong suriin ang mahahalagang resulta.
Mag-upload ng text-based PDF na hanggang 50 MB at 1,000 pahina. Kailangan munang i-OCR ang image-only scan bago i-upload. Pagkatapos ay may nakabalangkas na buod at chat gamit ang available na konteksto; tingnan ang Patakaran sa Privacy.
Alamin pa ang tungkol sa SummioMadalas itanong
Libre ba ang PDF OCR?
Nakadepende ang presyo at mga tuntunin ng OCR sa napili mong panlabas na tool. Mag-upload ng text-based PDF na hanggang 50 MB at 1,000 pahina. Kailangan munang i-OCR ang image-only scan bago i-upload. Pagkatapos ay may nakabalangkas na buod at chat gamit ang available na konteksto; tingnan ang Patakaran sa Privacy.
Gaano katumpak ang OCR sa mga scanned na libro?
Nakadepende ang katumpakan ng OCR sa kalidad ng scan, layout, wika, at font; manu-manong suriin ang mahahalagang resulta.
Gumagana ba ang OCR sa mga PDF na sulat-kamay?
Nahihirapan ang mga lumang engine sa handwriting. Ang mga bagong machine learning-based engine ay maayos sa malinis at malapit-print na handwriting; sa magulong sulat-kamay, hindi sila kasing-epektibo.
