Hvad er PDF OCR?
PDF OCR (optisk tegngenkendelse) er processen, hvor tekst, der i en skannet PDF kun findes som billede, omdannes til markérbar, søgbar og maskinlæsbar tekst.
PDF-filer findes i to varianter: med tekstlag (født digitalt, fx eksporteret fra Word eller LaTeX) — teksten kan læses direkte; og skannet (foto af papir eller kørt gennem en skanner) — siden består kun af billeder af bogstaver. Uden OCR kan den anden type hverken søges, kopieres eller resumeres.
Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.
OCR-nøjagtighed afhænger af scanningskvalitet, layout, sprog og skrifttype; kontrollér vigtige resultater manuelt.
Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.
Læs mere om SummioOfte stillede spørgsmål
Er PDF OCR gratis?
Pris og vilkår for OCR afhænger af det eksterne værktøj, du vælger. Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.
Hvor nøjagtig er OCR på skannede bøger?
OCR-nøjagtighed afhænger af scanningskvalitet, layout, sprog og skrifttype; kontrollér vigtige resultater manuelt.
Virker OCR på håndskrevne PDF'er?
Ældre motorer har det svært med håndskrift. Nyere maskinlæringsbaserede motorer klarer pænt, næsten trykagtigt håndskrift rimeligt; ved rodet håndskrift er de mindre effektive.
