Ordliste

Hvad er PDF OCR?

PDF OCR (optisk tegngenkendelse) er processen, hvor tekst, der i en skannet PDF kun findes som billede, omdannes til markérbar, søgbar og maskinlæsbar tekst.

PDF-filer findes i to varianter: med tekstlag (født digitalt, fx eksporteret fra Word eller LaTeX) — teksten kan læses direkte; og skannet (foto af papir eller kørt gennem en skanner) — siden består kun af billeder af bogstaver. Uden OCR kan den anden type hverken søges, kopieres eller resumeres.

Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.

OCR-nøjagtighed afhænger af scanningskvalitet, layout, sprog og skrifttype; kontrollér vigtige resultater manuelt.

Her passer Summio ind

Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.

Læs mere om Summio

Ofte stillede spørgsmål

Er PDF OCR gratis?

Pris og vilkår for OCR afhænger af det eksterne værktøj, du vælger. Upload tekstbaserede PDF-filer på højst 50 MB og 1.000 sider. Scanninger, der kun består af billeder, kræver OCR før upload. Derefter følger et struktureret sammendrag og chat med tilgængelig kontekst; se Privatlivspolitikken.

Hvor nøjagtig er OCR på skannede bøger?

OCR-nøjagtighed afhænger af scanningskvalitet, layout, sprog og skrifttype; kontrollér vigtige resultater manuelt.

Virker OCR på håndskrevne PDF'er?

Ældre motorer har det svært med håndskrift. Nyere maskinlæringsbaserede motorer klarer pænt, næsten trykagtigt håndskrift rimeligt; ved rodet håndskrift er de mindre effektive.