Ordliste

Hva er PDF OCR?

PDF OCR (optisk tegngjenkjenning) er prosessen som gjør om tekst som i en skannet PDF kun finnes som bilde, til markerbar, søkbar og maskinlesbar tekst.

PDF-filer finnes i to varianter: med tekstlag (født digitalt, f.eks. eksportert fra Word eller LaTeX) — teksten kan leses direkte; og skannet (foto av papir eller kjørt gjennom en skanner) — siden består bare av bilder av bokstaver. Uten OCR kan den andre typen ikke søkes i, kopieres eller oppsummeres.

Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.

OCR-nøyaktighet avhenger av skannekvalitet, oppsett, språk og skrifttype; kontroller viktige resultater manuelt.

Her passer Summio inn

Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.

Les mer om Summio

Vanlige spørsmål

Er PDF OCR gratis?

Pris og vilkår for OCR avhenger av det eksterne verktøyet du velger. Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.

Hvor nøyaktig er OCR på skannede bøker?

OCR-nøyaktighet avhenger av skannekvalitet, oppsett, språk og skrifttype; kontroller viktige resultater manuelt.

Fungerer OCR på håndskrevne PDF-er?

Eldre motorer sliter med håndskrift. Nyere motorer basert på maskinlæring klarer ryddig, nesten trykkliknende håndskrift rimelig bra; ved rotete håndskrift er de mindre effektive.