Hva er PDF OCR?
PDF OCR (optisk tegngjenkjenning) er prosessen som gjør om tekst som i en skannet PDF kun finnes som bilde, til markerbar, søkbar og maskinlesbar tekst.
PDF-filer finnes i to varianter: med tekstlag (født digitalt, f.eks. eksportert fra Word eller LaTeX) — teksten kan leses direkte; og skannet (foto av papir eller kjørt gjennom en skanner) — siden består bare av bilder av bokstaver. Uten OCR kan den andre typen ikke søkes i, kopieres eller oppsummeres.
Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.
OCR-nøyaktighet avhenger av skannekvalitet, oppsett, språk og skrifttype; kontroller viktige resultater manuelt.
Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.
Les mer om SummioVanlige spørsmål
Er PDF OCR gratis?
Pris og vilkår for OCR avhenger av det eksterne verktøyet du velger. Last opp tekstbaserte PDF-filer på maksimalt 50 MB og 1 000 sider. Skanninger som bare inneholder bilder, trenger OCR før opplasting. Deretter følger et strukturert sammendrag og chat med tilgjengelig kontekst; se Personvernerklæringen.
Hvor nøyaktig er OCR på skannede bøker?
OCR-nøyaktighet avhenger av skannekvalitet, oppsett, språk og skrifttype; kontroller viktige resultater manuelt.
Fungerer OCR på håndskrevne PDF-er?
Eldre motorer sliter med håndskrift. Nyere motorer basert på maskinlæring klarer ryddig, nesten trykkliknende håndskrift rimelig bra; ved rotete håndskrift er de mindre effektive.
