Mi az a PDF OCR?
A PDF OCR (optikai karakterfelismerés) az a folyamat, amely a beszkennelt PDF-ben csak képként jelen lévő szöveget kijelölhető, kereshető, gép által olvasható szöveggé alakítja.
A PDF-fájlok kétfélék: szövegréteggel (digitálisan született, pl. Wordből vagy LaTeX-ből exportált) — a szöveg közvetlenül olvasható; és szkennelt (papír fotója vagy szkenneren áthaladt) — az oldal csak a betűk képeiből áll. OCR nélkül a második típusban nem lehet keresni, másolni vagy összefoglalót készíteni.
Tölts fel szövegréteggel rendelkező, legfeljebb 50 MB-os és 1 000 oldalas PDF-et. A csak képeket tartalmazó szkenneléseken feltöltés előtt OCR-t kell futtatni. Ezután strukturált összefoglaló és az elérhető kontextussal működő csevegés következik; lásd az Adatvédelmi szabályzatot.
Az OCR pontossága a szkennelés minőségétől, az elrendezéstől, a nyelvtől és a betűtípustól függ; a fontos eredményt kézzel ellenőrizd.
Tölts fel szövegréteggel rendelkező, legfeljebb 50 MB-os és 1 000 oldalas PDF-et. A csak képeket tartalmazó szkenneléseken feltöltés előtt OCR-t kell futtatni. Ezután strukturált összefoglaló és az elérhető kontextussal működő csevegés következik; lásd az Adatvédelmi szabályzatot.
Tudj meg többet a SummiórólGyakori kérdések
Ingyenes a PDF OCR?
Az OCR ára és feltételei a választott külső eszköztől függenek. Tölts fel szövegréteggel rendelkező, legfeljebb 50 MB-os és 1 000 oldalas PDF-et. A csak képeket tartalmazó szkenneléseken feltöltés előtt OCR-t kell futtatni. Ezután strukturált összefoglaló és az elérhető kontextussal működő csevegés következik; lásd az Adatvédelmi szabályzatot.
Mennyire pontos az OCR beszkennelt könyveken?
Az OCR pontossága a szkennelés minőségétől, az elrendezéstől, a nyelvtől és a betűtípustól függ; a fontos eredményt kézzel ellenőrizd.
Működik az OCR kézzel írt PDF-eken?
A régebbi motorok küzdenek a kézírással. A gépi tanuláson alapuló újabbak ésszerűen boldogulnak a rendezett, szinte nyomtatottszerű írással; rendetlen kézírásnál kevésbé hatékonyak.
