Sökbar text i skannade PDF:er
Sök, markera och kopiera i dokument som bara var bilder.
Textigenkänning för PDF
Tolka text i skannade avtal, brev och bilagor så att du kan söka, kopiera och fortsätta bearbetningen. Prova utan konto, tre färdiga filer ingår gratis när du sparar, därefter från 49 kr.
Sök, markera och kopiera i dokument som bara var bilder.
Å, ä och ö tolkas rätt när svenska är valt.
Kör OCR först, redigera eller konvertera sedan.
Välj PDF eller dokumentbilder och kontrollera att sidorna är rättvända.
Rätt språk förbättrar å, ä, ö, sammansatta ord och vanliga svenska namn.
Sök efter kända ord och kontrollera särskilt personnummer, datum, belopp och avtalsparter.
Välj verktyget när: Välj OCR när en skannad PDF ser ut som text men inte går att söka, markera eller kopiera. Ett textlager gör dokumentet lättare att hitta i och kan användas som underlag för fortsatt konvertering eller redigering.
Välj en annan arbetsväg när: OCR är inte en garanti för korrekt avskrift och är inte rätt väg för en redan textbaserad PDF. Handskrift, svag kontrast och skadade original kan kräva manuell transkribering. Behåll alltid sidbilden som kontroll mot den tolkade texten.
Förbered filen så här: Räta upp sidorna, kontrollera rotation och välj språk innan körningen. Bestäm några kända namn eller fraser att söka efter i resultatet. Korrekturläs tecken som lätt förväxlas och kontrollera särskilt identitetsuppgifter, datum och belopp.
En skanner skapar ofta en bild av varje sida. OCR analyserar bokstavsformerna och lägger ett sökbart textlager ovanpå bilden. Dokumentet ser likadant ut men kan sökas och kopieras.
Resultatet beror på upplösning, kontrast, språk, sidrotation och originalets skick. Tydliga skanningar i 300 dpi ger vanligtvis bäst balans.
OCR kan förväxla 0 och O, 1 och l, eller läsa ett svagt tecken fel. Den maskinlästa texten ska därför inte användas som ensam källa för juridiskt viktiga uppgifter.
Behåll sidan som bild i PDF:en och korrekturläs texten innan du redigerar, konverterar eller indexerar dokumentet.
En PDF-export är en ny fil. Öppna den därför i en PDF-läsare, jämför den med originalet och kontrollera de uppgifter som är viktiga för mottagaren. Behåll alltid originalet tills du vet att resultatet är komplett.
Om originalet är elektroniskt signerat kan en ändring, konvertering, delning eller sammanfogning påverka signaturens verifiering. Kontrollera signaturstatus i en PDF-läsare och signera den slutliga versionen först när all bearbetning är klar.
PDF-filer kan innehålla personuppgifter, affärsinformation och bilagor som inte behöver ingå i arbetskopian. Behandla bara filer som du har rätt att hantera, arbeta på en kopia och överväg om onödiga sidor eller uppgifter kan tas bort innan filen bearbetas.
Behöver du flera åtgärder, gör dem i en tydlig följd: skapa eller OCR-tolka underlaget först, redigera och ordna sidorna därefter, och komprimera först när innehållet är färdigt. Då blir det lättare att hitta var en eventuell förändring uppstod.
Prova editorn direkt utan konto. Skapa ett gratis konto när du vill spara eller ladda ned resultatet – tre färdiga filer ingår, sedan från 49 kr.
OCR står för Optical Character Recognition, optisk teckenigenkänning, och omvandlar text i bilder till maskinläsbar text.
Vanlig OCR är optimerad för tryckt text. Handskrift kräver andra modeller och ger normalt lägre precision.
Behöver du hjälp med arbetsflödet? Läs dokumentationen eller kontakta Avtalsfrid.