Bilde til tekst – les tekst fra bilder

Gjør tekst i bilder og skjermbilder om til redigerbar tekst med norsk tekstgjenkjenning. Bildet behandles i nettleseren og lastes ikke opp.

Hent tekst fra bilder og skjermbilder

Bilde til tekst gjør trykt tekst i et bilde om til vanlig tekst som du kan kopiere, redigere og lime inn andre steder. Det kalles tekstgjenkjenning eller OCR (optical character recognition). Verktøyet bruker en norsk språkmodell, så æ, ø og å blir gjenkjent.

Slik bruker du verktøyet

  1. Velg et bilde, eller trykk Ctrl+V (Cmd+V på Mac) for å lime inn et skjermbilde direkte.
  2. Teksten leses automatisk. Første gang lastes tekstgjenkjenningen inn, så det tar litt lengre tid.
  3. Kontroller teksten i feltet, rett eventuelle feil og trykk «Kopier tekst» eller last den ned som en .txt-fil.

Står det engelsk tekst i bildet, eller en blanding av norsk og engelsk, velger du riktig språk og trykker «Les teksten på nytt».

Personvern

Bildet ditt lastes ikke opp. Tekstgjenkjenningen kjører i nettleseren, og bildet og teksten forlater ikke enheten din. Selve programmet og språkdataene lastes ned fra funksjoner.no første gang du bruker verktøyet, rundt 4 MB for norsk og rundt 7 MB med både norsk og engelsk. Bildet og teksten lagres ikke.

Slik fungerer det

Verktøyet bruker Tesseract, en kjent tekstgjenkjenningsmotor med åpen kildekode, i en versjon som kjører i nettleseren. Bildet roteres riktig ut fra mobilens retningsinformasjon, får hvit bakgrunn og sendes til en språkmodell som er trent på norsk tekst. Resultatet får et sikkerhetstall fra 0 til 100 prosent. Lavt tall betyr at du bør lese teksten ekstra nøye.

Eksempel

Du har tatt et skjermbilde av en tekst i en app som ikke lar deg kopiere. Ta skjermbildet, åpne denne siden og trykk Ctrl+V. Etter noen sekunder står teksten i feltet, klar til å kopieres. Det fungerer også for bilder av kvitteringer, oppslag, bruksanvisninger og skannede brev.

Tips for bedre resultat

Tesseract-dokumentasjonen anbefaler en oppløsning på minst 300 dpi, og den peker på at skjeve sider og mørke kanter gir dårligere gjenkjenning. I praksis betyr det:

  • Fotografer rett ovenfra, med jevnt lys og uten skygger.
  • Beskjær bort mørke kanter og bakgrunn, men la det være litt luft rundt teksten.
  • Bruk et skarpt bilde der bokstavene er store nok. Zoom inn i stedet for å fotografere en hel side langt unna hvis teksten er liten.

Begrensninger

  • Håndskrift, svært stilisert skrift og tekst på mønstret bakgrunn blir ofte feil.
  • Tabeller og kolonner kan bli lest i en annen rekkefølge enn du forventer.
  • Kontroller alltid tall, navn og beløp før du bruker teksten videre.
  • Har du en PDF, kan du først gjøre sidene om til bilder med PDF til JPG. Vil du telle ord i teksten, kan du lime den inn i ordtelleren.

Vanlige spørsmål

Blir bildet lastet opp til funksjoner.no?

Nei. Tekstgjenkjenningen kjører i nettleseren din. Bare programmet og språkdataene lastes ned fra funksjoner.no første gang.

Kjenner verktøyet igjen æ, ø og å?

Ja, når språket står på norsk. Velg «Norsk og engelsk» hvis teksten blander språkene.

Kan verktøyet lese håndskrift?

Som regel ikke godt. Tekstgjenkjenningen er laget for trykt tekst, som dokumenter, skjermbilder og skilt.

Resultatet er veiledende. Se metode og kvalitetsprinsipper.