Sådan virker udtræk af tekst fra billeder
Forstå hvordan browseren læser billedet, forbereder pixels, henter en sprogmodel, genkender tegn og returnerer redigerbar tekst til kontrol.
Forbered billedet før tekstudtræk
Brug det tydeligste billede, du har. Hold teksten vandret, beskær uvedkommende grafik, og undgå kraftige skygger. Moderat kontrast kan hjælpe svage bogstaver, men ekstreme indstillinger kan fjerne tegnsætning.
Vælg dokumentets sprog
Den valgte sprogmodel påvirker accenter, alfabet og ordmønstre. Vælg det sprog, som bruges i det meste af teksten. Billeder med flere sprog kan stadig kræve manuel rettelse.
Enkle layouts er lettere at læse
En enkelt kolonne og regelmæssige linjer bevarer normalt læserækkefølgen. Sidebjælker, billedtekster, lodrette etiketter og tabeller kan komme i en uventet rækkefølge. Beskær komplekse områder separat.
Praktiske svar
- OCR betyder optisk tegngenkendelse.
- Browseren afkoder først billedet til pixels.
- Drejning, beskæring og kontrast kan gøre input tydeligere.
- Sprogmodellen hjælper med at matche tegn og ord.
- En Web Worker holder brugerfladen responsiv.
- Motoren vurderer tekstområder, linjer, ord og tegn.
- Lignende former kan give forkerte tegn.
- Komplekse layouts kan ændre læserækkefølgen.
- Sikkerhedsscoren er kun et skøn.
- Kontrollér vigtige resultater mod kildebilledet.
Brug resultatet som en redigerbar kladde
Sammenlign teksten med billedet før udgivelse eller beslutninger. Kontrollér navne, datoer, beløb, referencenumre, tegnsætning og lignende tegn som O og 0 eller I og 1.
Tjekliste til billede-til-tekst
- Brug originalbilledet, når det er muligt.
- Drej og beskær før udtræk.
- Vælg det rigtige sprog.
- Sammenlign hele resultatet med kilden.
- Gem billedet, når nøjagtighed er vigtig.