OCR - utan att scanna?
Jag har scannat en del textdokument och fått det "omvandlat" till ett Worddokument. Det brukar återstå en del rättning, men besparar ändå mycket tid.
Men om jag får en färdiginscannad text per mail - hur omvandlar jag den texten till ett Word-dokument?
Går det?
Om du har Office 2003 (kanske finns även i äldre versioner) så finns ett program som heter Microsoft Office Document Imaging som kan OCR-läsa alla TIF-bilder.
Du hittar programmet under Alla program, Microsoft Office, Officeverktyg, Microsoft Office Document Imaging.
En rätt cool grej med Office OneNote 2007 (inte skarp ännu) är att du kan ta en bild med mobilen/digitalkameran eller ta en skärmdump och lägga in i OneNote. Alla text i bilden känns igen och blir sökbar. Rätt smart om man t ex tagit en bild på en whiteboard på ett möte och sedan ha all text helt sökbar.
Mvh // Johan
Tack Johan!
Bilden låg i ett Worddokument. När jag kopierade det och klistrade in på skrivbordet blev det ett "OLE-klipp"? Det lyckades jag inte öppna med Microsoft Office Document Imaging.
Jag löste det genom att printa det, scanna det, bildbehandla för att få bättre kontrast och sedan OCR-läsa det.
Lite klumpigt, men resultatet blev bra (kommer i Proveniens-artikel snart…)
Om du väljer att spara ett Word-dokument som HTML, filtrerat så kommer alla bilder att sparas som JPG-bilder.
Mvh // Johan
Aha - fiffigt!