Maak gescande documenten tekstdoorzoekbaar, herken relevante gegevens en stuur informatie gericht door naar de volgende stap in het proces.
OCR-software voor documentherkenning
Wat betekent OCR?
Kort antwoord: OCR staat voor Optical Character Recognition, oftewel optische tekenherkenning. De software herkent gedrukte tekst in een scan, foto of digitaal document en zet die om in machineleesbare tekst. Daardoor kan een document tekstdoorzoekbaar worden en kunnen specifieke gegevens, afhankelijk van document en inrichting, verder worden verwerkt.
Een scan kan er op het scherm leesbaar uitzien en toch voor een systeem niet meer zijn dan een afbeelding. Medewerkers kunnen de tekst dan niet goed doorzoeken, kopiëren of automatisch verwerken. Gegevens uit facturen, formulieren of vrachtbrieven moeten alsnog handmatig worden overgenomen.
OCR-software voegt herkenning toe aan de documentstroom. Ruvano helpt bepalen welke tekst of gegevens relevant zijn, hoe de herkenning wordt gecontroleerd en waar het bestand en de uitgelezen informatie daarna naartoe moeten. Zo blijft OCR geen losse techniek, maar wordt het een bruikbare stap tussen ontvangst en verwerking.

Wat doet OCR met een document?
OCR analyseert de afbeeldingslaag van een document en probeert letters, cijfers en woorden te herkennen. Het resultaat kan als tekstlaag achter de scan worden opgeslagen of als gegevens worden aangeboden aan een volgende stap in de workflow.
- Een gescande pdf op woorden doorzoekbaar maken.
- Tekst kopieerbaar maken voor verder gebruik.
- Een document omzetten naar een bewerkbaar formaat, waarbij controle van de opmaak nodig blijft.
- Vaste zones herkennen, zoals een referentienummer, datum of klantcode.
- Barcodes of QR-codes gebruiken om documenten te scheiden, classificeren of routeren.
- Herkende gegevens samen met het document afleveren bij een DMS of bedrijfsapplicatie.
Niet iedere OCR-inrichting doet al deze dingen. De gekozen functie moet aansluiten op het doel. Alleen tekst kunnen zoeken vraagt minder inrichting dan kritieke gegevens automatisch boeken in een bedrijfssysteem.
Tekstdoorzoekbaar maken of gegevens uitlezen?
Bij basis-OCR wordt de volledige pagina herkend en als tekstlaag aan het document toegevoegd. Daardoor kun je later zoeken op een naam, artikelnummer of onderwerp. Dit is vooral nuttig voor archieven, contracten en algemene correspondentie.
Bij gegevensherkenning gaat de workflow een stap verder. De software zoekt naar afgesproken velden en gebruikt die bijvoorbeeld voor de bestandsnaam, metadata, een controlevenster of een koppeling met een applicatie. Denk aan een factuurnummer, datum, orderreferentie of dossiernummer.
Belangrijk verschil
OCR herkent tekens en tekst. Automatische classificatie, validatie en procesbeslissingen vragen aanvullende regels, herkenningsmethoden of intelligente documentverwerking. Gebruik die begrippen niet als synoniemen en bepaal per proces welke functie echt nodig is.
Voor welke documenten wordt OCR gebruikt?
OCR is vooral waardevol bij documenten die vaak terugkomen of waarvan de inhoud later snel moet worden gevonden. Voorbeelden zijn:
- Facturen, orderbevestigingen, declaraties en pakbonnen.
- Contracten, brieven, rapportages en bestaande archiefstukken.
- Aanmeldformulieren, vragenlijsten en andere vaste formulieren.
- Personeelsdocumenten en dossierstukken.
- Werkbonnen, kwaliteitsdocumenten en technische registraties.
- Vrachtbrieven en CMR-documenten binnen transport en logistiek.
Een voorspelbaar document met vaste velden is doorgaans anders in te richten dan een verzameling brieven met wisselende opmaak. Daarom worden verschillende documentvarianten al in de testfase meegenomen.
Hoe werkt OCR in een zakelijke documentstroom?
- Het document komt binnen via een multifunctional, scanner, e-mail, netwerkmap of andere ondersteunde bron.
- De software kan pagina’s rechtzetten, draaien, opschonen of scheiden om de herkenning te ondersteunen.
- OCR leest de tekst; aanvullende herkenningsregels kunnen zones, barcodes of documentkenmerken gebruiken.
- De gebruiker of workflow controleert velden die onzeker, onvolledig of bedrijfskritisch zijn.
- Het document en de goedgekeurde metadata gaan naar een cloudlocatie, DMS, ERP-, CRM-, HR- of andere ingerichte applicatie.
De controle hoeft niet voor ieder veld hetzelfde te zijn. Een zoekbare tekstlaag kan vaak zonder uitgebreide validatie worden gebruikt, terwijl een bedrag, dossiernummer of transportreferentie vóór automatische verwerking extra controle kan vragen.
Welke OCR-oplossing past bij jouw proces?
Ruvano begint met de documenten en de gewenste uitkomst. Gaat het om doorzoekbare pdf’s, vaste velden, documentclassificatie of een koppeling met een bedrijfsapplicatie? Daarna testen we met echte voorbeelden welke inrichting passend is.
Voor documentcapture, OCR, indexering en routering kan Ruvano onder meer werken met Umango en Document Navigator. De softwarekeuze volgt uit documenttypen, volumes, gebruikers, apparatuur en bestemming. Bekijk de aparte partnerpagina’s voor de mogelijkheden per oplossing.
Software die dit documentproces kan ondersteunen
De softwarekeuze volgt uit documenttypen, gebruikers, apparatuur, gewenste controle en de bestemming van documenten en gegevens. Bekijk de aparte partnerpagina's voor de mogelijkheden per oplossing.
Veelgestelde vragen over documenten digitaliseren
Is OCR altijd honderd procent nauwkeurig?
Nee. Kwaliteit, lay-out, taal, handschrift en scaninstellingen beïnvloeden de uitkomst. Voor belangrijke velden moet een controle- en uitzonderingsproces worden ingericht.
Welke talen kan OCR herkennen?
Dat verschilt per softwarepakket en licentie. Geef vooraf aan welke talen en tekensets in de documenten voorkomen, zodat dit in de selectie en test wordt meegenomen.
Kan OCR tabellen herkennen?
Dat is bij bepaalde oplossingen en documenten mogelijk, maar tabellen, kolommen en afwijkende lay-outs kunnen de verwerking complexer maken. Test met echte varianten voordat automatische verwerking wordt ingericht.
Kan OCR handgeschreven tekst lezen?
Sommige oplossingen ondersteunen handschriftherkenning, maar de betrouwbaarheid hangt sterk af van leesbaarheid en structuur. Voor kritieke gegevens blijft controle vaak nodig.
Werkt OCR ook met bestaande pdf-bestanden?
Vaak wel, zolang de bestanden als invoerbron kunnen worden aangeboden en de kwaliteit voldoende is. Een pdf met alleen afbeeldingspagina’s kan met OCR van een tekstlaag worden voorzien.
Kan OCR gegevens automatisch in een systeem zetten?
Dat kan wanneer herkenning, validatie en een passende koppeling zijn ingericht. De mogelijkheden hangen af van het document, de gewenste velden en de connector met het doelsysteem.
Wat is het verschil tussen scannen en OCR?
Scannen maakt een digitale afbeelding van het document. OCR herkent de tekens in die afbeelding, zodat tekst doorzoekbaar of verder verwerkbaar wordt.
Waar staat OCR voor?
OCR staat voor Optical Character Recognition. In het Nederlands wordt dit optische tekenherkenning of tekstherkenning genoemd.


Test OCR met de documenten die jouw organisatie echt gebruikt
Een demo met perfecte voorbeeldscans zegt weinig over de dagelijkse praktijk. Neem daarom verschillende documenten, afwijkende lay-outs en lastige scans mee. Dan bekijken we welke herkenning haalbaar is en waar controle nodig blijft.