Producten · 03 · Intelligente documentcapture
← Alle producten

KognitCapture

Vang, extraheer en structureer data uit elk document — op uw eigen infrastructuur, zonder lopende pagineter.

Een API-first platform voor intelligente documentcapture. Documenten komen binnen via dertien kanalen, doorlopen een beeldpijplijn van zestien stappen, worden gelezen door lokale OCR, lokale modellen of twaalf externe providers, worden gemapt op versiebeheerde templates, waar nodig door mensen herzien, en afgeleverd aan dertien soorten downstreamsystemen. Gebouwd als moderne vervanger van legacy-capture-suites.

632REST-endpoints
31Veldtypes
109Agent-tools
€0Marginale kost per pagina
Het probleem

Documentcapture wordt per pagina geprijsd en per kwartaal geleverd.

De gevestigde platformen in deze categorie delen twee eigenschappen. Ze rekenen per pagina, zodat u meer betaalt naarmate u meer waarde extraheert. En ze vereisen acht tot twaalf weken gespecialiseerde consulting om één enkel documenttype te configureren. Ondertussen verplichten de cloudalternatieven dat uw facturen, schadeformulieren en identiteitsdocumenten uw gebouw verlaten — voor een groeiend aantal klanten is dat een dealbreaker.

01
Pagineters
Volumegroei wordt een kostenprobleem in plaats van een efficiëntiewinst.
02
Gedwongen migraties
Leveranciers zetten het platform waarop u bouwde stop en laten u met een herbouwproject achter.
03
Data die het pand verlaat
Cloudcapture betekent dat gereguleerde documenten naar de tenant van iemand anders gaan.
04
Afhankelijkheid van consulting
Elk nieuw documenttype is een change request, geen configuratie.
De oplossing

Eén platform, op uw eigen hardware, met omgekeerde economie.

01
Geen runtime-licentiepoort
Er is geen licentieserver, geen rechtencontrole en geen pagineter. Draai lokale OCR en lokale modellen, en de marginale kost van een pagina is de elektriciteit om ze te verwerken.
02
Blueprints, geen projecten
Zes sector-startkits voorzien in één transactie een volledig werkend project — workflow, stappen, routering, upload-endpoint, exportdoel en een volledig gevelde template.
03
Niets verlaat het gebouw
Tesseract en lokale modellen draaien in-process; air-gapped werken is een ondersteunde implementatie, geen workaround. Externe modelproviders zijn een optie, nooit een vereiste.

Mogelijkheden

01Capture & herkenning
  • Dertien importkanalen: upload, REST, SFTP, FTP, hotfolder, e-mail, Kafka, RabbitMQ, ZeroMQ, webhook, script, plugin, dataset.
  • Stuurloos netwerkscannen via server-side eSCL-detectie, of directe koppeling via de browser — niets te installeren op de scanplek.
  • Scan Hub-sessies overleven een gesloten laptop: herordenen, draaien, verwijderen, herscannen, splitsen, dan als één batch indienen.
  • Acht herkenningsmodi over Tesseract 5, native PDF-tekst, hybride en open dataload.
  • 129 meegeleverde OCR-taalpakketten, warm gepoolde engines, geen externe OCR-dienst.
  • Lokale modellen in-process, plus twaalf externe providers achter één interface met failover.
  • Barcode- en QR-lezen via een apart decodeerpad — nooit gegokt vanuit OCR-tekst.
02Templates & classificatie
  • 31 veldtypes en 10 extractiemethodes — zone, labelzoeken, regex, keyword-nabijheid, model, manueel, ankertekst, begeleidend bestand, classificatie, XML-mapping.
  • Versiebeheerde templates waaraan integraties vastpinnen, zodat een ontwerpwijziging een live koppeling nooit breekt.
  • Tabel- en lijnitem-extractie met kolomzones, rijgroepering, headerdetectie en doorloop over pagina's.
  • Templategeneratie vanuit één voorbeeldpagina, en training op basis van correcties door operators.
  • Vier machine-learning-frameworks en 29 modeltypes die in-process draaien — geen externe inferentiedienst.
  • Documentsplitsing op vast paginaraantal, blanco pagina, barcode-match, modeldetectie, header/footer of fysieke scheidingsbladen.
  • Referentiedatasets voor opzoeken, autofill en validatie, plus templatevarianten voor lay-outverschillen per leverancier.
03Workflow & review
  • 16 workflowstaptypes, van import en OCR tot verificatiehubs, export en custom scripts.
  • Een visuele ontwerper waar de tekening de workflow is, met beslissingspoorten op documenteigenschappen en veldwaarden.
  • Drie operatorhubs — Verificatie, Verwerking en Scan — met het paginabeeld naast de velden en click-to-fill.
  • Traceerbaarheid per veld: ruwe herkende waarde, oorspronkelijke waarde, wie ze verifieerde en wanneer.
  • 14 validatieregeltypes, van niet-leeg en bereiken tot checksum, expressie, script, REST-aanroep en databasequery.
  • Custom scripts in JavaScript, Groovy of Java, gesandboxed, versiebeheerd en testbaar tegen voorbeelddocumenten.
  • Check-out-vergrendeling zodat twee operators nooit hetzelfde werk aanraken; publieke reviewlinks voor externen zonder account.
04Levering & integratie
  • Dertien exportbestemmingen en acht formaten, waaronder doorzoekbare PDF en PDF/A-2b, opgebouwd uit bewaarde woordgeometrie.
  • Veldmapping per exportdoel — niet-gemapte velden worden bewust weggelaten.
  • Elf externe connectietypes, elk met een configuratiewizard en een testactie.
  • Versleutelde credential-vault per project.
  • Plugin-SDK voor gecompileerde workflowstappen, importers en exporters, met eigen migraties en endpoints.
05Gebouwd voor agents
  • Een native Model Context Protocol-server met ongeveer 109 curated tools over projecten, documenten, verificatie, herkenning, templates, workflows en beheer.
  • OAuth 2.1 met dynamische clientregistratie en een expliciet toestemmingsscherm.
  • Tools met scopes en risiconiveaus, en een apart auditkanaal dat ook leesacties van agents registreert, niet alleen schrijfacties.
  • Insluitbare Verificatie- en Scan Hubs in uw eigen product, in een iframe, achter een API-key, een kortlevende sessie en een benoemde origin.
  • Cluster-nodes die taak- en capaciteitsbewust werk claimen zonder contentie — een node draineren, herstarten, of toewijzen aan OCR, export of import.
■Java 25 op Spring Boot 4, één self-contained JAR met gebundelde OCR-bibliotheken; optionele native image.
■PostgreSQL-database, 90 versiebeheerde migraties, elke tabel en kolom gedocumenteerd in de database zelf.
■632 REST-endpoints over 83 controllers; OpenAPI 3 met ingebouwde console.
■Bestanden op een tenant-geprefixte schijfstructuur, nooit in de database; AES-256-GCM-encryptie in rust voor sleutels en credentials.
■Model Context Protocol-server over streamable HTTP met OAuth 2.1, voor toegang door AI-agents.
■Self-hosted; geen SOC 2- of ISO 27001-attestatie van de leverancier, en MFA/SSO staan op de roadmap, nog niet uitgebracht.

Wat het doet

  • 01Geen licentiepoort, geen pagineter — de marginale kost van een pagina is de elektriciteit om ze te verwerken.
  • 02Zes sector-blueprints leveren in één transactie een volledig werkend project, tegenover een sectornorm van acht tot twaalf weken.
  • 03Lokale OCR en lokale modellen houden gereguleerde documenten op uw eigen infrastructuur, met externe AI-providers als optie, nooit als vereiste.

In het kort

Voor wieAccounts payable · Verzekeringen · KYC · AML · Logistiek
LicentieGelicentieerd per installatie, nooit per pagina. Eén vaste jaarlijkse vergoeding dekt een onbeperkt aantal gebruikers, projecten en organisaties binnen één tenant, schalend met uw eigen omzet — marginaal zoals de personenbelasting, met een minimum van €900 en een jaarlijkse stijging die maximaal 25% bedraagt. Hosting, AI-gebruik en professionele diensten worden afzonderlijk gefactureerd.

KognitCapture in uw organisatie?