KognitCapture
Vang, extraheer en structureer data uit elk document — op uw eigen infrastructuur, zonder lopende pagineter.
Een API-first platform voor intelligente documentcapture. Documenten komen binnen via dertien kanalen, doorlopen een beeldpijplijn van zestien stappen, worden gelezen door lokale OCR, lokale modellen of twaalf externe providers, worden gemapt op versiebeheerde templates, waar nodig door mensen herzien, en afgeleverd aan dertien soorten downstreamsystemen. Gebouwd als moderne vervanger van legacy-capture-suites.
Documentcapture wordt per pagina geprijsd en per kwartaal geleverd.
De gevestigde platformen in deze categorie delen twee eigenschappen. Ze rekenen per pagina, zodat u meer betaalt naarmate u meer waarde extraheert. En ze vereisen acht tot twaalf weken gespecialiseerde consulting om één enkel documenttype te configureren. Ondertussen verplichten de cloudalternatieven dat uw facturen, schadeformulieren en identiteitsdocumenten uw gebouw verlaten — voor een groeiend aantal klanten is dat een dealbreaker.
Eén platform, op uw eigen hardware, met omgekeerde economie.
Mogelijkheden
- Dertien importkanalen: upload, REST, SFTP, FTP, hotfolder, e-mail, Kafka, RabbitMQ, ZeroMQ, webhook, script, plugin, dataset.
- Stuurloos netwerkscannen via server-side eSCL-detectie, of directe koppeling via de browser — niets te installeren op de scanplek.
- Scan Hub-sessies overleven een gesloten laptop: herordenen, draaien, verwijderen, herscannen, splitsen, dan als één batch indienen.
- Acht herkenningsmodi over Tesseract 5, native PDF-tekst, hybride en open dataload.
- 129 meegeleverde OCR-taalpakketten, warm gepoolde engines, geen externe OCR-dienst.
- Lokale modellen in-process, plus twaalf externe providers achter één interface met failover.
- Barcode- en QR-lezen via een apart decodeerpad — nooit gegokt vanuit OCR-tekst.
- 31 veldtypes en 10 extractiemethodes — zone, labelzoeken, regex, keyword-nabijheid, model, manueel, ankertekst, begeleidend bestand, classificatie, XML-mapping.
- Versiebeheerde templates waaraan integraties vastpinnen, zodat een ontwerpwijziging een live koppeling nooit breekt.
- Tabel- en lijnitem-extractie met kolomzones, rijgroepering, headerdetectie en doorloop over pagina's.
- Templategeneratie vanuit één voorbeeldpagina, en training op basis van correcties door operators.
- Vier machine-learning-frameworks en 29 modeltypes die in-process draaien — geen externe inferentiedienst.
- Documentsplitsing op vast paginaraantal, blanco pagina, barcode-match, modeldetectie, header/footer of fysieke scheidingsbladen.
- Referentiedatasets voor opzoeken, autofill en validatie, plus templatevarianten voor lay-outverschillen per leverancier.
- 16 workflowstaptypes, van import en OCR tot verificatiehubs, export en custom scripts.
- Een visuele ontwerper waar de tekening de workflow is, met beslissingspoorten op documenteigenschappen en veldwaarden.
- Drie operatorhubs — Verificatie, Verwerking en Scan — met het paginabeeld naast de velden en click-to-fill.
- Traceerbaarheid per veld: ruwe herkende waarde, oorspronkelijke waarde, wie ze verifieerde en wanneer.
- 14 validatieregeltypes, van niet-leeg en bereiken tot checksum, expressie, script, REST-aanroep en databasequery.
- Custom scripts in JavaScript, Groovy of Java, gesandboxed, versiebeheerd en testbaar tegen voorbeelddocumenten.
- Check-out-vergrendeling zodat twee operators nooit hetzelfde werk aanraken; publieke reviewlinks voor externen zonder account.
- Dertien exportbestemmingen en acht formaten, waaronder doorzoekbare PDF en PDF/A-2b, opgebouwd uit bewaarde woordgeometrie.
- Veldmapping per exportdoel — niet-gemapte velden worden bewust weggelaten.
- Elf externe connectietypes, elk met een configuratiewizard en een testactie.
- Versleutelde credential-vault per project.
- Plugin-SDK voor gecompileerde workflowstappen, importers en exporters, met eigen migraties en endpoints.
- Een native Model Context Protocol-server met ongeveer 109 curated tools over projecten, documenten, verificatie, herkenning, templates, workflows en beheer.
- OAuth 2.1 met dynamische clientregistratie en een expliciet toestemmingsscherm.
- Tools met scopes en risiconiveaus, en een apart auditkanaal dat ook leesacties van agents registreert, niet alleen schrijfacties.
- Insluitbare Verificatie- en Scan Hubs in uw eigen product, in een iframe, achter een API-key, een kortlevende sessie en een benoemde origin.
- Cluster-nodes die taak- en capaciteitsbewust werk claimen zonder contentie — een node draineren, herstarten, of toewijzen aan OCR, export of import.
Wat het doet
- 01Geen licentiepoort, geen pagineter — de marginale kost van een pagina is de elektriciteit om ze te verwerken.
- 02Zes sector-blueprints leveren in één transactie een volledig werkend project, tegenover een sectornorm van acht tot twaalf weken.
- 03Lokale OCR en lokale modellen houden gereguleerde documenten op uw eigen infrastructuur, met externe AI-providers als optie, nooit als vereiste.