Producten · 04 · Document Intelligence
← Alle producten

Classifix

Maak van ongestructureerde documenten gecategoriseerde, machineleesbare gegevens — zonder ze ooit te versturen.

Upload documenten, lees ze met on-premise OCR in 129 talen, en classificeer en extraheer vervolgens velden met taalmodellen die volledig op uw eigen hardware kunnen draaien. Medewerkers verifiëren de resultaten in een toetsenbordgestuurd controlestation waarbij de herkende woorden rechtstreeks op de pagina worden weergegeven.

129Gebundelde OCR-talen
3OCR-uitvoerformaten
17Bijgehouden jobtypes
0Bytes die moeten vertrekken
Het probleem

De documenten die u het meest moet verwerken, zijn net de documenten die u niet mag versturen.

Cloudoplossingen voor documentbegrip zijn uitstekend, maar voor veel klanten simpelweg geen optie: het gaat om patiëntendossiers, gerechtelijke dossiers, offerteaanvragen of personeelsgegevens, en zodra die een grens of tenant-grens overschrijden, stopt het project. Het werk blijft dus manueel — sorteren, intypen, klasseren — tegen een kost die niemand meet omdat het altijd zo is geweest.

01
Gegevens mogen het pand niet verlaten
Regelgeving, contract of beleid sluit elke dienst uit die documenten buiten de eigen omgeving verwerkt.
02
Gemengde binnenkomende batches
Een scanbatch met vijf documenttypes, die iemand handmatig moet uitsplitsen.
03
Overtypen vanaf papier
Velden die opnieuw worden ingetypt in een systeem dat ze had kunnen lezen, met de fouten die daarbij horen.
04
Geen feedbacklus
Correcties verdwijnen in het hoofd van een medewerker in plaats van de volgende batch te verbeteren.
De oplossing

De volledige pijplijn draait op uw eigen hardware — inclusief het model.

01
Lokale herkenning
OCR draait in-process met 129 taalpakketten die al zijn meegeleverd. Geen downloadstap, geen dienst per pagina, geen uitgaande oproep.
02
Lokale intelligentie
Negen modelleveranciers achter één configuratie, waarvan vijf op uw eigen machines draaien — classificatie en extractie zonder gegevensuitstroom is een instelling, geen project.
03
Mensen in de lus
Een controlestation gebouwd voor snelheid: het document aan de ene kant, de beslissing aan de andere, met de hele wachtrij navigeerbaar via het toetsenbord.

Mogelijkheden

01Optische tekenherkenning
  • 129 meegeleverde taalpakketten, inclusief verticaal Chinees, Japans en Koreaans, Fraktur en scriptdetectie.
  • Drie uitvoervormen per document bewaard: platte tekst, woord-gepositioneerde markup en een archiverings-XML-laag.
  • PDF-pagina's gerasteriseerd op 300 dpi; afbeeldingen worden rechtstreeks aanvaard.
  • Configureerbare resolutie, taal, pagina-segmentatiemodus en uitvoerformaat.
  • Threadpool afgestemd op de machine, met voortgang per pagina en gecachete resultaten, zodat herverwerken een keuze is, geen kost.
  • Versleutelde en lege PDF's worden gedetecteerd en geweigerd, in plaats van stilzwijgend niets op te leveren.
02Classificatie & extractie
  • Definieer uw eigen classifiers en categorieën, met massale categoriecreatie vanuit een geplakte lijst.
  • Classificatie door een taalmodel levert de categorie, een betrouwbaarheidsscore en de redenering op.
  • Classificatie per pagina met automatische opsplitsing: een gemengde binnenkomende batch wordt opgesplitst in één uitvoerbestand per categorie.
  • Categoriesleutelwoorden — verplichte, optionele en verboden termen — scoren een document en kunnen het automatisch herklasseren of markeren.
  • Extractors gedefinieerd per documenttype met vier promptslots — systeem, extractie, schema en verfijning — plus een optionele verfijningsronde.
  • Uitvoer als JSON of XML, opgeslagen met veldenaantal, betrouwbaarheid, methode, model en verwerkingstijd.
  • Endpoints voor losse, sequentiële batch- en parallelle batchextractie.
03Modellen, lokaal of hosted
  • Negen modelleveranciers — vijf die op uw eigen hardware draaien en vier hosted.
  • Benoemde modelprofielen per organisatie met volledige controle over generatieparameters en een connectiviteitstest.
  • Herbruikbare, geversioneerde prompts met sjabloonvariabelen voor zowel classificatie als extractie.
  • Een modelronde corrigeert de herkenningsuitvoer voordat iets verderop deze leest.
  • Een regex-pad behandelt eenvoudige, vaste patronen waarvoor een model niet nodig is.
04Validatie & evaluatie
  • Een driepanelig controlescherm — wachtrij, document, beslissing — met herkende woord-, lijn- en blokkaders over de paginascan.
  • Toetsenbordgestuurde navigatie: volgende, vorige, aanvaarden en pagineren zonder de muis aan te raken.
  • Aanvaard een classificatie of herklasseer ze tegen de categorielijst, document per document.
  • Wachtrijstatistieken waardoor een verantwoordelijke de achterstand ziet in plaats van te gokken.
  • Een modelvergelijking laat benoemde modellen op hetzelfde corpus lopen en rapporteert nauwkeurigheid, gemiddelde betrouwbaarheid en verwerkingstijd.
  • Precisie, recall en F-maat per categorie, met testruns bewaard als geschiedenis voor vergelijking.
05Operaties & integratie
  • Zeventien bijgehouden jobtypes voor herkenning, training, classificatie, extractie, herklassering, herstel en opschoning.
  • Elke job rapporteert voortgang, verwerkte items, geschatte eindtijd en een gedetailleerd logboek; jobs kunnen worden geannuleerd, herstart of massaal opgeruimd.
  • 236 REST-endpoints verdeeld over drieëntwintig controllers, beschreven in een OpenAPI-document.
  • Scoped API-sleutels met een permissiekaart per sleutel, vervaldatum, intrekking en dagelijkse gebruiksregistratie.
  • Exporteer of stream een volledige classifier — bestanden en data — naar een andere Classifix-instantie, of kopieer ze binnen één instantie.
  • Begeleide eerste opstart, inclusief generatie van een service-unit.
■Eén zelfstandige Java 21 / Spring Boot JAR met OCR-engine en taalpakketten inbegrepen; PostgreSQL-database.
■Server-gerenderde front end, geen framework of buildstap; PDF-viewer in de browser met woordpositie-overlay.
■236 REST-endpoints verdeeld over 23 controllers, gedocumenteerd via OpenAPI.
■Negen modelleveranciers, vijf selfhosted; opslag op lokale schijf of een gekoppelde cloudmap.
■Circa 139.000 regels code voor applicatie en tests samen, 24 entiteiten, 168 testklassen.

Wat het doet

  • 01Alles draait op uw eigen hardware — OCR, classificatie en het taalmodel — zonder verplichte gegevensuitstroom.
  • 02129 meegeleverde OCR-talen en negen modelleveranciers, waarvan vijf volledig on-premise draaien.
  • 03Een toetsenbordgestuurd controlestation toont herkende woorden rechtstreeks op de pagina, zodat controleurs verifiëren in plaats van te gokken.

In het kort

Voor wieAccounts Payable · Juridisch · Overheid · Documentbureaus
LicentieGelicentieerd per installatie, niet per pagina. Classifix wordt eenmalig aangekocht en door u zelf uitgevoerd, met een jaarlijkse vergoeding op basis van uw eigen omzet (vanaf €900 minimum, met een jaarlijkse stijging van maximaal 25%). Elke schijf omvat onbeperkte gebruikers, projecten en organisaties binnen één tenant, plus selfhosting en support. Hosting, hardware en AI-modelkosten zijn voor uw rekening; consultancy en opleiding worden apart geofferteerd.

Classifix in uw organisatie?