Dokumentenklassifizierungmit verketteten Klassifizierern.
Jedes Dokument wird gegen Typen geprüft, die Sie definieren, durch eine Kette von Klassifizierern, die günstig beginnt und nur bei Bedarf eskaliert: Dateinamensregeln, Strukturprüfungen, dann semantische Bewertung durch ein LLM.
Eine Kette, keine Blackbox.
Geordnete Klassifizierer laufen, bis einer passt; Sie steuern die Reihenfolge und die Regeln.
Dateinamensregeln
Regex- und Musterprüfungen fangen die Dokumente ab, die Ihre Absender bereits beschriften, ganz ohne Modellkosten.
Strukturprüfungen
Single- und Multi-Struktur-Klassifizierer testen, ob das Dokument tatsächlich enthält, was sein Typ verlangt.
Semantische Bewertung
Ein LLM bewertet Ihre formulierte Bedingung für die Fälle, die Regeln nicht trennen können, einschließlich eines exklusiven Modus, der für gemischte Eingänge genau einen Typ wählt.
Ihre Typen, kein Anbieterkatalog.
Vortrainierte Klassifizierung bindet Sie an die Vorstellung des Anbieters, welche Dokumente es gibt. Verkettete Klassifizierung bewertet Ihre Definitionen; eine Dokumentklasse, die es nur in Ihrem Unternehmen gibt, klassifiziert so zuverlässig wie eine Rechnung.
Die Kette gibt Ihnen außerdem einen Kostenregler: zuerst günstige deterministische Prüfungen, modellbasierte Bewertung nur für den Rest und eine Prüf-Queue für alles, was kein Klassifizierer sicher zuordnet. In Pipelines für gemischte Eingänge weist der exklusive Auswahlmodus das passende Schema automatisch zu; eine lineare Pipeline bewältigt so viele Dokumenttypen.
Fragen zur Klassifizierung
Was Teams beim Entwerfen ihrer Klassifizierung am häufigsten fragen.
Klassifizierer laufen in der Reihenfolge, die Sie konfigurieren, bis einer passt: zuerst Dateinamensregeln, dann strukturbasierte Prüfungen, dann semantische LLM-Bewertung. Jeder Klassifizierer ist eine Konfiguration, die Sie bearbeiten und umsortieren können; die Entscheidungslogik ist damit einsehbar statt ein einzelner undurchsichtiger Modell-Score.
Ja: Der exklusive Modus des Multi-Struktur-Klassifizierers wählt mit einem einzigen Auswahlaufruf genau einen Ihrer Typen (oder keinen), und die Extraktionsstufe wendet dann automatisch das Schema dieses Typs an. Eine lineare Pipeline verarbeitet Rechnungen, Verträge und Formulare, die im selben Postfach eintreffen.
Genau dafür sind benutzerdefinierte Typen da: Eine Classifier-Kette bewertet Ihre Definitionen und Bedingungen, keinen festen Katalog. Wenn Sie den Typ beschreiben können (über Namensmuster, erwartete Struktur oder eine semantische Bedingung in Alltagssprache), kann die Kette ihn klassifizieren, und die Prüf-Queue fängt ab, was mehrdeutig bleibt.
Sehen Sie es auf Ihren eigenen Dokumenten.
Das kostenlose 14-Tage-Trial umfasst 200 Dokumente: genug, um Ihre Schemas zu definieren, echte Dateien zu verarbeiten und die Ergebnisse zu messen, bevor Sie jemand anruft.
