DIE REGISTRY-EBENE FÜR UNSTRUKTURIERTE DATEN
Einmal erfassen.
Für immer abfragen.
Talonic erfasst unübersichtliche Unternehmensdokumente einmalig: PDFs, Scans, handschriftliche Notizen, Tabellen, E-Mails, in dauerhafte, schemavalidierte Datensätze mit Nachweisen auf Feldebene. Jeder Workflow, jedes System und jeder KI-Agent fragt später dieselbe Registry ab. Die Quelle wird nie erneut extrahiert.
Antwort innerhalb 1 Werktag · Oder kostenlos starten: 5,000 Credits/Monat, keine Kreditkarte erforderlich
Co-Autor von DIN SPEC 91491, Europas erstem KI-Datenstandard · DSGVO · HIPAA · ISO 27001 / 42001 ausgerichtet · Infrastruktur mit Sitz in der EU

TRUSTED ACROSS LOGISTICS, ENERGY, AUTOMOTIVE, AND CONTRACT OPERATIONS
DAS PROBLEM
Die Daten wurden nie wiederverwendbar gemacht.
Die meisten Tools extrahieren für ein Schema und hören dann auf. Die Struktur wird zusammen mit dem Workflow verworfen, der sie angefordert hat. Das nächste System, der nächste Report oder Agent beginnt wieder bei den Rohdokumenten.
Jedes neue System extrahiert alles erneut.
Ohne Registry bedeutet jedes zusätzliche nachgelagerte System, dass jede Extraktion erneut läuft. Die Kosten skalieren mit Dokumenten mal Systemen.
Jeder neue Agent, Workflow oder jede Integration vervielfacht Ihre Extraktionskosten. Es sei denn, die Daten liegen bereits in einer Registry.
Dieselbe Grundursache, auf vier Arten gemessen:
10%
Der unstrukturierten Unternehmensdaten wird jemals analysiert.
5%
Der Unternehmensdaten ist heute für KI abfragbar.
33%
der Unternehmensanwendungen sind integriert.
5%
der GenAI-Pilotprojekte in Unternehmen erreichen die Produktion.
Vier defekte Schichten. Keine davon wird durch ein besseres Modell behoben. Solange Extraktion Wegwerfware ist, zahlt jeder Anwendungsfall die O(n × m)-Rechnung.
WIEDERVERWENDUNG STATT WIEDERHOLTER EXTRAKTION
Lösen Sie den Workflow. Behalten Sie die Daten.
Erledigen Sie die Dokumentenarbeit, für die Sie ohnehin schon bezahlen. Jedes Feld, das Talonic verarbeitet, landet typisiert und abfragbar in der Registry, sodass der nächste Agent, das nächste Schema oder der nächste Report aus Struktur statt aus einer neuen Extraktion bedient wird. Die Plattform ist das Nebenprodukt der erledigten Arbeit.
- ·Lieferanten- und Kundenverträge
- ·AP/AR: Rechnungen, Bestellungen, Belege
- ·Logistik: Frachtbriefe, Manifeste
- ·Schadensfälle, KYC- und Onboarding-Unterlagen
3,465 documents · 412,908 fields · 1 registry
SERVED FROM REGISTRY
TOKENS SAVED
0
of 1.52M this run
DOCUMENTS RE-READ
0
the old way: 3,465 × every query
ingest once · query forever · pay once
LIVE-EINSÄTZE
Live im regulierten Unternehmen. Heute.
8.500 aktive Verträge in Strukturierung, Stand Q2 2026. Schema v2, 59 deutschsprachige Felder, Microsoft Dynamics-Anbindung in Q2 2026.
Als Nächstes: automatisierte Anomalieerkennung über das gesamte Vertragsportfolio.
22,000 Lieferantenverträge werden für Ivalua strukturiert. Kommerzieller Rollout im Q2 2026.
Nächster Schritt: Ausweitung der Schema-Abdeckung auf Dokumentation klinischer Studien.
930-Dokumente-Ground-Truth-Benchmark. Genauigkeit von 75 % auf 92 % über POC-Zyklen (2025–2026). Ablösung eines sechsstelligen Bestandssystems.
Nächster Schritt: vollständiges Carrier-to-Load-Matching im gesamten Gemspring-Portfolio.
30,500+
Unternehmensverträge werden aktuell strukturiert.
6-figure
sechsstelliges Bestandssystem, das bei Bridgeway abgelöst wird.
< 200ms
mediane Verarbeitungszeit pro Dokument.
DER MECHANISMUS
So funktioniert Talonic.
How Talonic works
01 Sources
An endless stream of documents. None of it queryable. Ingested through Talonic from email, drive, S3, SFTP, or API. Document types include contracts, invoices, emails, scans, carrier manifests, purchase orders, service reports, and allocations.
02 Data Capture
Every document, parsed. Every field, extracted. Every schema, recognized. In parallel, at scale. Talonic processes service agreements, invoices, carrier manifests, purchase orders, and service reports — extracting 64 to 113 fields per document with schema recognition (vendor_contract_v7, invoice_v3, carrier_manifest_v2, purchase_order_v2, service_report_v1).
03 Field Registry
Every field becomes canonical. Every extraction compounds. The registry never resets. Canonical fields include vendor_name, contract_value, effective_date, term_end, auto_renew, governing_law, notice_period, invoice_number, total_amount, tax_rate, currency, due_date, payment_terms, load_id, carrier, origin, destination, weight_kg, incoterms, vehicle_type, technician, report_id, service_date, and facility. New canonicals are continuously discovered: meter_id, incoterm_variant, clinical_phase, hs_code, vat_id, hazmat_class, and more.
04 Schema Matching
Every new schema, mapped to canonicals. Every field, recognized regardless of source terminology. Continuously. Example: customer_contract_v3 maps party_name to vendor_name (0.94 confidence), agreement_value to contract_value (0.91), termination_date to term_end (0.89), monetary_unit to currency (0.97). 4/4 matched with 0.93 average confidence.
05 Query
Every question, answered against the registry. Every answer, structured and typed. Continuously. Query with SQL, natural language, or API calls. Examples: "SELECT contract_value FROM canonicals WHERE governing_law = BGB § 305ff", "which contracts expire in Q4 2026?", "talonic.query(canonicals, filter={governing_law: BGB § 305ff})". Deliver to SAP S/4HANA, Salesforce CRM, NetSuite, Dynamics, Ivalua, or any REST endpoint.
Die meisten Document-AI-Systeme extrahieren für ein Schema. Talonic baut die Datenschicht hinter jedem zukünftigen Schema.
Traditionelle Parsing-Tools starten mit einem Zielformat und extrahieren darauf hin. Extraktionsqualität ist der Boden, nicht die Decke. Kunden erzielen in direkten Benchmarks gegen Bestandssysteme durchgehend über 90 % Genauigkeit. Und bei Talonic lebt dieses Ergebnis in einer Registry, die sich über jedes zukünftige Schema, jedes System und jeden Agenten hinweg aufsummiert.
PROVENANCE
Jeder Wert verweist zurück auf seine Herkunft.
Die meisten Tools liefern einen Wert. Talonic liefert einen Wert, die Zeile, aus der er stammt, den Bereich des Scans, der diese Zeile erzeugt hat, die Konfidenz, die Phase und die Begründung. Standardmäßig auditierbar. Von Grund auf belastbar.
- vendor_nameMeridian Energy AG0.99
- customer_nameKent Logistics Ltd.0.97
- contract_start_date2026-01-010.99
- contract_end_date2027-12-310.99
- contract_value2,480,0000.97
- currencyEUR1.00
- auto_renewtrue0.96
- notice_period_days900.94
- governing_lawDE · BGB § 305ff0.92
- delivery_pointBerlin HKW0.93
- annual_volume_mwh144000.95
- schema_versionvendor_contract_v21.00
ANWENDUNGSFÄLLE
Eine Registry. Jeder Dokument-Workflow.
Derselbe erfasste Datenbestand bedient jeden nachgelagerten Verbraucher. Das sind die vier, die wir am häufigsten sehen.
Rechnungen, Bestellungen, Quittungen und Gutschriften werden zu typisierten Datensätzen. Der Drei-Wege-Abgleich läuft gegen die Registry, nicht gegen PDFs auf einem Netzlaufwerk.
Commercial Invoice · Purchase Order · Goods Receipt Note
Rechnungsverarbeitung →Parteien, Konditionen, Verlängerungsfristen und Verpflichtungen werden einmal extrahiert und über Nachträge und Zusatzvereinbarungen hinweg verfolgt. Cases gruppieren, was zusammengehört.
Master Service Agreement · Contract Amendment · Side Letter
So funktionieren Cases →Ein Agent greift über MCP oder REST auf die Registry zu und liest jedes Dokument wie eine typisierte Datenbank: Felder, Konfidenz und Herkunftsnachweis bei jeder Antwort.
MCP server · REST API · Node SDK
Für Agenten →Copiloten und interne Tools erhalten dieselben verwalteten Felder, die auch Ihr ERP nutzt. Eine Extraktion, jeder Verbraucher: keine parallelen Pipelines, die synchron gehalten werden müssen.
Dynamics 365 · Ivalua · Salesforce · custom REST
Delivery-Infrastruktur →GEFUNDENES GELD
Ihre Dokumente schulden Ihnen Geld.
Verluste verstecken sich dort, wo niemand abfragen kann: doppelte Zahlungen, unberechnete Preiserhöhungen, ablaufende Fristen. Sobald jedes Feld typisiert und nachverfolgbar ist, holt ein einziger Durchlauf über den Korpus sie zurück.
Repräsentative Befunde aus Kreditorenbuchhaltung und Vertragsportfolios. Jede Zeile ist bis zum Wert, der Quellzeile und dem Scan, der sie erzeugt hat, nachvollziehbar.
RETRIEVAL
RAG, wo Genauigkeit zählt.
Vektorsuche über Rohtext liefert Passagen, die relevant wirken. Die Registry liefert Werte, die überprüfbar sind: typisiert, bewertet und bis zur Zeile nachvollziehbar, die sie erzeugt hat.
Wenn die Antwort in einen ERP-Eintrag, eine Ablage oder eine geprüfte Entscheidung einfließt, ist ein plausibel klingender Absatz keine Datenquelle.
| Embedding-Retrieval | Registry-Retrieval | |
|---|---|---|
| Ergebnis | Textabschnitte | Typisierte Felder |
| Sicherheit | Ähnlichkeitswert | Konfidenz pro Feld |
| Quelle | Ungefähre Textpassage | Zeile und Bereich des Scans |
| Bei erneuter Abfrage | Neu einbetten, neu einordnen | Aus der Registry lesen |
| Prüfpfad | — | Wert → Zeile → Scan → Begründung |
DOKUMENTONTOLOGIE
529 Dokumenttypen. Keine Vorlagen.
Vom Schedule K-1 bis zum Bill of Lading (Ocean), von notariellen Urkunden bis zu QC-Prüfprotokollen: Talonic versteht die Struktur jedes Unternehmensdokumenttyps von Anfang an.
Schedule K-1, Form 1099-MISC, Form W-8BEN, Form 1040, Form 990, and 48 more
Purchase Order, Commercial Invoice, Pro Forma Invoice, Goods Receipt Note, Three-Way Match Report, and 48 more
Bill of Lading (Ocean), Bill of Lading (Inland), Air Waybill (AWB), House Air Waybill (HAWB), Sea Waybill, and 48 more
Notarial Deed, Master Service Agreement, Statement of Work, Non-Disclosure Agreement, License Agreement, and 48 more
Commercial Register Extract, Certificate of Good Standing, Certificate of Incorporation, Annual Return, Director's Report, and 48 more
Patient Intake Form, Medical History Questionnaire, Informed Consent Form, Discharge Summary, Operative Report, and 48 more
QC Inspection Form, Certificate of Analysis (CoA), Certificate of Conformance, First Article Inspection Report, Material Test Report, and 48 more
Insurance Application, Policy Declaration Page, Insurance Policy Wording, Endorsement / Rider, Certificate of Insurance, and 48 more
Property Deed, Title Report, Land Registry Extract, Survey Plan, Zoning Certificate, and 48 more
Employment Application, Offer Letter, Employment Contract, Background Check Report, I-9 Employment Eligibility, and 47 more
Für KI-Agenten
Entwickelt als Datenschicht, auf die Ihr Agent zugreift.
Richten Sie Ihren Agenten auf Talonic aus, und er kann jedes Dokument wie eine Datenbank lesen: typisierte Felder, Konfidenz pro Zelle und Herkunftsnachweis. Discovery-Oberflächen und ein MCP-Server sind von Anfang an einsatzbereit.
Über MCP verbinden
npx -y @talonic/mcp@latestDIN SPEC 91491
Wir waren Mitautor des Standards.

Talonic hat DIN SPEC 91491 gemeinsam mit Fraunhofer IIS, Humboldt-Innovation, GIIC und dem DIN verfasst. Europas erster Standard für KI-fähige Daten auf Schema-Ebene.
Da der EU AI Act sich auf Compliance auf Datenebene ausweitet, definiert DIN SPEC 91491, wie Datenbereitschaft auf Schema-Ebene aussieht. Unternehmen, die sich am Standard ausrichten, brauchen eine Implementierung, die parallel dazu entwickelt wurde.
Der Standard, den wir mitgeschrieben haben. Die Implementierung, die wir liefern.
Sehen Sie, was Talonic mit Ihren Daten machen würde.
Senden Sie eine repräsentative Stichprobe aus Verträgen, Scans, Falldokumenten oder Betriebsunterlagen. Wir verarbeiten sie mit Talonic und senden Ihnen Ihre extrahierten Daten zurück: Abdeckung auf Feldebene, Konfidenz, Herkunftsnachweis und eine konkrete Empfehlung, wie Sie Ihren Datenbestand wiederverwendbar machen, innerhalb von fünf Werktagen.
P.S. Sechs Felder, einmal festgelegt, für immer abfragbar. Ihre Dokumente funktionieren genauso.
Noch nicht bereit, eine Stichprobe zu teilen?
Häufig gestellte Fragen
Was ist Talonic?
Talonic ist die Schema-Schicht für Unternehmensdaten. Sie wandelt unstrukturierte Dokumente in schema-validierte strukturierte Daten um, mit Herkunftsnachweis pro Zelle und vollständigem Audit-Trail.
Welche Dokumenttypen kann Talonic verarbeiten?
Talonic unterstützt über 25 Dateiformate, darunter PDFs, Scans, Word-Dokumente, Excel-Tabellen, Bilder, E-Mails und mehr, klassifiziert in eine Dokument-Ontologie mit 529 Typen.
Ist Talonic DSGVO-konform?
Ja. Talonic ist DSGVO- und HIPAA-konform, an ISO 27001 und ISO 42001 ausgerichtet und Mitautor der DIN SPEC 91491. Alle Daten werden auf EU-Infrastruktur in Germany West Central verarbeitet.
Was ist DIN SPEC 91491?
Europas erster Standard für KI-fertige Daten auf Schema-Ebene, veröffentlicht 2025. Talonic hat den Standard zusammen mit Fraunhofer IIS, Humboldt-Innovation und GIIC mitverfasst.
Wie unterscheidet sich Talonic von OCR- oder Dokumenten-Parsing-Tools?
OCR wandelt Pixel in Text um. Talonic klassifiziert Dokumente anhand einer Ontologie mit 529 Typen, extrahiert schema-validierte Felder mit Konfidenzwerten, führt Entitäten zu Fällen zusammen und liefert typisierte Daten mit vollständigem Audit-Trail an führende Systeme.
Kann ich Talonic mit meinen eigenen Dokumenten testen?
Ja. Senden Sie eine repräsentative Stichprobe Ihrer Dokumente, Talonic verarbeitet sie innerhalb von fünf Werktagen. Sie erhalten eine Analyse auf Feldebene zu Extrahierbarkeit, Konfidenzverteilung, empfohlenem Schema und einer Produktions-Roadmap.