FÜR ENTWICKLER
Eine Data Extraction API, die schema-validiertes JSON liefert
Ein Endpunkt. Senden Sie ein Dokument per POST, erhalten Sie typisiertes JSON zurück, mit Konfidenzwert und Provenienz für jedes Feld. Erkennen Sie die Felder automatisch oder senden Sie Ihr eigenes Schema und erhalten Sie genau diese Struktur. Derselbe Aufruf verarbeitet Rechnungen, Verträge, Kontoauszüge und 529 Dokumenttypen in über 25 Formaten.
Ein Aufruf: /v1/extract
Die gesamte Oberfläche ist ein einziges POST. Senden Sie eine Datei und optional die gewünschte Struktur. Die Antwort ist ein typisiertes Objekt plus Konfidenz und Provenienz pro Feld. Für den synchronen Pfad ist keine Job-Orchestrierung nötig, und asynchrone sowie Streaming-Modi teilen sich bei Bedarf denselben Antwortvertrag.
Anfrage
curl -X POST https://api.talonic.com/v1/extract \
-H "Authorization: Bearer $TALONIC_API_KEY" \
-F "file=@invoice.pdf" \
-F 'schema={"vendor":"string","total_eur":"number","due_date":"date"}'Antwort
{
"data": {
"vendor": "Acme Corp",
"total_eur": 1500.00,
"due_date": "2026-07-15"
},
"confidence": {
"vendor": 0.99,
"total_eur": 0.97,
"due_date": 0.92
},
"provenance": {
"total_eur": { "page": 1, "region": [0.62, 0.81, 0.78, 0.84] }
}
}Lassen Sie das Feld schema weg, und die API erkennt stattdessen jedes Feld im Dokument automatisch. Senden Sie ein umfangreicheres JSON Schema, validiert es Typen, Pflichtfelder und verschachtelte Arrays wie Positionszeilen.
Auto-Schema oder eigenes Schema
Schema ist der Vertrag. Wenn Sie nicht wissen, was in einem Dokument steht, senden Sie es unformatiert und lesen alles aus, was die Engine findet. Wenn Ihr Code die benötigte Struktur bereits kennt, was bei jedem Funktionsaufruf eines Agenten der Fall ist, senden Sie das Schema und erhalten genau dieses Objekt. Drei Schema-Formate werden akzeptiert: vollständiges JSON Schema für maximale Kontrolle, eine vereinfachte Feldliste und eine flache Schlüssel-Typ-Zuordnung für den schnellsten Weg.
Da die Ausgabe schema-validiert ist, bleibt die JSON-Struktur über Anbieter und Layouts hinweg stabil. Eine neu gestaltete Rechnung eines bestehenden Lieferanten liefert weiterhin dieselben Schlüssel, sodass nachgelagerter Code bei einer Layoutänderung nicht bricht.
Node SDK und MCP-Server
Das Node SDK und der MCP-Server sind dünne Wrapper über dieselbe REST-API. Mit dem MCP-Server ruft ein KI-Agent in Claude, Cursor oder jedem MCP-Client die Extraktion als natives Tool auf, ohne zusätzlichen Klebecode.
npm install @talonic/nodeimport { Talonic } from "@talonic/node";
const client = new Talonic({ apiKey: process.env.TALONIC_API_KEY! });
const result = await client.extract({
file_path: "invoice.pdf",
schema: { vendor: "string", total_eur: "number" }
});
// result.data, result.confidence, result.provenanceGehostetes MCP unter https://mcp.talonic.com/mcp bedeutet keine Installation nötig. Für andere Sprachen treibt die OpenAPI-Spezifikation die Codegenerierung direkt an. Siehe den Entwicklerleitfaden für die drei Modi, die Authentifizierung und die Cost-Header.
Transparente, nutzungsbasierte Preisgestaltung
Starten Sie kostenlos mit 5.000 Credits pro Monat, ohne Kreditkarte. Kostenpflichtige Nutzung basiert auf Credits zu 1.000 Credits pro Euro: Die Dokumentenerfassung kostet 100 Credits pro Seite, Abfragen auf bereits erfassten Daten sind kostenlos. Es gibt keine Gebühren pro Sitzplatz oder Connector. Jede synchrone Antwort enthält Cost-Header, sodass ein Agent genau sieht, was ein Aufruf gekostet hat und welches Guthaben verbleibt.
Siehe Preise für aktuelle Tarife oder die API-Referenz für den vollständigen Endpunkt-Katalog, das Fehler-Envelope und die Webhook-Events.
Häufig gestellte Fragen
Was macht die Data Extraction API?+
Sie verwandelt ein Dokument in strukturiertes, typisiertes JSON. Sie senden eine Datei per POST an /v1/extract und erhalten Felder als schema-validiertes Objekt zurück, mit einem Konfidenzwert und Herkunftsnachweis für jeden Wert. Sie deckt Rechnungen, Kontoauszüge, Verträge, Quittungen und 529 Dokumenttypen über 25+ Dateiformate ab, sodass eine einzige Integration einen ganzen Stapel formatspezifischer Parser ersetzt.
Muss ich ein Schema definieren?+
Nein. Senden Sie ein Dokument ohne Schema, und die API erkennt die Felder automatisch und gibt alles zurück, was sie findet. Senden Sie ein Dokument mit eigenem Schema, als JSON Schema, als vereinfachte Feldliste oder als flache Key-Type-Map, erhalten Sie genau diese Form zurück. Die meisten Produktivaufrufer senden ein Schema, da ihr Code die benötigte Form bereits kennt.
Wie wird die Konfidenz gemeldet?+
Pro Feld, nicht pro Dokument. Jeder Wert trägt einen Konfidenzwert von 0.0 bis 1.0 und einen Herkunftsverweis auf Quellseite und -bereich. Synchrone Antworten enthalten außerdem Cost-Header (X-Talonic-Cost-Credits, X-Talonic-Balance-Credits), sodass ein Agent die Ausgaben bei jedem Aufruf ohne zweite Anfrage verfolgen kann.
Gibt es ein SDK oder einen MCP-Server?+
Ja. Das Node SDK (@talonic/node) und der MCP-Server (@talonic/mcp) sind dünne Wrapper über dieselbe REST-API, sodass ein KI-Agent die Extraktion als Tool ohne Klebecode aufrufen kann. Für andere Sprachen treibt die OpenAPI-Spezifikation unter talonic.com/openapi.json die Codegenerierung direkt an.
Was kostet die Data Extraction API?+
Es gibt eine kostenlose Stufe mit 5,000 Credits pro Monat, keine Kreditkarte erforderlich. Kostenpflichtige Nutzung ist Credit-basiert bei 1,000 Credits pro Euro: Die Erfassung einer Seite kostet 100 Credits, und Abfragen, die aus bereits erfassten Daten aufgelöst werden, sind kostenlos. Die Preise sind unter talonic.com/pricing veröffentlicht, ohne Gebühren pro Sitzplatz oder Connector.
Wo erfolgt die Extraktion?+
Auf EU-ansässiger Infrastruktur: Microsoft Azure in Germany West Central mit Mistral Large als primärem Modell. Für Kunden, die dies benötigen, verlassen die Daten den EU-Rechtsraum nicht. Die API ist DSGVO-konform und ISO 27001-konform.
Machen Sie Ihren ersten Extraktionsaufruf
Holen Sie sich einen API-Schlüssel und senden Sie ein Dokument per POST. Erhalten Sie in derselben Antwort schema-validiertes JSON mit Konfidenz und Herkunft zurück.
Parsen Sie speziell Rechnungen? Siehe Rechnungsparsing und Rechnungsdatenextraktion.