Holen Sie Bilanzen, Gewinn- und Verlustrechnungen sowie Kapitalflussrechnungen als strukturiertes JSON aus Geschäfts- und Quartalsberichten heraus. Jede Position behält ihren Abschnitt und beide Periodenspalten bleiben getrennt, sodass Ihr Auswertungsmodell die Ausgabe direkt verarbeiten kann.
Senden Sie die Abschlussseite und ein Schema. Jede Zeile kommt mit ihrer Abschnittsbezeichnung und bereits nach Perioden getrennten Werten zurück, sodass nichts mehr davon abhängt, eine Spaltenüberschrift mit dem Auge zu lesen.
curl -X POST \
https://api-parse.conversiontools.io/v1/extract \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "file=@annual-report.pdf" \
-F 'schema={
"company": "string",
"statement_type": "string",
"fiscal_period": "string",
"period_end": "date",
"currency": "string",
"units": "string",
"line_items": [{
"label": "string",
"section": "string",
"current_period": "number",
"prior_period": "number"
}],
"total_assets": "number",
"total_liabilities": "number",
"total_equity": "number",
"revenue": "number",
"net_income": "number"
}'{
"status": "completed",
"pages": 2,
"data": {
"company": "Halbrook Materials Inc.",
"statement_type": "balance_sheet",
"fiscal_period": "FY2025",
"period_end": "2025-12-31",
"currency": "USD",
"units": "thousands",
"line_items": [
{
"label": "Cash and cash equivalents",
"section": "current_assets",
"current_period": 184320,
"prior_period": 151806
},
{
"label": "Accounts receivable, net",
"section": "current_assets",
"current_period": 96455,
"prior_period": 88012
},
{
"label": "Property, plant and equipment, net",
"section": "non_current_assets",
"current_period": 411208,
"prior_period": 398765
},
{
"label": "Accounts payable",
"section": "current_liabilities",
"current_period": 64907,
"prior_period": 59320
}
],
"total_assets": 764123,
"total_liabilities": 302588,
"total_equity": 461535,
"revenue": null,
"net_income": null
}
}In einem Abschluss steht die Periode in der Spaltenüberschrift - und alles Weitere hängt daran, diese Zuordnung richtig zu treffen.
Laufende und Vorjahresperiode sind eigene Felder jeder Position, sodass kein Wert ins falsche Jahr rutscht, wenn ein Unternehmen die Spaltenreihenfolge tauscht oder eine angepasste Spalte einschiebt.
Zahlungsmittel gehören zum Umlaufvermögen, eine Leasingverbindlichkeit zu den langfristigen Schulden. Jede Zeile trägt ihre Abschnittsbezeichnung, sodass sich eine Zwischensumme gegen genau die Positionen prüfen lässt, aus denen sie besteht.
Keine zwei Unternehmen benennen ihre Posten gleich. Das Schema bestimmt die Form der Ausgabe, sodass ein Modell, das für einen Emittenten gebaut wurde, beim nächsten nicht auseinanderfällt.
Ja, und ebenso mit Abschlüssen nach anderen Rechnungslegungsstandards. Die Extraktion ist schemagesteuert statt formularspezifisch, daher werden ein IFRS-Geschäftsbericht und ein Quartalszwischenbericht mit derselben Anfrage genauso behandelt.
Die Periode steht in der Spaltenüberschrift, und im Schema legen Sie fest, was Sie zurückbekommen möchten. Fordern Sie current_period und prior_period je Position an, und die Spalten werden für Sie getrennt. Druckt ein Abschluss drei oder fünf Jahre, ergänzen Sie ein Feld je Spalte und benennen es so, wie Ihr Modell es erwartet.
Die Angabe der Einheit wird als eigenes Feld erfasst, und Werte kommen so zurück, wie sie gedruckt sind, statt still umgerechnet zu werden - der Multiplikator bleibt in Ihrer Hand. In Klammern geschriebene negative Beträge werden als negative Zahlen zurückgegeben.
Ja. Reichen Sie das vollständige Dokument ein und fragen Sie das Ergebnis ab, oder hinterlegen Sie einen Webhook und lassen Sie sich benachrichtigen, sobald es fertig ist. Lange Berichte müssen nicht von Hand zerteilt werden, und ein Abschluss über einen Seitenumbruch hinweg bleibt ein zusammenhängender Satz von Positionen.
Hochgeladene Dokumente werden automatisch innerhalb von 24 Stunden gelöscht. Extrahierte Daten sind bei der Übertragung sowie im Ruhezustand verschlüsselt und werden niemals zum Trainieren von Modellen verwendet.
Dieselbe schemagesteuerte API funktioniert für jeden Dokumenttyp. Definieren Sie ein Schema einmal und extrahieren Sie aus Tausenden von Dateien.
Strukturiertes JSON aus jedem Dokument mit eigenen Schemas extrahieren.
Jedes PDF in strukturiertes JSON umwandeln, gescannt oder digital.
Lieferant, Positionen, Summen, Steuern und Daten aus Rechnungen.
Geschäft, Artikel, Summen und Zahlungsmethode aus Belegen.
Bestellnummer, Lieferant, Käufer und Positionen auf SKU-Ebene.
Transaktionen, laufende Salden und Daten für den Abgleich.
Daten auf Feldebene aus W-2, 1099 und anderen Steuerformularen.
Parteien, Daten, geltendes Recht und wichtige Klauseln.
Spediteur, Parteien, Häfen, Container und Fracht.
Gutschriftbeträge, zugeordnet zur ursprünglichen Rechnung.
Zahlungen aufgeteilt auf Rechnungen für den Zahlungsabgleich.
Zählerstände, Posten und Summen von jedem Anbieter.
Lieferantenangebote in einer vergleichbaren Form.
Bezüge, Abzüge, Steuern und Jahressummen.
Berufserfahrung, Ausbildung und Fähigkeiten aus jedem Layout.
Felder und MRZ aus Pässen und Personalausweisen.
Miete, Laufzeit, Kautionen und Verlängerungsfristen.
Schaden- und Policennummern, Daten und Forderungsbeträge.
Packstücke und Positionen auf SKU-Ebene für den Wareneingang.
Bestellte und gelieferte Mengen sowie Empfangsbestätigung.
Die kostenlose Stufe deckt Ihre ersten 100 Seiten pro Monat ab. Keine Kreditkarte für den Start.