Von Docling unterstützte Formate

Was Docling lesen und exportieren kann. Basierend auf der offiziellen Liste – prüfen Sie stets die offizielle Seite.

FormatKategorieOCRTabellenHinweiseBefehl
PDF
.pdf
DokumenteoptionaljaErweitertes PDF-Parsing mit Layout, Lesereihenfolge und Tabellenverständnis.
  • Für digitale PDFs --no-ocr verwenden, für Scans --ocr-mode full_page.
  • Die funktionsreichste Eingabe: Layout, Lesereihenfolge und Tabellen.
docling convert file.pdf --to md
Word
.docx, .doc
DokumenteneinjaWord-Dokumente mit Überschriften, Listen und Tabellen.
  • Überschriften, Listen und Tabellen lassen sich gut in Markdown abbilden.
docling convert file.docx --to md
OpenDocument Text
.odt
DokumenteneinjaOpenDocument-Textdokumente.
  • Ideal für Dokumente aus LibreOffice Writer.
docling convert file.odt --to md
Apple Pages
.pages
DokumenteneinjaApple-Pages-Dokumente (Pages 5+ und iWork '09).
  • Unterstützt Pages 5+ und iWork-'09-Dateien.
docling convert file.pages --to md
Markdown
.md, .qmd, .Rmd
DokumenteneinjaReines Markdown und Markdown-Supersets.
  • Konvertiert Markdown und seine Obermengen (qmd, Rmd).
docling convert file.md --to md
AsciiDoc
.adoc, .asciidoc
DokumenteneinjaAsciiDoc-Textdokumente.
  • Gut für technische Dokumentation in AsciiDoc.
docling convert file.adoc --to md
LaTeX
.tex, .latex
DokumenteneinjaLaTeX-Quelldokumente.
  • Konvertieren Sie .tex-Quellen, nicht das kompilierte PDF.
docling convert file.tex --to md
Plain text
.txt, .text
DokumenteneinneinReine Textdateien.
  • Reiner Text hat keine Struktur, die wiederhergestellt werden könnte.
docling convert file.txt --to md
PowerPoint
.pptx, .ppt
PräsentationenneinjaFolien mit Layout, Textboxen und Notizen.
  • Referentennotizen werden zusammen mit dem Folientext erfasst.
docling convert file.pptx --to md
OpenDocument Presentation
.odp
PräsentationenneinjaOpenDocument-Präsentationen.
  • Ideal für LibreOffice-Impress-Präsentationen.
docling convert file.odp --to md
Excel
.xlsx, .xls
TabellenneinjaArbeitsmappen, je Blatt in Tabellen umgewandelt.
  • Jedes Blatt wird zu einer eigenen strukturierten Tabelle.
docling convert file.xlsx --to md
OpenDocument Spreadsheet
.ods
TabellenneinjaOpenDocument-Tabellen.
  • Ideal für LibreOffice-Calc-Arbeitsmappen.
docling convert file.ods --to md
CSV
.csv
TabellenneinjaKommagetrennte Werte.
  • Wird als einzelne Tabelle geparst.
docling convert file.csv --to md
HTML
.html, .htm, .xhtml
WebneinjaWebseiten und gespeichertes HTML.
  • Skripte und Styles werden ignoriert; sichtbare Inhalte bleiben erhalten.
docling convert file.html --to md
EPUB
.epub
WebneinjaE-Books im EPUB-Format.
  • Kapitel folgen der Spine-Reihenfolge des Buchs.
docling convert file.epub --to md
WebVTT
.vtt
WebneinneinWeb Video Text Tracks (Untertitel).
  • Zeitgesteuerte Untertitel werden zu strukturiertem Text.
docling convert file.vtt --to md
Images
.png, .jpg, .jpeg, .tiff
BilderjateilweiseGescannte Seiten und Bilddateien; OCR für Text erforderlich.
  • OCR ist für Text erforderlich; --ocr-mode full_page verwenden.
docling convert scan.png --to md
Email
.eml, .msg
E-MailneinjaE-Mail-Nachrichtendateien.
  • Header, Text und Anhänge werden getrennt.
docling convert mail.eml --to md
XBRL
.xml (XBRL)
XMLneinjaeXtensible Business Reporting Language – Finanzberichte.
  • Finanztabellen bleiben erhalten.
docling convert report.xml --to md
USPTO XML
.xml (USPTO)
XMLneinjaUSPTO-Patent-XML-Dokumente.
  • Patent-XML mit Abschnitten und Ansprüchen.
docling convert patent.xml --to md
JATS XML
.xml (JATS)
XMLneinjaJATS-XML für Zeitschriftenartikel.
  • Zeitschriftenartikel-XML mit strukturierten Abschnitten.
docling convert article.xml --to md
Audio
.wav, .mp3
Audio/VideoneinneinSprache, transkribiert mit der ASR-Pipeline.
  • Benötigt das asr-Extra; verwendet Whisper.
docling convert audio.mp3 --pipeline asr --to md
Video
.mp4, .avi, .mov, .mkv, .webm
Audio/VideoneinneinVideo, geparst in ein ASR-Transkript mit repräsentativen Keyframes.
  • Erzeugt ein ASR-Transkript plus repräsentative Keyframes.
docling convert video.mp4 --pipeline asr --to md
1
Schritt 1

So konvertiert Docling ein Dokument

Docling liest 23 Eingabeformate aus acht Familien und exportiert neun Ausgabeformate. Filtern Sie die Tabelle, um ein Format zu finden, und folgen Sie seinem Befehl. Diese Anleitung erklärt, wie die Konvertierung funktioniert, wie die Tabelle zu lesen ist und wie Sie die richtige Ausgabe wählen.

Jede Eingabe durchläuft dieselbe Pipeline: Die Datei wird in ein einheitliches DoclingDocument geparst und dann in das gewählte Format exportiert.

  • Die Layoutanalyse erkennt Spalten, Kopf- und Fußzeilen sowie die Lesereihenfolge.
  • TableFormer rekonstruiert Tabellen als Markdown- oder HTML-Matrizen.
  • OCR wird nur angewendet, wenn eine Seite keine Textebene hat oder Sie es erzwingen.
  • Das Ergebnis ist ein DoclingDocument, das Sie vielfältig exportieren können.
2
Schritt 2

So lesen Sie die Tabelle

Die Tabelle listet jede unterstützte Eingabe mit Endungen, Kategorie und einem fertigen Befehl.

  • OCR: ob OCR für diese Eingabe gilt (optional, ja oder nein).
  • Tabellen: ob die Tabellenstruktur rekonstruiert wird (ja, teilweise oder nein).
  • Hinweise und Tipps: worauf bei diesem Format zu achten ist.
  • Befehl: kopieren und den Dateinamen ersetzen.
3
Schritt 3

Die richtige Ausgabe wählen

Das Eingabeformat schränkt den Export nicht ein; wählen Sie die Ausgabe passend zum nächsten Schritt.

4
Schritt 4

OCR und Tabellen nach Format

OCR gilt nur für bildbasierte Eingaben. Tabellen werden für jedes strukturierte Format rekonstruiert.

  • Bilder und gescannte PDFs benötigen OCR; digitale PDFs meist nicht.
  • Office-, Web- und XML-Eingaben bringen Struktur mit, daher ist OCR standardmäßig aus.
  • Audio und Video nutzen die ASR-Pipeline statt OCR.
  • Eine OCR-Engine wählen Sie auf der Seite OCR-Engines.
5
Schritt 5

Wenn ein Format nicht unterstützt wird

Steht eine Datei nicht in der Tabelle, kann Docling sie nicht direkt parsen.

  • Konvertieren Sie sie zuerst in PDF, DOCX oder HTML.
  • Entfernen Sie bei verschlüsselten PDFs den Passwortschutz.
  • Testen Sie mit einer frischen Kopie, wenn eine Datei beschädigt sein könnte.
  • Siehe Fehlerbehebung bei Konvertierungsfehlern.
6
Schritt 6

Leistung und Datenschutz

Die Konvertierung läuft lokal, und nur aktivierte Modelle kosten Zeit.

  • Deaktivieren Sie OCR bei digitalen Dokumenten; es ist der größte Geschwindigkeitsfaktor.
  • Nutzen Sie --table-mode fast, wenn ungefähre Tabellen akzeptabel sind.
  • Bevorzugen Sie bei großen Stapeln eine GPU.
  • Nichts wird hochgeladen; Dateien verlassen Ihren Rechner nie.
7
Schritt 7

Häufig gestellte Fragen

Welche Formate kann Docling lesen?
23 Eingabeformate aus Dokumenten, Tabellen, Präsentationen, Web, Bildern, E-Mail, XML und Audio/Video. Die Tabelle oben listet alle auf.
Welche Ausgabeformate kann Docling schreiben?
Markdown, JSON, HTML, DocTags, DocLang, WebVTT, YAML, LaTeX und gechunkte JSON.
Braucht Docling für jede PDF OCR?
Nein. OCR ist optional und nur für Scans oder PDFs ohne Textebene nötig. Für digitale PDFs --no-ocr verwenden.
Kann Docling verschlüsselte PDFs lesen?
Nein. Entfernen Sie den Passwortschutz vor der Konvertierung.
Behält Docling Tabellen?
Ja. TableFormer rekonstruiert Tabellen für strukturierte Eingaben und PDFs; Bilder und Scans hängen von der OCR-Qualität ab.
Was, wenn mein Format nicht aufgeführt ist?
Konvertieren Sie es zuerst in PDF, DOCX oder HTML und lassen Sie Docling darauf laufen.