Häufige Docling-Aufgaben und der genaue Befehl. Suchen, nach Kategorie filtern und kopieren. Die Befehle nutzen die aktuelle docling convert-Syntax; prüfen Sie die offizielle Dokumentation.
PDF in Markdown umwandeln
BasicStarter
Eine lokale PDF in strukturiertes Markdown umwandeln.
docling convert report.pdf --to md
Flags, Ausgabe & Tipps
Verwendete Flags
--to md Ausgabeformat. Wiederholen Sie das Flag, um mehrere Formate gleichzeitig zu exportieren.
In Docling v2 befindet sich die Konvertierung im expliziten Unterbefehl convert. Jeder Befehl hat dieselbe Form:
source kann eine lokale Datei, ein Verzeichnis oder eine HTTP(S)-URL sein.
Ausgaben werden standardmäßig daneben geschrieben — wählen Sie mit --output einen Ordner und mit --to ein Format.
Die Hilfe ist maßgeblich.docling convert --help listet immer genau das, was Ihre installierte Version unterstützt.
docling convert <source> [options]
docling convert report.pdf --to md --output ./out
!Die meisten älteren Tutorials schreiben docling report.pdf — das ist v1-Syntax und funktioniert heute nicht. Siehe Von v1 migrieren.
iBegleitbefehle: docling-tools models lädt Modelle vorab, docling convert-remote spricht mit einem laufenden Dienst und docling-serve stellt eine HTTP-API bereit.
2
Pipeline
Pipeline wählen
Die Pipeline ist die größte strukturelle Entscheidung: Sie legt fest, welche Modelle über Ihr PDF oder Bild laufen.
Standard für PDF und Bilder — Layout, OCR, Tabellen.
Ausgewogen und gut verstanden.
native
Sie möchten den threaded nativen Parser für große PDFs.
Schnelles Parsen; mit --parser-threads abstimmen.
vlm
Komplexe, visuell reiche Layouts, die ein einzelnes Modell besser bewältigt.
Lädt ein Vision-Modell; langsamer und schwerer.
asr
Audio- und Videodateien (Whisper-Familie).
Nur Sprache; OCR-/Tabellen-Flags gelten nicht.
legacy
Reproduzieren älteren Verhaltens.
Für neue Arbeit nicht empfohlen.
iFür gewöhnliche digitale PDFs ist die Pipeline standard schneller und günstiger als ein VLM — beginnen Sie dort.
3
Formate
Eingaben und Ausgaben
Docling liest PDF, die Office-Familie, HTML, EPUB, CSV, Bilder, Audio/Video und mehr. Die vollständige Liste mit Hinweisen pro Format finden Sie in der Referenz der unterstützten Formate.
Das Flag --to ist wiederholbar, sodass ein Lauf mehrere Formate ausgeben kann. Häufige Ausgaben:
!Leere Ausgabe aus einem gescannten PDF? Erzwingen Sie --ocr-mode full_page. OCR läuft nicht auf programmatischem Text, selbst wenn die Schriftart beschädigt ist.
Wählen Sie eine Engine mit --ocr-engine und eine Sprache mit --ocr-lang. Vergleichen Sie Engines in der OCR-Referenz.
5
Leistung
Geschwindigkeit und Hardware
Die Konvertierungskosten werden davon dominiert, welche Modelle laufen und wo sie laufen.
docling convert report.pdf --device cuda --num-threads 8 --to md
Hebel
Wirkung
--no-ocr
Größter Gewinn bei digitalen PDFs.
--no-tables, Anreicherung überspringen
Vermeidet neuronale Durchläufe, die Sie nicht brauchen.
--device cuda|mps|xpu
Verlagert die Inferenz auf eine GPU (CUDA, Apple Silicon, Intel).
--num-threads
CPU-Parallelität für die Modellinferenz (Standard 4).
--page-batch-size
Mehr Seiten pro Batch — erhöhen, bis der Speicher knapp wird.
--profiling
Zeigt die Zeit pro Phase, damit Sie den echten Engpass optimieren.
iSchützen Sie lange Batches mit --document-timeout 120. Für Air-Gapped-Beschleuniger siehe --artifacts-path.
6
Automatisierung
Stapelverarbeitung & Automatisierung
Übergeben Sie ein Verzeichnis und Docling durchläuft es für Sie, oder schleifen Sie in Ihrer Shell für volle Kontrolle über Benennung, Parallelität und inkrementelle Läufe.
Integrierte Ordnerkonvertierung
Docling durchläuft ein Verzeichnis für Sie — der einfachste Batch-Weg.
docling convert ./inbox --output ./out
PowerShell-Ordnerschleife
Volle Kontrolle darüber, welche Dateien unter Windows erfasst werden.
!Parallele Läufe teilen sich eine Modell-Pipeline pro Prozess — beobachten Sie CPU und RAM und senken Sie -P oder --page-batch-size, wenn die Maschine swappt.
7
RAG
Chunks für RAG
Docling chunked den Dokumentbaum, nicht einen flachen String, sodass Überschriften und Tabellen in den Chunks erhalten bleiben.
--chunks-type hybrid (Standard) oder hierarchical.
--chunks-max-tokens entspricht dem Limit Ihres Embedding-Modells.
--chunks-tokenizer wählt den HuggingFace-Tokenizer zum Zählen der Token.
iconvert-remote lässt absichtlich lokale Flags wie --device weg — der Server besitzt die Ausführung. Für KI-Clients siehe den MCP-Server-Leitfaden.
10
Debug
Eine Konvertierung debuggen
Wenn die Ausgabe falsch aussieht, erhöhen Sie zuerst die Protokollierung und visualisieren Sie dann, was jede Phase erkannt hat.
--pdf-backend pypdfium2 hilft bei PDFs mit beschädigten Schriftkodierungen.
docling convert report.pdf -vv --to md
11
Migration
Von v1-Syntax migrieren
Docling v2 hat die Befehlsfläche neu organisiert. Wenn ein Tutorial, Skript oder CI-Job die alte Form verwendet, ordnen Sie sie mit dieser Tabelle zu.
Alte Syntax
Aktuelle Syntax
Warum
docling report.pdf
docling convert report.pdf --to md
v1 konvertierte direkt; v2 verlagerte die Konvertierung unter den convert-Unterbefehl.
docling report.pdf --format json
docling convert report.pdf --to json
--format wurde zu --to.
docling report.pdf -o out.md
docling convert report.pdf --to md --output ./out
-o/--output ist jetzt ein Verzeichnis, keine Zieldatei.
--force-ocr
--ocr-mode full_page
--force-ocr ist veraltet; verwenden Sie den expliziten OCR-Modus.
--ocr-engine tesseract_cli
--ocr-engine tesseract
Engine-Werte wurden umbenannt; tesserocr ist weiterhin für die C-Binding-Engine gültig.
--table-mode fast (no engine choice)
--table-mode fast --table-structure-engine docling_tableformer_v2
Sie können jetzt den Geschwindigkeits-/Genauigkeitsmodus und die zugrunde liegende Tabellen-Engine getrennt wählen.
Erforderlich, wenn ein Modell eine Verbindung zu einem Remote-Dienst herstellt.
--allow-external-plugins
flag
false
Aktiviert das Laden von Plugin-Engines Dritter.
-v / --verbose
repeatable
0
-v für Info-Logs, -vv für Debug-Logs.
-q / --quiet
flag
false
Unterdrückt Fortschritts-Logs pro Datei.
--show-layout
flag
false
Legt Bounding-Boxen der Elemente über Seitenbilder.
--debug-visualize-layout
flag
false
Visualisiert Layout-Cluster.
--debug-visualize-tables
flag
false
Visualisiert Tabellenzellen.
--debug-visualize-ocr
flag
false
Visualisiert OCR-Zellen.
--version
flag
-
Zeigt die installierte Docling-Version an.
14
Schritt 14
Docling-CLI-Fragen
Was ist der Unterschied zwischen `docling` und `docling convert`?
In Docling v1 konnten Sie `docling file.pdf` direkt ausführen. In v2 befindet sich die Konvertierung im expliziten Unterbefehl `docling convert`. Alte Tutorials, die `convert` weglassen, sind für v1 geschrieben und funktionieren in aktuellen Releases nicht — verwenden Sie `docling convert file.pdf --to md`.
Warum wird mein gescanntes PDF in eine leere Ausgabe konvertiert?
Ein gescanntes PDF hat keine Textebene, daher muss OCR erzwungen werden. Führen Sie `docling convert scan.pdf --ocr-mode full_page` aus. Wenn Seiten Bilder in einem größeren PDF sind, stellen Sie außerdem sicher, dass OCR aktiviert ist (standardmäßig der Fall) und eine OCR-Engine installiert ist.
Wie mache ich die Konvertierung schneller?
Fügen Sie für digitale PDFs `--no-ocr` hinzu (oft mehrere Male schneller) und überspringen Sie nicht benötigte Funktionen, zum Beispiel `--no-tables`. Verwenden Sie `--device cuda` oder `--device mps`, wenn Sie eine GPU haben, und stimmen Sie `--num-threads` und `--page-batch-size` ab. Mit `--profiling` sehen Sie, wohin die Zeit tatsächlich fließt.
Welche OCR-Engine sollte ich wählen?
Beginnen Sie mit `auto`. RapidOCR ist ein starker plattformübergreifender Standard und CPU-freundlich. Verwenden Sie `tesseract`/`tesserocr` für viele Sprachen, `ocrmac` unter macOS und `nemotron-ocr` nur in einer CUDA-Umgebung. Vergleichen Sie sie mit Ihren eigenen Dokumenten im OCR-Leitfaden.
Brauche ich eine GPU?
Nein. Docling läuft auf der CPU. Eine GPU beschleunigt hauptsächlich OCR- und Anreicherungsmodelle bei großen Dokumenten. Unter Apple Silicon können Sie `--device mps` verwenden; bei NVIDIA `--device cuda`.
Wohin werden die konvertierten Dateien geschrieben?
Standardmäßig in das aktuelle Verzeichnis, neben dem Ort, an dem Sie den Befehl ausführen. Verwenden Sie `--output ./irgendein/ordner`, um ein Verzeichnis zu wählen. Beachten Sie, dass `--output` ein Verzeichnis ist, kein Dateiname.
Wie konvertiere ich viele Dateien oder einen ganzen Ordner?
Übergeben Sie ein Verzeichnis (`docling convert ./inbox --output ./out`), übergeben Sie mehrere Pfade gleichzeitig oder verwenden Sie eine Shell-Schleife für volle Kontrolle. Die Grundbefehle und die Batch-Rezepte oben decken bash, PowerShell und parallele Läufe ab.
Wie erhalte ich Chunks für ein RAG-System?
Verwenden Sie `docling convert report.pdf --to chunks --chunks-type hybrid`. Die Chunks bewahren Überschriften und Tabellenstruktur. Sie können ihre Größe mit `--chunks-max-tokens` begrenzen und den Tokenizer mit `--chunks-tokenizer` wählen.
Kann ich Docling vollständig offline betreiben?
Ja. Laden Sie Modelle mit `docling-tools models download --all` auf einem verbundenen Rechner vorab und setzen Sie auf dem isolierten Host `DOCLING_ARTIFACTS_PATH` (und `HF_HUB_OFFLINE=1`) und verweisen Sie mit `--artifacts-path` auf den kopierten Cache.
Wann sollte ich die VLM-Pipeline statt der Standard-Pipeline verwenden?
Verwenden Sie `--pipeline vlm` für komplexe, visuell reiche Seiten, bei denen klassische Layout-Analyse schwer tut, oder wenn Sie ein einziges End-to-End-Modell möchten. Für gewöhnliche digitale PDFs ist die Standard-Pipeline schneller und günstiger — beginnen Sie dort.
Lädt Docling meine Dokumente hoch?
Nein. Docling verarbeitet Dokumente standardmäßig lokal und sendet keine Telemetrie. Remote-Modelle werden nur verwendet, wenn Sie sie ausdrücklich mit `--enable-remote-services` aktivieren oder eine Pipeline auf einen externen Dienst verweisen.
Wird `--force-ocr` noch unterstützt?
Es ist veraltet. Verwenden Sie `--ocr-mode full_page`, den unterstützten Weg, um jede Seite zu OCR-en und vorhandenen Text zu ersetzen.