Buscador de comandos Docling

Tareas comunes de Docling y el comando exacto. Busca, filtra por categoría y copia. Los comandos usan la sintaxis actual docling convert; verifícalos en la documentación oficial.

Convertir PDF a Markdown

BasicStarter

Convierte un PDF local en Markdown estructurado.

docling convert report.pdf --to md
Opciones, salida y consejos

Opciones usadas

  • --to md Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

# Annual Report

## Revenue

| Year | Revenue |
|------|--------:|
| 2025 | $12M |
| 2026 | $15M |

Variantes

Omitir OCR en un PDF digital (mucho más rápido)

docling convert report.pdf --to md --no-ocr

Escribir directamente en una carpeta

docling convert report.pdf --to md --output ./out

Error común: Ejecutarlo sobre un PDF escaneado y obtener texto vacío. Si el PDF no tiene capa de texto, añada --ocr-mode full_page.

Convertir un documento desde una URL

BasicStarter

Descarga y convierte un documento en línea directamente desde una URL HTTP.

docling convert https://arxiv.org/pdf/2408.09869 --to md
Opciones, salida y consejos

Opciones usadas

  • --to md Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

## Docling Technical Report

The conversion pipeline analyses layout, reading order and tables…

Variantes

Enviar cabeceras de solicitud (auth / token)

docling convert https://example.com/report.pdf --headers '{"Authorization":"Bearer TOKEN"}' --to md

Exportar JSON en su lugar

docling convert https://arxiv.org/pdf/2408.09869 --to json

Error común: Asumir que cualquier URL funciona. La fuente debe ser un formato de documento compatible accesible por HTTP(S).

Exportar JSON sin pérdidas

BasicStarter

Exporta el esquema JSON DoclingDocument, incluidas las bounding boxes.

docling convert report.pdf --to json
Opciones, salida y consejos

Opciones usadas

  • --to json Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

{
  "schema_name": "DoclingDocument",
  "texts": [ ... ],
  "tables": [ ... ],
  "pictures": [ ... ]
}

Variantes

Omitir OCR por velocidad

docling convert report.pdf --to json --no-ocr

Incrustar imágenes como base64

docling convert report.pdf --to json --image-export-mode embedded

Error común: Esperar que el JSON de la CLI y export_to_dict() sean idénticos byte a byte; son vistas equivalentes del mismo documento.

Comprobar la versión instalada

BasicStarter

Muestra las versiones de Docling, docling-core y docling-ibm-models.

docling --version
Opciones, salida y consejos

Opciones usadas

  • --version Muestra la versión instalada de Docling.

Salida esperada

Docling version: 2.129.0
Docling Core version: 2.x.x
Docling IBM Models version: 3.x.x
Python: cpython-312 …

Variantes

Actualizar a la última versión

pip install -U docling docling-core docling-ibm-models

Error común: Informar de un error sin la salida de versión: inclúyala siempre, ya que las opciones cambian entre versiones.

Leer la ayuda integrada

BasicStarter

Lista todas las opciones que admite la versión instalada de Docling, directamente desde la CLI.

docling convert --help
Opciones, salida y consejos

Salida esperada

Usage: docling convert [OPTIONS] SOURCE

  --from TEXT        Input formats to accept…
  --to TEXT          Output formats…
  --ocr-engine TEXT  The OCR engine to use…

Variantes

Listar los comandos de nivel superior

docling --help

Inspeccionar el conversor remoto

docling convert-remote --help

Error común: Confiar en publicaciones de blog antiguas. Confirme siempre las opciones con --help para su versión instalada.

Guardar resultados en una carpeta

BasicStarter

Escribe los archivos convertidos en un directorio de salida concreto en lugar del actual.

docling convert report.pdf --to md --output ./out
Opciones, salida y consejos

Opciones usadas

  • --output Directorio donde se guardan los resultados (no un nombre de archivo).

Salida esperada

./out/report.md

Variantes

Exportar varios formatos a la vez

docling convert report.pdf --to md --to json --to html --output ./out

Error común: Olvidar que --output toma un directorio, no un nombre de archivo. Combínelo con --to para elegir la extensión.

Exportar varios formatos a la vez

OutputIntermediate

La opción --to es repetible: produce Markdown, JSON y HTML en una sola ejecución.

docling convert report.pdf --to md --to json --to html
Opciones, salida y consejos

Opciones usadas

  • --to Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

report.md  report.json  report.html

Variantes

Todo en una carpeta

docling convert report.pdf --to md --to json --output ./out

Error común: Pasar una lista separada por comas (--to md,json). Repita la opción en su lugar.

Convertir una carpeta entera

BasicIntermediate

Apunta Docling a un directorio y recorre cada documento compatible que contiene.

docling convert ./inbox --output ./out
Opciones, salida y consejos

Opciones usadas

  • --output Directorio donde se guardan los resultados (no un nombre de archivo).
  • --abort-on-error Detiene toda la ejecución cuando falla el primer archivo.

Salida esperada

Converting ./inbox/a.pdf … done
Converting ./inbox/b.docx … done

Variantes

Continuar aunque falle un archivo

docling convert ./inbox --output ./out --no-abort-on-error

Filtrar a un formato

docling convert ./inbox --from pdf --output ./out

Error común: Esperar que la recursión en subcarpetas siempre sea deseable: revise la lista de archivos impresa antes de una ejecución grande.

Convertir varios archivos con nombre

BasicIntermediate

Pasa varias rutas en un comando; cada una se convierte de forma independiente.

docling convert a.pdf b.docx c.pptx --output ./out
Opciones, salida y consejos

Opciones usadas

  • source Accepts one or more local paths, directories or URLs.

Salida esperada

a.md  b.md  c.md  written to ./out

Variantes

Fuentes mixtas incluida una URL

docling convert a.pdf https://example.com/b.pdf --output ./out

Error común: Entrecomillar un glob (“*.pdf”) y esperar que el shell lo expanda: deje que el shell lo expanda o pase el directorio.

Descargar todos los modelos

OfflineIntermediate

Guarda en caché los modelos de diseño y tablas antes de usarlos sin conexión.

docling-tools models download --all
Opciones, salida y consejos

Opciones usadas

  • --all Download every available model (large).

Salida esperada

Downloading layout model…
Downloading tableformer model…
Models cached in $HOME/.cache/docling/models

Variantes

Descargar solo lo que necesita

docling-tools models download layout tableformer rapidocr

Descargar un repositorio de HuggingFace

docling-tools models download-hf-repo docling-project/docling-models

Error común: Descargar --all con una conexión medida: elija los modelos específicos que usa.

Convertir DOCX a Markdown

ConversionStarter

Analiza documentos de Microsoft Word a Markdown.

docling convert contract.docx --to md
Opciones, salida y consejos

Opciones usadas

  • --to md Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

# Service Agreement

1. Scope
2. Payment terms…

Variantes

Archivos .doc heredados

docling convert contract.doc --to md

Error común: Esperar que las opciones de OCR importen: los formatos de Office se analizan de forma nativa, así que --ocr-engine no tiene efecto.

Convertir PPTX a Markdown

ConversionStarter

Analiza diapositivas, cuadros de texto y notas del orador.

docling convert slides.pptx --to md
Opciones, salida y consejos

Opciones usadas

  • --page-range Convierte solo un rango de páginas. Lo respetan PDF, XLSX y PPTX.

Salida esperada

## Slide 1 — Overview

Bullet one
Bullet two

Variantes

Solo las diez primeras diapositivas

docling convert slides.pptx --page-range 1-10 --to md

Error común: Asumir que las imágenes dentro de las diapositivas se describen: añada --enrich-picture-description para eso.

Convertir XLSX a Markdown

ConversionStarter

Analiza libros de Excel en tablas estructuradas por hoja.

docling convert workbook.xlsx --to md
Opciones, salida y consejos

Opciones usadas

  • --page-range Convierte solo un rango de páginas. Lo respetan PDF, XLSX y PPTX.

Salida esperada

## Sheet 1

| Region | Q1 | Q2 |
|--------|----|----|
| EMEA   | 12 | 15 |

Variantes

Estructura sin pérdidas

docling convert workbook.xlsx --to json

Error común: Tratar XLSX como un PDF y activar OCR: las hojas de cálculo no tienen páginas de mapa de bits por defecto.

Convertir HTML a Markdown

ConversionStarter

Analiza páginas HTML locales a Markdown.

docling convert page.html --to md
Opciones, salida y consejos

Opciones usadas

  • --html-image-fetch Obtiene las imágenes referenciadas por entradas HTML y EPUB.

Salida esperada

# Page title

Body text converted from HTML…

Variantes

Descargar también imágenes remotas

docling convert page.html --html-image-fetch remote --to md

Error común: Olvidar que la obtención de imágenes está desactivada por defecto; pase --html-image-fetch si necesita las imágenes.

Convertir CSV a Markdown

ConversionStarter

Convierte datos separados por comas en una tabla Markdown.

docling convert data.csv --to md
Opciones, salida y consejos

Opciones usadas

  • --to md Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

| name | score |
|------|------:|
| Ada  | 98    |

Variantes

Mantenerlo como JSON estructurado

docling convert data.csv --to json

Error común: Usar un delimitador distinto de la coma/dialecto CSV estándar: normalícelo primero.

Convertir EPUB a Markdown

ConversionIntermediate

Convierte e-books y contenido EPUB extenso manteniendo la estructura de capítulos.

docling convert book.epub --to md
Opciones, salida y consejos

Opciones usadas

  • --html-image-fetch Obtiene las imágenes referenciadas por entradas HTML y EPUB.

Salida esperada

# Chapter 1

Long-form text…

Variantes

Incluir las ilustraciones

docling convert book.epub --html-image-fetch all --to md

Error común: No obtener las imágenes y luego preguntarse por qué faltan las figuras.

Convertir Markdown a HTML

ConversionIntermediate

Reprocesa un archivo Markdown y exporta HTML limpio (tablas y código conservados).

docling convert notes.md --to html
Opciones, salida y consejos

Opciones usadas

  • --to html Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

<h1>Notes</h1>
<p>…</p>

Variantes

Dividir páginas largas

docling convert notes.md --to html_split_page

Error común: Esperar que se generen archivos de imagen: la exportación HTML referencia cajas, no renderiza imágenes nuevas.

Convertir LaTeX a Markdown

ConversionAdvanced

Analiza fuentes LaTeX, con renderizado opcional de diagramas TikZ.

docling convert paper.tex --to md
Opciones, salida y consejos

Opciones usadas

  • --tikz-engine Set to 'tectonic' to rasterize tikzpicture diagrams.

Salida esperada

# Introduction

The math is preserved as LaTeX where possible…

Variantes

Renderizar diagramas TikZ como imágenes

docling convert paper.tex --tikz-engine tectonic --to md

Error común: El renderizado de TikZ recurre silenciosamente a mantener el código fuente cuando falta Tectonic o falla.

OCR de una sola imagen

OCRIntermediate

Convierte una imagen PNG/JPEG/TIFF con texto a Markdown mediante OCR.

docling convert scan.png --to md --ocr-mode full_page
Opciones, salida y consejos

Opciones usadas

  • --ocr-mode full_page Qué regiones del documento se envían al motor OCR.
  • --ocr-engine Proveedor del motor OCR.

Salida esperada

Text recognised from the image…

Variantes

Usar RapidOCR

docling convert scan.png --ocr-engine rapidocr --to md

Error común: Usar el modo OCR predeterminado en una foto de bajo DPI: aumente la resolución para mayor precisión.

Aplicar OCR a un PDF escaneado

OCRStarter

Fuerza OCR de página completa en páginas solo de imagen.

docling convert scan.pdf --ocr-mode full_page --to md
Opciones, salida y consejos

Opciones usadas

  • --ocr-mode full_page Qué regiones del documento se envían al motor OCR.

Salida esperada

Text reconstructed from the scanned page images…

Variantes

Elegir el motor a la vez

docling convert scan.pdf --ocr-mode full_page --ocr-engine rapidocr --to md

Error común: Dejar el OCR activado en PDF digitales pierde tiempo. Solo fuércelo cuando falte o sea incorrecta la capa de texto.

Elegir un motor OCR

OCRIntermediate

Ejecuta OCR con un motor concreto (ejemplo: RapidOCR).

docling convert scan.pdf --ocr-engine rapidocr --to md
Opciones, salida y consejos

Opciones usadas

  • --ocr-engine Proveedor del motor OCR.

Salida esperada

Using OCR engine: rapidocr

Variantes

Tesseract con un idioma

docling convert scan.pdf --ocr-engine tesseract --ocr-lang eng --to md

Apple Vision en macOS

docling convert scan.pdf --ocr-engine ocrmac --to md

Error común: Elegir un motor que no está instalado. RapidOCR es el valor predeterminado multiplataforma más seguro.

OCR en un idioma concreto

OCRIntermediate

Indica al motor OCR qué idioma(s) esperar para una precisión mucho mejor.

docling convert scan.pdf --ocr-engine tesseract --ocr-lang deu,fra --to md
Opciones, salida y consejos

Opciones usadas

  • --ocr-lang Idiomas OCR; use códigos nativos del motor o etiquetas BCP-47 con el prefijo iso:.

Salida esperada

Using OCR languages: deu, fra

Variantes

Chino simplificado vía BCP-47

docling convert scan.pdf --ocr-engine rapidocr --ocr-lang iso:zh-Hans --to md

Dejar que el motor detecte automáticamente

docling convert scan.pdf --ocr-lang '' --to md

Error común: Mezclar convenciones de motores. Cada motor tiene sus propios códigos: prefije las etiquetas BCP-47 canónicas con iso:.

Desactivar OCR (PDF digitales)

OCRStarter

Omite el OCR en PDF que ya contienen capa de texto.

docling convert report.pdf --no-ocr --to md
Opciones, salida y consejos

Opciones usadas

  • --no-ocr Turn OCR off; the embedded text layer is used as-is.

Salida esperada

Skipping OCR (digital text layer detected)…

Variantes

Omitir también las tablas que no necesite

docling convert report.pdf --no-ocr --no-tables --to md

Error común: Usar --no-ocr en un escaneo: obtendrá una salida vacía o casi vacía.

OCR solo en regiones de diseño

OCRAdvanced

Ejecuta OCR solo en las regiones de diseño detectadas en lugar de toda la página.

docling convert report.pdf --ocr-mode layout_regions --to md
Opciones, salida y consejos

Opciones usadas

  • --ocr-mode layout_regions Qué regiones del documento se envían al motor OCR.

Salida esperada

OCR applied to detected layout regions…

Variantes

Selección de región consciente del PDF

docling convert report.pdf --ocr-mode pdf_aware_layout_regions --to md

Error común: Usar modos de región cuando toda la página es una foto: use full_page en ese caso.

Establecer el modo de segmentación de Tesseract

OCRAdvanced

Ajusta el análisis de diseño de Tesseract con un modo de segmentación de página (0-13).

docling convert scan.pdf --ocr-engine tesseract --psm 6 --to md
Opciones, salida y consejos

Opciones usadas

  • --psm Page Segmentation Mode para motores Tesseract.

Salida esperada

Tesseract PSM 6 — assume a single uniform block of text.

Variantes

Una sola línea de texto

docling convert scan.pdf --ocr-engine tesseract --psm 7 --to md

Error común: Establecer PSM en motores que no son Tesseract, donde se ignora.

Extracción de tablas más rápida

TablesIntermediate

Usa el modo de tabla rápido en lugar del modelo preciso.

docling convert report.pdf --table-mode fast --to md
Opciones, salida y consejos

Opciones usadas

  • --table-mode Compromiso entre precisión y velocidad para el modelo de estructura de tablas.

Salida esperada

Rough table grid, produced faster…

Variantes

Omitir las tablas por completo

docling convert report.pdf --no-tables --to md

Error común: Usar fast en hojas financieras con celdas combinadas: la precisión cae notablemente.

Desactivar la extracción de tablas

TablesIntermediate

Omite el modelo de estructura de tablas cuando solo necesitas texto.

docling convert report.pdf --no-tables --to md
Opciones, salida y consejos

Opciones usadas

  • --no-tables Do not run the table structure model.

Salida esperada

Tables rendered as plain text flow…

Variantes

Ruta de texto digital más rápida

docling convert report.pdf --no-ocr --no-tables --to md

Error común: Activarlo cuando las tablas importan: el contenido de la tabla se colapsará en párrafos.

Usar el motor TableFormer v2

TablesAdvanced

Selecciona un motor de estructura de tablas concreto, incluido el más nuevo TableFormer v2.

docling convert report.pdf --table-structure-engine docling_tableformer_v2 --to md
Opciones, salida y consejos

Opciones usadas

  • --table-structure-engine Selecciona el motor de estructura de tablas.

Salida esperada

Using table structure engine: docling_tableformer_v2

Variantes

Motor de tablas Granite vision

docling convert report.pdf --table-structure-engine granite_vision_table --to md

Error común: Asumir que todos los motores están incluidos: algunos requieren descargas de modelos o plugins adicionales.

Activar enriquecimiento de código y fórmulas

EnrichmentIntermediate

Extrae fórmulas LaTeX y bloques de código con modelos de enriquecimiento.

docling convert paper.pdf --enrich-code --enrich-formula --to md
Opciones, salida y consejos

Opciones usadas

  • --enrich-code Detecta y etiqueta bloques de código.
  • --enrich-formula Extrae fórmulas como LaTeX.

Salida esperada

```python
def hello(): …
```

$$ E = mc^2 $$

Variantes

Solo fórmulas

docling convert paper.pdf --enrich-formula --to md

Solo código

docling convert repo.pdf --enrich-code --to md

Error común: Activar ambos en documentos sin código ni matemáticas: cada uno añade una pasada neuronal y ralentiza la conversión.

Describir imágenes con un VLM

EnrichmentAdvanced

Genera descripciones en lenguaje natural para figuras e imágenes.

docling convert report.pdf --enrich-picture-description --to md
Opciones, salida y consejos

Opciones usadas

  • --enrich-picture-description Genera descripciones de imágenes con un modelo de visión.

Salida esperada

<!-- picture: a bar chart showing revenue growth from 2020 to 2026 -->

Variantes

Limitar los tokens generados

docling convert report.pdf --enrich-picture-description --picture-description-max-new-tokens 256 --to md

Error común: Ejecutarlo en documentos con muchas imágenes sin suficiente RAM/VRAM: carga un modelo de visión.

Clasificar imágenes

EnrichmentAdvanced

Etiqueta imágenes por clase (gráfico, diagrama, captura, foto…) con un modelo clasificador.

docling convert report.pdf --enrich-picture-classes --to md
Opciones, salida y consejos

Opciones usadas

  • --enrich-picture-classes Clasifica imágenes (gráfico, diagrama, captura…).

Salida esperada

<!-- picture class: chart -->

Variantes

Clasificar y describir

docling convert report.pdf --enrich-picture-classes --enrich-picture-description --to md

Error común: Esperar etiquetas perfectas: es un clasificador ligero, no un modelo de visión completo.

Extraer datos de gráficos a tablas

EnrichmentAdvanced

Convierte gráficos de barras, circulares y de líneas en datos tabulares con el modelo de extracción de gráficos.

docling convert report.pdf --enrich-chart-extraction --to md
Opciones, salida y consejos

Opciones usadas

  • --enrich-chart-extraction Extrae datos de gráficos de barras, circulares y de líneas.

Salida esperada

<!-- chart: category | value -->
<!-- 2025 | 12 -->

Variantes

Combinar con salida de tablas

docling convert report.pdf --enrich-chart-extraction --to json

Error común: Esperar que se extraigan escaneos de gráficos 3D complejos: los gráficos más allá de barras/circular/líneas quedan fuera del alcance.

Exportar chunks para RAG

RAGIntermediate

Genera chunks de HybridChunker que conservan la estructura.

docling convert report.pdf --to chunks --chunks-type hybrid
Opciones, salida y consejos

Opciones usadas

  • --to chunks Formato de salida. Repita la opción para exportar varios formatos a la vez.
  • --chunks-type Tipo de chunker usado con --to chunks.

Salida esperada

{ "text": "…", "meta": { "headings": ["Revenue"] } }

Variantes

Limitar el tamaño del chunk

docling convert report.pdf --to chunks --chunks-max-tokens 512

Chunks jerárquicos

docling convert report.pdf --to chunks --chunks-type hierarchical

Error común: Dividir la exportación Markdown con un divisor simple en lugar de usar el chunker consciente de la estructura de Docling.

Establecer el tamaño del chunk

RAGAdvanced

Controla los tokens máximos por chunk y el tokenizer usado para el chunking híbrido.

docling convert report.pdf --to chunks --chunks-max-tokens 512
Opciones, salida y consejos

Opciones usadas

  • --chunks-max-tokens Máximo de tokens por chunk.
  • --chunks-tokenizer Tokenizer usado para el chunking híbrido.

Salida esperada

Chunks sized to the embedding model's token limit…

Variantes

Igualar otro modelo de embeddings

docling convert report.pdf --to chunks --chunks-tokenizer BAAI/bge-small-en-v1.5

Error común: Establecer un tamaño de chunk mayor que el que admite su modelo de embeddings: se truncará.

Convertir con una pipeline VLM

VLMAdvanced

Usa la pipeline VLM con el modelo Granite Docling.

docling convert report.pdf --pipeline vlm --vlm-model granite_docling --to md
Opciones, salida y consejos

Opciones usadas

  • --pipeline vlm Pipeline de procesamiento para archivos PDF e imágenes.
  • --vlm-model Preset VLM usado con --pipeline vlm.

Salida esperada

Markdown generated page-by-page by the vision model…

Variantes

Preset SmolDocling más pequeño

docling convert report.pdf --pipeline vlm --vlm-model smoldocling --to md

Conservar la salida sin procesar del modelo

docling convert report.pdf --pipeline vlm --vlm-write-native-output

Error común: Asumir que VLM siempre es mejor: para PDF digitales simples el pipeline estándar es más rápido y barato.

Limitar la longitud de generación del VLM

VLMAdvanced

Anula el número máximo de tokens que el VLM puede generar por página.

docling convert report.pdf --pipeline vlm --vlm-max-new-tokens 8192 --to md
Opciones, salida y consejos

Opciones usadas

  • --vlm-max-new-tokens Anula max_new_tokens para la generación VLM.

Salida esperada

Long, dense pages no longer get cut off…

Variantes

Conservar la salida sin procesar para depurar

docling convert report.pdf --pipeline vlm --vlm-write-native-output

Error común: Dejar el valor predeterminado en páginas muy densas puede truncar la salida de la página.

Transcribir audio o vídeo (ASR)

AudioIntermediate

Transcribe WAV/MP3 (y vídeo) con la pipeline ASR.

docling convert lecture.mp3 --pipeline asr --to md
Opciones, salida y consejos

Opciones usadas

  • --pipeline asr Pipeline de procesamiento para archivos PDF e imágenes.
  • --asr-model Modelo ASR para archivos de audio y vídeo.

Salida esperada

00:00:00 — Welcome to the show…

Variantes

Mejor precisión

docling convert lecture.mp3 --pipeline asr --asr-model whisper_medium --to md

Salida de subtítulos

docling convert lecture.mp3 --pipeline asr --to vtt

Error común: Usar el whisper_tiny predeterminado para una transcripción importante; elija medium/large para precisión.

Transcribir vídeo a subtítulos

AudioIntermediate

Transcribe el audio de un vídeo y exporta subtítulos WebVTT con marcas de tiempo.

docling convert talk.mp4 --pipeline asr --to vtt
Opciones, salida y consejos

Opciones usadas

  • --to vtt Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

WEBVTT

00:00:00.000 --> 00:00:04.000
Hello and welcome…

Variantes

Otro modelo ASR

docling convert talk.mp4 --pipeline asr --asr-model whisper_small --to vtt

Error común: Esperar que apliquen las opciones de OCR/tablas: el vídeo usa solo el pipeline ASR.

Muestrear vídeo por cambios de escena

AudioAdvanced

Elige cómo se muestrean los fotogramas del vídeo: intervalo fijo o cambios de escena.

docling convert talk.mp4 --pipeline asr --video-sampling-mode scene
Opciones, salida y consejos

Opciones usadas

  • --video-sampling-mode Cómo se muestrean los fotogramas de vídeo.
  • --video-frame-interval Segundos entre fotogramas en el modo de intervalo fijo.

Salida esperada

Frames sampled at scene changes…

Variantes

Muestreo fijo más denso

docling convert talk.mp4 --pipeline asr --video-frame-interval 5

Error común: Usar el modo escena en una única cámara estática: el intervalo fijo es más predecible allí.

Diarización de hablantes (quién dijo qué)

AudioAdvanced

Etiqueta a los hablantes en transcripciones de audio/vídeo (requiere el extra resemblyzer).

docling convert interview.mp4 --pipeline asr --video-diarization
Opciones, salida y consejos

Opciones usadas

  • --video-diarization Activa la diarización de hablantes (requiere resemblyzer).

Salida esperada

[SPEAKER_00] …
[SPEAKER_01] …

Variantes

Desactivar la diarización explícitamente

docling convert interview.mp4 --pipeline asr --no-video-diarization

Error común: Olvidar que la diarización necesita la dependencia resemblyzer instalada.

Exportar imágenes como archivos PNG

OutputIntermediate

Escribe las figuras como archivos PNG separados y las referencia desde el documento de salida.

docling convert report.pdf --to md --image-export-mode referenced --output ./out
Opciones, salida y consejos

Opciones usadas

  • --image-export-mode Cómo se exportan las imágenes para salidas JSON, YAML, HTML y Markdown.

Salida esperada

./out/report.md + ./out/report_artifacts/*.png

Variantes

Marcar solo las posiciones de las imágenes

docling convert report.pdf --to md --image-export-mode placeholder

Incrustar como base64

docling convert report.pdf --to json --image-export-mode embedded

Error común: Usar referenced con --to json y esperar los PNG al lado: revise la carpeta de artefactos.

Exportar DocTags

OutputAdvanced

Produce el compacto marcado DocTags estilo token usado como entrada de modelo.

docling convert report.pdf --to doctags
Opciones, salida y consejos

Opciones usadas

  • --to doctags Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

<doctag><page_1><section_header_level_1>Annual Report</section_header_level_1>…

Variantes

Con salida nativa de VLM

docling convert report.pdf --pipeline vlm --to doctags

Error común: Tratar DocTags como Markdown: es una representación interna compacta para modelos.

Exportar HTML paginado

OutputAdvanced

Produce HTML dividido por página: práctico para visores y revisión lado a lado.

docling convert report.pdf --to html_split_page --output ./out
Opciones, salida y consejos

Opciones usadas

  • --to html_split_page Formato de salida. Repita la opción para exportar varios formatos a la vez.

Salida esperada

./out/report_1.html  report_2.html …

Variantes

HTML de un solo archivo

docling convert report.pdf --to html

Error común: Buscar un solo archivo HTML cuando la salida dividida escribe uno por página.

Visualizar el diseño detectado

OutputAdvanced

Superpone los cuadros delimitadores detectados en las imágenes de página de la salida.

docling convert report.pdf --show-layout --to md --output ./out
Opciones, salida y consejos

Opciones usadas

  • --show-layout Superpone los cuadros delimitadores de los elementos en las imágenes de página.

Salida esperada

Page images with coloured layout boxes…

Variantes

Visualizar celdas de tabla

docling convert report.pdf --debug-visualize-tables

Error común: Esperar que se dibujen cajas sobre el propio Markdown: se dibujan en las imágenes de página exportadas.

Ejecutar en una GPU NVIDIA (CUDA)

PerformanceIntermediate

Acelera la inferencia con CUDA y ajusta los parámetros de hilos/lotes.

docling convert report.pdf --device cuda --num-threads 8 --to md
Opciones, salida y consejos

Opciones usadas

  • --device cuda Acelerador de hardware para la inferencia del modelo.
  • --num-threads Hilos usados para la inferencia del modelo.

Salida esperada

Using accelerator device: cuda

Variantes

Lotes de páginas más grandes

docling convert big.pdf --device cuda --page-batch-size 16

Error común: Pasar --device cuda en una máquina sin runtime CUDA; use auto o cpu en su lugar.

Ejecutar en Apple Silicon (MPS)

PerformanceIntermediate

Usa el backend Metal en Macs de la serie M para una inferencia acelerada.

docling convert report.pdf --device mps --to md
Opciones, salida y consejos

Opciones usadas

  • --device mps Acelerador de hardware para la inferencia del modelo.

Salida esperada

Using accelerator device: mps

Variantes

Dejar que Docling elija

docling convert report.pdf --device auto --to md

Error común: Esperar que MPS iguale a una GPU dedicada: es una buena aceleración, no una tarjeta de centro de datos.

Aumentar el tamaño de lote de páginas

PerformanceAdvanced

Procesa más páginas por lote para elevar el rendimiento de GPU/CPU en documentos grandes.

docling convert big.pdf --page-batch-size 16 --to md
Opciones, salida y consejos

Opciones usadas

  • --page-batch-size Páginas procesadas en un lote.

Salida esperada

Processing 16 pages per batch…

Variantes

Retroceder si se queda sin memoria

docling convert big.pdf --page-batch-size 2

Error común: Aumentarlo hasta provocar un error de falta de memoria: redúzcalo si la conversión falla.

Establecer un tiempo de espera por documento

PerformanceAdvanced

Protege un lote de un único archivo problemático limitando el tiempo de procesamiento.

docling convert ./inbox --document-timeout 120 --output ./out
Opciones, salida y consejos

Opciones usadas

  • --document-timeout Tiempo de espera para procesar cada documento.

Salida esperada

Timed out after 120s — moving to the next file…

Variantes

Abortar todo el lote en caso de fallo

docling convert ./inbox --abort-on-error --output ./out

Error común: Establecer un tiempo de espera muy corto en documentos enormes y obtener fallos falsos.

Perfilar el pipeline de conversión

PerformanceAdvanced

Resume dónde se dedica el tiempo en las etapas de conversión para encontrar cuellos de botella.

docling convert report.pdf --profiling --to md
Opciones, salida y consejos

Opciones usadas

  • --profiling Resume el tiempo dedicado a cada etapa de conversión.
  • --save-profiling Save profiling summaries to JSON.

Salida esperada

layout: 3.2s  ocr: 1.1s  tableformer: 0.9s  total: 5.4s

Variantes

Guardar los números en JSON

docling convert report.pdf --profiling --save-profiling

Error común: Perfilar con -v activado y confundir el tiempo de registro con el tiempo del modelo.

Convertir solo un rango de páginas

ConversionIntermediate

Analiza un subconjunto de páginas en lugar de todo el documento.

docling convert report.pdf --page-range 1-4 --to md
Opciones, salida y consejos

Opciones usadas

  • --page-range Convierte solo un rango de páginas. Lo respetan PDF, XLSX y PPTX.

Salida esperada

Converting pages 1-4 only…

Variantes

Una sola página

docling convert report.pdf --page-range 3 --to md

Error común: Esperar que todos los backends respeten el rango: principalmente PDF, XLSX y PPTX.

Abrir un PDF protegido con contraseña

ConversionAdvanced

Proporciona una contraseña para que los PDF cifrados puedan convertirse.

docling convert locked.pdf --pdf-password 'secret' --to md
Opciones, salida y consejos

Opciones usadas

  • --pdf-password Contraseña para documentos PDF protegidos.

Salida esperada

Decrypting and converting locked.pdf…

Variantes

Usar una contraseña de una variable de entorno

docling convert locked.pdf --pdf-password "$PDF_PW" --to md

Error común: Poner una contraseña real en el historial del shell; prefiera una variable de entorno.

Cambiar el backend de PDF

ConversionAdvanced

Elige entre el backend predeterminado docling-parse y pypdfium2 para PDF problemáticos.

docling convert report.pdf --pdf-backend pypdfium2 --to md
Opciones, salida y consejos

Opciones usadas

  • --pdf-backend docling_parse (default) or pypdfium2.

Salida esperada

Using PDF backend: pypdfium2

Variantes

Analizador predeterminado

docling convert report.pdf --pdf-backend docling_parse --to md

Error común: Quedarse con el predeterminado en PDF con codificaciones de fuente rotas: pruebe pypdfium2.

Usar una ruta de modelos personalizada

OfflineAdvanced

Apunta Docling a un directorio de modelos precargado en lugar de la caché predeterminada.

docling convert report.pdf --artifacts-path /opt/docling/models --to md
Opciones, salida y consejos

Opciones usadas

  • --artifacts-path Ubicación de los artefactos de modelo predescargados.

Salida esperada

Loading models from /opt/docling/models…

Variantes

Usar una variable de entorno en su lugar

DOCLING_ARTIFACTS_PATH=/opt/docling/models docling convert report.pdf --to md

Error común: Apuntar a un directorio vacío: Docling intentará descargar y puede fallar sin conexión.

Ejecutar totalmente sin conexión (air-gapped)

OfflineAdvanced

Predescarga los modelos en un host conectado y luego convierte sin acceso a la red.

export HF_HUB_OFFLINE=1; export DOCLING_ARTIFACTS_PATH=/opt/docling/models; docling convert report.pdf --to md
Opciones, salida y consejos

Opciones usadas

  • DOCLING_ARTIFACTS_PATH Directory holding the pre-downloaded models.
  • HF_HUB_OFFLINE Stop HuggingFace downloads and use the local cache only.

Salida esperada

Conversion completes with no outbound requests…

Variantes

Elegir el directorio de caché de HF

export HF_HOME=/opt/docling/hf; docling convert report.pdf --to md

Error común: Olvidar HF_HUB_OFFLINE=1, lo que hace que Docling intente una descarga de red y se bloquee o falle.

Ejecutar la API Docling Serve

ServerIntermediate

Inicia la API HTTP docling-serve y la UI en el puerto 5001.

docling-serve run --enable-ui
Opciones, salida y consejos

Opciones usadas

  • --enable-ui Serve the built-in web UI alongside the API.

Salida esperada

Uvicorn running on http://0.0.0.0:5001  (docs at /docs)

Variantes

Ejecutar en Docker

docker run -p 5001:5001 -e DOCLING_SERVE_ENABLE_UI=1 quay.io/docling-project/docling-serve

Error común: Exponer el servicio públicamente sin autenticación: póngale delante un proxy y auth.

Convertir mediante un servicio remoto

ServerAdvanced

Descarga la conversión a una instancia de docling-serve en ejecución (archivos, carpetas o URL locales).

docling convert-remote report.pdf --service-url http://localhost:5001 --to md
Opciones, salida y consejos

Opciones usadas

  • --service-url Base URL of docling-serve (or DOCLING_SERVICE_URL).
  • --api-key Optional API key (or DOCLING_SERVICE_API_KEY).

Salida esperada

submitting job… polling… report.md written

Variantes

Servicio autenticado

docling convert-remote report.pdf --service-url https://docling.internal --api-key "$DOCLING_KEY" --to md

Usar polling en lugar de websocket

docling convert-remote report.pdf --service-url http://localhost:5001 --watcher polling --to md

Error común: Pasar opciones solo locales como --device a convert-remote; están ausentes intencionadamente.

Ejecutar el servidor MCP

MCPIntermediate

Inicia el servidor Model Context Protocol para clientes de escritorio de IA.

uvx --from=docling-mcp docling-mcp-server
Opciones, salida y consejos

Opciones usadas

  • --from=docling-mcp Restringe los formatos de entrada aceptados. Use 'odf' para odt, ods y odp.

Salida esperada

docling-mcp server ready (stdio)

Variantes

Configuración JSON para un cliente de IA

{"mcpServers": {"docling": {"command": "uvx", "args": ["--from=docling-mcp", "docling-mcp-server"]}}}

Error común: Pegar el comando en lugar del bloque JSON en la configuración MCP del cliente.

Aumentar la verbosidad del registro

DebugIntermediate

Imprime el progreso (-v) o el registro de depuración completo (-vv) para diagnosticar una conversión.

docling convert report.pdf -vv --to md
Opciones, salida y consejos

Opciones usadas

  • -v / --verbose Repeat for more detail: -v info, -vv debug.
  • -q / --quiet Silence per-file progress (warnings and errors remain).

Salida esperada

DEBUG docling.pipeline… loading layout model

Variantes

Lote silencioso para scripts

docling convert ./inbox --quiet --output ./out

Error común: Dejar -vv activado en producción: el registro de depuración es lento y muy ruidoso.

Visualizar celdas, OCR y tablas

DebugAdvanced

Los visualizadores de depuración muestran lo que detectó cada etapa, para ajuste y solución de problemas.

docling convert report.pdf --debug-visualize-tables
Opciones, salida y consejos

Opciones usadas

  • --debug-visualize-layout Visualiza los clústeres de diseño.
  • --debug-visualize-tables Visualiza las celdas de tabla.
  • --debug-visualize-ocr Visualiza las celdas OCR.
  • --debug-visualize-cells Visualise PDF cells.

Salida esperada

Annotated page images written next to the output…

Variantes

Inspeccionar la detección de OCR

docling convert scan.pdf --debug-visualize-ocr

Inspeccionar los clústeres de diseño

docling convert report.pdf --debug-visualize-layout

Error común: Usar varios visualizadores a la vez y obtener una cantidad abrumadora de imágenes.

Elija su escenario

La ruta más rápida de un tipo de documento a un comando que funciona. Copie uno y cambie el nombre del archivo.

PDF escaneado, sin capa de texto

El OCR de página completa recupera el contenido.

docling convert scan.pdf --ocr-mode full_page --to md

PDF digital, resultado más rápido

Omita el OCR y las tablas que no necesite.

docling convert report.pdf --no-ocr --to md

Artículo de investigación con matemáticas

Extraiga fórmulas LaTeX y bloques de código.

docling convert paper.pdf --enrich-formula --enrich-code --to md

Informe financiero con tablas

Conserve tablas precisas y estructura sin pérdidas.

docling convert report.pdf --table-mode accurate --to json

Alimentar un pipeline RAG

Chunks conscientes de la estructura listos para incrustar.

docling convert report.pdf --to chunks --chunks-type hybrid

Escaneo multilingüe

Dígale al OCR qué idiomas esperar.

docling convert scan.pdf --ocr-engine tesseract --ocr-lang deu,fra --to md

Transcribir una reunión

Voz a texto con un modelo Whisper más grande.

docling convert meeting.mp3 --pipeline asr --asr-model whisper_medium --to md

Diseño visual complejo

Deje que un modelo de visión y lenguaje lea la página.

docling convert brochure.pdf --pipeline vlm --vlm-model granite_docling --to md

Ejecución sin conexión / air-gapped

Use modelos predescargados sin red.

HF_HUB_OFFLINE=1 docling convert report.pdf --artifacts-path /opt/models --to md
1
Empiece aquí

Cómo funciona la CLI

En Docling v2 la conversión vive en el subcomando explícito convert. Todos los comandos tienen la misma forma:

  • source puede ser un archivo local, un directorio o una URL HTTP(S).
  • Las salidas se escriben al lado de forma predeterminada: elija una carpeta con --output y un formato con --to.
  • La ayuda es la fuente autorizada. docling convert --help siempre lista exactamente lo que admite su versión instalada.
docling convert <source> [options]
docling convert report.pdf --to md --output ./out
!La mayoría de los tutoriales antiguos escriben docling report.pdf: eso es sintaxis v1 y no funcionará hoy. Vea Migrar desde v1.
iComandos complementarios: docling-tools models predescarga modelos, docling convert-remote habla con un servicio en ejecución y docling-serve expone una API HTTP.
2
Pipeline

Elegir un pipeline

El pipeline es la mayor decisión estructural: determina qué modelos se ejecutan sobre su PDF o imagen.

docling convert report.pdf --pipeline vlm --vlm-model granite_docling --to md
PipelineCuándo usarloCompromiso
standardPredeterminado para PDF e imágenes: diseño, OCR, tablas.Equilibrado y bien conocido.
nativeQuiere el analizador nativo con hilos para PDF grandes.Análisis rápido; ajuste con --parser-threads.
vlmDiseños complejos y visualmente ricos que un solo modelo maneja mejor.Carga un modelo de visión; más lento y pesado.
asrArchivos de audio y vídeo (familia Whisper).Solo voz; las opciones de OCR/tablas no aplican.
legacyReproducir el comportamiento anterior.No recomendado para trabajos nuevos.
iPara PDF digitales normales el pipeline standard es más rápido y barato que un VLM: empiece por ahí.
3
Formatos

Entradas y salidas

Docling lee PDF, la familia Office, HTML, EPUB, CSV, imágenes, audio/vídeo y más. Consulte la referencia de formatos compatibles para la lista completa y notas por formato.

La opción --to es repetible, así que una ejecución puede emitir varios formatos. Salidas comunes:

docling convert report.pdf --to md --to json --to chunks --output ./out
FormatoQué obtieneMejor para
mdMarkdown legible con tablasNotas, documentación, texto para RAG (predeterminado)
jsonDoclingDocument sin pérdidas con cuadros delimitadoresPipelines personalizados y estructura
chunksChunks conscientes de la estructuraEmbeddings y almacenes vectoriales
htmlUn solo archivo HTMLVistas previas web y correo
html_split_pageUn archivo HTML por páginaVisores página a página
doctagsMarcado compacto estilo tokenEntrada de modelo y flujos de tokens
yaml, text, vtt, doclang, dclx, latexFormatos serializados, de subtítulos, archivo y fuenteHerramientas posteriores específicas
iControle cómo se manejan las imágenes con --image-export-mode placeholder|embedded|referenced.
4
OCR

Decidir sobre el OCR

El OCR es el mayor factor individual tanto en precisión como en tiempo de ejecución. Actívelo de forma deliberada.

  • Active el OCR para escaneos, fotos y PDF sin capa de texto.
  • Desactive el OCR para PDF digitales (--no-ocr): a menudo varias veces más rápido.
  • El modo default solo aplica OCR a las páginas sin texto; full_page aplica OCR a todas las páginas y sobrescribe el texto detectado.
  • layout_regions y pdf_aware_layout_regions aplican OCR solo a las regiones detectadas.
docling convert scan.pdf --ocr-mode full_page --to md
!¿Salida vacía de un PDF escaneado? Fuerce --ocr-mode full_page. El OCR no se ejecutará sobre texto programático aunque la fuente esté dañada.

Elija un motor con --ocr-engine y dele un idioma con --ocr-lang. Compare motores en la referencia de OCR.

5
Rendimiento

Velocidad y hardware

El coste de la conversión está dominado por qué modelos se ejecutan y dónde se ejecutan.

docling convert report.pdf --device cuda --num-threads 8 --to md
PalancaEfecto
--no-ocrLa mayor ganancia en PDF digitales.
--no-tables, omitir el enriquecimientoEvita pasadas neuronales que no necesita.
--device cuda|mps|xpuTraslada la inferencia a una GPU (CUDA, Apple Silicon, Intel).
--num-threadsParalelismo de CPU para la inferencia (predeterminado 4).
--page-batch-sizeMás páginas por lote: aumente hasta que la memoria se ajuste.
--profilingMuestra el tiempo por etapa para que optimice el cuello de botella real.
iProteja los lotes largos con --document-timeout 120. Para aceleradores air-gapped vea --artifacts-path.
6
Automatización

Lotes y automatización

Pase un directorio y Docling lo recorre por usted, o use un bucle en su shell para control total sobre nombres, paralelismo y ejecuciones incrementales.

Conversión de carpeta integrada

Docling recorre un directorio por usted: la ruta por lotes más sencilla.

docling convert ./inbox --output ./out
Bucle de carpeta en PowerShell

Control total sobre qué archivos se recogen en Windows.

Get-ChildItem ./inbox -Recurse -Filter *.pdf | ForEach-Object { docling convert $_.FullName --to md --output ./out }
Lote paralelo con xargs

Cuatro conversiones a la vez para una gran reposición (cuide CPU/RAM).

find ./inbox -name '*.pdf' -print0 \ | xargs -0 -P 4 -I{} docling convert {} --to md --output ./out
Convertir solo archivos nuevos

Omite los archivos que ya tienen salida; útil para ejecuciones incrementales.

for f in ./inbox/*.pdf; do out="./out/$(basename "${f%.pdf}").md" [ -f "$out" ] || docling convert "$f" --to md --output ./out done
Lote de producción robusto

Tiempo de espera por documento y continuar tras los fallos.

docling convert ./inbox --output ./out \ --document-timeout 120 \ --no-abort-on-error \ --quiet
Un formato, en streaming

Envía un solo documento directamente a un archivo en Windows.

docling convert .\report.pdf --to md | Out-File -Encoding utf8 .\report.md
!Las ejecuciones paralelas comparten una pipeline de modelo por proceso: vigile la CPU y la RAM, y baje -P o --page-batch-size si la máquina hace swap.
7
RAG

Chunks para RAG

Docling divide el árbol del documento, no una cadena plana, así que los encabezados y las tablas sobreviven en los chunks.

  • --chunks-type hybrid (predeterminado) o hierarchical.
  • --chunks-max-tokens coincide con el límite de su modelo de embeddings.
  • --chunks-tokenizer elige el tokenizer de HuggingFace usado para contar tokens.
docling convert report.pdf --to chunks --chunks-type hybrid --chunks-max-tokens 512

Vea la guía de RAG para ejemplos de almacenes vectoriales.

8
Sin conexión

Sin conexión y modelos

Predescargue los modelos una vez en un host conectado y luego convierta sin red en el aislado.

  • docling-tools models download layout tableformer rapidocr obtiene solo lo que usa.
  • Establezca DOCLING_ARTIFACTS_PATH en lugar de la opción para scripts.
  • RapidOCR puede tener problemas en sistemas de archivos de solo lectura: prefiera Tesseract en esos entornos.
docling-tools models download --all
HF_HUB_OFFLINE=1 docling convert report.pdf --artifacts-path /opt/docling/models --to md
9
Servidor

Servidor y conversiones remotas

Ejecute la conversión como servicio cuando muchos clientes o idiomas la necesiten, y luego descárguela con el cliente remoto.

docling-serve run --enable-ui
docling convert-remote report.pdf --service-url http://localhost:5001 --to md
iconvert-remote omite intencionadamente opciones solo locales como --device: el servidor controla la ejecución. Para clientes de IA, vea la guía del servidor MCP.
10
Depuración

Depurar una conversión

Cuando la salida parece incorrecta, aumente primero el registro y luego visualice lo que detectó cada etapa.

  • -v registro de información, -vv registro de depuración completo, -q silencioso para scripts.
  • --debug-visualize-layout, --debug-visualize-tables, --debug-visualize-ocr muestran lo que encontró cada etapa.
  • --show-layout superpone cuadros delimitadores en las imágenes de página exportadas.
  • --pdf-backend pypdfium2 ayuda con PDF que usan codificaciones de fuente dañadas.
docling convert report.pdf -vv --to md
11
Migración

Migrar desde la sintaxis v1

Docling v2 reorganizó la superficie de comandos. Si un tutorial, script o trabajo de CI usa la forma antigua, mapéelo con esta tabla.

Sintaxis antiguaSintaxis actualPor qué
docling report.pdfdocling convert report.pdf --to mdv1 convertía directamente; v2 movió la conversión bajo el subcomando convert.
docling report.pdf --format jsondocling convert report.pdf --to json--format pasó a ser --to.
docling report.pdf -o out.mddocling convert report.pdf --to md --output ./out-o/--output ahora es un directorio, no un archivo de destino.
--force-ocr--ocr-mode full_page--force-ocr está obsoleto; use el modo OCR explícito.
--ocr-engine tesseract_cli--ocr-engine tesseractLos valores de motor se renombraron; tesserocr sigue siendo válido para el motor de enlace C.
--table-mode fast (no engine choice)--table-mode fast --table-structure-engine docling_tableformer_v2Ahora puede elegir el modo de velocidad/precisión y el motor de tablas subyacente por separado.
docling --pipeline vlm doc.pdfdocling convert doc.pdf --pipeline vlm --vlm-model granite_doclingLa selección de pipeline y modelo se movió bajo convert.
docling-tools models downloaddocling-tools models download --allSigue disponible; --all predescarga todos los modelos mientras que los nombres simples obtienen un conjunto concreto.
!Fíjese en el cambio de --output: ahora nombra un directorio, no un archivo de destino. Use --to para elegir la extensión.
12
Soluciones

Problemas comunes de un vistazo

SíntomaCausa y solución más probables
Markdown vacío o casi vacío de un escaneoSin capa de texto: añada --ocr-mode full_page.
La conversión es muy lentaOCR en un PDF digital: añada --no-ocr; si no, use una GPU (--device).
Caracteres distorsionados / marcadores GLYPHCodificación de fuente dañada: pruebe --pdf-backend pypdfium2.
Idioma OCR incorrectoEstablezca --ocr-lang usando los códigos del motor.
La GPU no se usaInstale una compilación CUDA/MPS de PyTorch y pase --device cuda|mps.
El cliente MCP no puede conectarseUse el bloque JSON exacto, no el comando sin procesar.

Los tutoriales completos están en Solución de problemas.

13
Paso 13

Referencia completa de opciones de la CLI

OpciónValores aceptadosPredeterminadoQué hace
--fromrepeatable textall supportedRestringe los formatos de entrada aceptados. Use 'odf' para odt, ods y odp.
--tomd, json, yaml, html, html_split_page, text, doctags, vtt, doclang, dclx, chunks, latexmdFormato de salida. Repita la opción para exportar varios formatos a la vez.
--outputpath.Directorio donde se guardan los resultados (no un nombre de archivo).
--image-export-modeplaceholder, embedded, referencedembeddedCómo se exportan las imágenes para salidas JSON, YAML, HTML y Markdown.
--html-image-fetchnone, local, remote, allnoneObtiene las imágenes referenciadas por entradas HTML y EPUB.
--page-rangetext (e.g. 1-4)all pagesConvierte solo un rango de páginas. Lo respetan PDF, XLSX y PPTX.
--pdf-passwordtext-Contraseña para documentos PDF protegidos.
--pipelinelegacy, standard, native, vlm, asrstandardPipeline de procesamiento para archivos PDF e imágenes.
--vlm-modelgranite_docling, smoldocling, deepseek_ocr, granite_vision, pixtral, …granite_doclingPreset VLM usado con --pipeline vlm.
--vlm-max-new-tokensintegermodel defaultAnula max_new_tokens para la generación VLM.
--vlm-write-native-outputflagfalseEscribe la respuesta VLM sin analizar de cada página en <output>/<doc>.vlm-native/.
--asr-modelwhisper_tiny … whisper_large, plus _mlx and _native variantswhisper_tinyModelo ASR para archivos de audio y vídeo.
--video-sampling-modefixed, scenefixedCómo se muestrean los fotogramas de vídeo.
--video-frame-intervalfloat (seconds)10.0Segundos entre fotogramas en el modo de intervalo fijo.
--video-diarizationflagfalseActiva la diarización de hablantes (requiere resemblyzer).
--ocr / --no-ocrflagtrueActiva o desactiva OCR en contenido de mapa de bits.
--ocr-modefull_page, layout_regions, pdf_aware_layout_regions, defaultdefaultQué regiones del documento se envían al motor OCR.
--ocr-engineauto, easyocr, rapidocr, tesserocr, tesseract, ocrmac, nemotron-ocr, kserve_v2_ocrautoProveedor del motor OCR.
--ocr-langcomma-separated codesengine defaultIdiomas OCR; use códigos nativos del motor o etiquetas BCP-47 con el prefijo iso:.
--psminteger 0-13engine defaultPage Segmentation Mode para motores Tesseract.
--tables / --no-tablesflagtrueActiva o desactiva el modelo de estructura de tablas.
--table-modeaccurate, fastaccurateCompromiso entre precisión y velocidad para el modelo de estructura de tablas.
--table-structure-enginedocling_tableformer, docling_tableformer_v2, granite_vision_tabledocling_tableformerSelecciona el motor de estructura de tablas.
--layout-enginelayout_object_detection, docling_layout_default, …layout_object_detectionSelecciona el motor de detección de diseño.
--enrich-codeflagfalseDetecta y etiqueta bloques de código.
--enrich-formulaflagfalseExtrae fórmulas como LaTeX.
--enrich-picture-classesflagfalseClasifica imágenes (gráfico, diagrama, captura…).
--enrich-picture-descriptionflagfalseGenera descripciones de imágenes con un modelo de visión.
--enrich-chart-extractionflagfalseExtrae datos de gráficos de barras, circulares y de líneas.
--chunks-typehybrid, hierarchicalhybridTipo de chunker usado con --to chunks.
--chunks-max-tokensintegertokenizer limitMáximo de tokens por chunk.
--chunks-tokenizerHuggingFace model idsentence-transformers/all-MiniLM-L6-v2Tokenizer usado para el chunking híbrido.
--deviceauto, cpu, cuda, mps, xpuautoAcelerador de hardware para la inferencia del modelo.
--num-threadsinteger4Hilos usados para la inferencia del modelo.
--page-batch-sizeinteger4Páginas procesadas en un lote.
--document-timeoutfloat (seconds)noneTiempo de espera para procesar cada documento.
--abort-on-errorflagfalseDetiene toda la ejecución cuando falla el primer archivo.
--profilingflagfalseResume el tiempo dedicado a cada etapa de conversión.
--artifacts-pathpathHF cacheUbicación de los artefactos de modelo predescargados.
--enable-remote-servicesflagfalseRequerido cuando un modelo se conecta a un servicio remoto.
--allow-external-pluginsflagfalseActiva la carga de motores de plugin de terceros.
-v / --verboserepeatable0-v para registros de información, -vv para registros de depuración.
-q / --quietflagfalseSuprime los registros de progreso por archivo.
--show-layoutflagfalseSuperpone los cuadros delimitadores de los elementos en las imágenes de página.
--debug-visualize-layoutflagfalseVisualiza los clústeres de diseño.
--debug-visualize-tablesflagfalseVisualiza las celdas de tabla.
--debug-visualize-ocrflagfalseVisualiza las celdas OCR.
--versionflag-Muestra la versión instalada de Docling.
14
Paso 14

Preguntas sobre la CLI de Docling

¿Cuál es la diferencia entre `docling` y `docling convert`?
En Docling v1 podía ejecutar `docling file.pdf` directamente. En v2 la conversión vive en el subcomando explícito `docling convert`. Los tutoriales antiguos que omiten `convert` están escritos para v1 y no funcionarán en las versiones actuales: use `docling convert file.pdf --to md`.
¿Por qué mi PDF escaneado se convierte en una salida vacía?
Un PDF escaneado no tiene capa de texto, por lo que debe forzarse el OCR. Ejecute `docling convert scan.pdf --ocr-mode full_page`. Si las páginas son imágenes dentro de un PDF mayor, asegúrese también de que el OCR esté activado (lo está por defecto) y de que haya un motor OCR instalado.
¿Cómo hago la conversión más rápida?
Para PDF digitales añada `--no-ocr` (a menudo varias veces más rápido) y omita las funciones que no necesite, por ejemplo `--no-tables`. Use `--device cuda` o `--device mps` si tiene GPU, y ajuste `--num-threads` y `--page-batch-size`. Use `--profiling` para ver a dónde va realmente el tiempo.
¿Qué motor OCR debería elegir?
Empiece con `auto`. RapidOCR es un buen valor predeterminado multiplataforma y eficiente en CPU. Use `tesseract`/`tesserocr` para muchos idiomas, `ocrmac` en macOS y `nemotron-ocr` solo en un entorno CUDA. Compárelos con sus propios documentos en la guía de OCR.
¿Necesito una GPU?
No. Docling funciona en CPU. Una GPU acelera principalmente los modelos de OCR y enriquecimiento en documentos grandes. En Apple Silicon puede usar `--device mps`; en NVIDIA, `--device cuda`.
¿Dónde se escriben los archivos convertidos?
Por defecto en el directorio actual, junto a donde ejecuta el comando. Use `--output ./alguna/carpeta` para elegir un directorio. Tenga en cuenta que `--output` es un directorio, no un nombre de archivo.
¿Cómo convierto muchos archivos o una carpeta entera?
Pase un directorio (`docling convert ./inbox --output ./out`), pase varias rutas a la vez o use un bucle de shell para tener control total. Los comandos básicos y las recetas por lotes de arriba cubren bash, PowerShell y ejecuciones paralelas.
¿Cómo obtengo chunks para un sistema RAG?
Use `docling convert report.pdf --to chunks --chunks-type hybrid`. Los chunks conservan los encabezados y la estructura de tablas. Puede limitar su tamaño con `--chunks-max-tokens` y elegir el tokenizer con `--chunks-tokenizer`.
¿Puedo ejecutar Docling completamente sin conexión?
Sí. Predescargue los modelos con `docling-tools models download --all` en una máquina conectada y, en el host aislado, establezca `DOCLING_ARTIFACTS_PATH` (y `HF_HUB_OFFLINE=1`) y apunte a la caché copiada con `--artifacts-path`.
¿Cuándo debo usar el pipeline VLM en lugar del estándar?
Use `--pipeline vlm` para páginas complejas y visualmente ricas donde el análisis de diseño clásico tiene dificultades, o cuando quiera un único modelo de extremo a extremo. Para PDF digitales normales el pipeline estándar es más rápido y barato, así que empiece por ahí.
¿Docling sube mis documentos?
No. Docling procesa los documentos localmente por defecto y no envía telemetría. Los modelos remotos solo se usan cuando los habilita explícitamente con `--enable-remote-services` o apunta un pipeline a un servicio externo.
¿Sigue siendo compatible `--force-ocr`?
Está obsoleto. Use `--ocr-mode full_page`, que es la forma admitida de aplicar OCR a todas las páginas y reemplazar cualquier texto existente.