DeepSeek-OCR es una línea de investigación y herramientas para trabajar con información visual y textual de documentos. Puede interesarte si necesitas convertir páginas escaneadas o imágenes en una representación que después puedas revisar o procesar. Esta página explica cómo abordar esa evaluación; no contiene una herramienta de subida de archivos.

Dos publicaciones que debes distinguir

El repositorio de DeepSeek-OCR documenta la publicación original del 20 de octubre de 2025 y enlaza DeepSeek-OCR 2, anunciado el 27 de enero de 2026. Cada repositorio contiene su propio código, modelos, instrucciones y licencia.

OCR 2 incluye ejemplos de conversión de documentos a Markdown y de extracción de texto sin conservar la disposición visual. Son tareas distintas: una transcripción puede reconocer palabras y aun así perder el orden de columnas o la relación entre una cifra y su encabezado.

Qué necesitas para utilizarlo

Las instrucciones oficiales describen entornos de inferencia con dependencias de Python y aceleración mediante GPU. Revisa la combinación de bibliotecas indicada para la versión que elijas. La presencia de un ejemplo de instalación no significa que cualquier ordenador tenga memoria suficiente ni que todas las versiones de las dependencias sean intercambiables.

Para un primer ensayo, conserva una copia original del documento, prepara unas pocas páginas representativas y registra la versión exacta del modelo y del software. Evita empezar con todo un archivo documental antes de conocer los errores habituales.

Cómo evaluar documentos en español

Documento ficticio con cuatro zonas de revisión: tildes en Revisión del envío, cifra 12,50 euros, correspondencia de una tabla y orden de lectura de dos columnas.Ver imagen a tamaño completo ↗
Muestra de entrada creada para explicar qué revisar. No es un resultado de DeepSeek-OCR ni una medición de precisión.
Texto de referencia del ejemplo

Revisión del envío. El paquete llegará mañana.

Tabla de la muestra ficticia
ConceptoImporte
Material12,50 €

Columna izquierda — Notas: Revisar la dirección.

Columna derecha — Entrega: Martes, 10:00.

El orden de referencia es título, frase, tabla, columna de notas y columna de entrega. Comprueba por separado las palabras, las cifras y las asociaciones de celdas.

  • Texto continuo: comprueba tildes, eñes, guiones de final de línea y palabras cortadas.
  • Cifras: revisa separadores decimales, porcentajes, signos y unidades.
  • Tablas: confirma la correspondencia entre filas, columnas y encabezados.
  • Disposición: verifica el orden de lectura en páginas con varias columnas, notas al pie o recuadros.
  • Partes ilegibles: conserva una marca de incertidumbre y revisa el original.

Un ejemplo propuesto de control consiste en transcribir manualmente una página corta y compararla con la salida. Cuenta por separado palabras incorrectas, números alterados y celdas mal asociadas. Así puedes decidir si el resultado admite una revisión razonable para tu tarea.

OCR, visión y chat son cosas diferentes

El nombre DeepSeek-OCR no identifica automáticamente el componente utilizado por un chat ni una función disponible en todos los modelos de la API. Para preguntas generales sobre imágenes, consulta las familias de visión y lenguaje. Para servicios alojados, revisa las capacidades de las versiones actuales.

Cuando el texto extraído vaya a utilizarse en una base de datos, conserva el vínculo con la página original y valida sus campos antes de incorporarlos. Encontrarás ideas de tratamiento posterior en la guía de análisis de datos.