Descripción general
DeepSeek-OCR está diseñado para escenarios de reconocimiento de documentos y conversión de imagen a texto, llevando al límite la compresión visual y textual. El modelo puede representar textos largos como imágenes altamente comprimidas, logrando una precisión de OCR del 97% con una relación de compresión sin pérdida de 10x y alrededor de un 60% de precisión con una compresión de 20x.Este modelo actualmente solo admite tareas de reconocimiento independientes de un solo turno. No admite conversaciones de varios turnos. Solo se puede cargar una imagen por solicitud, y se recomienda encarecidamente usar prompts predefinidos para obtener un rendimiento óptimo.
Prompts predefinidos recomendados
Ejemplo de uso
Este ejemplo utiliza el prompt predefinido<|grounding|>OCR this image. para realizar reconocimiento de texto en imágenes.
