Skip to main content

Visão geral

O DeepSeek-OCR foi projetado para cenários de reconhecimento de documentos e conversão de imagem em texto, expandindo os limites da compressão visual e textual. O modelo pode renderizar textos longos em imagens altamente comprimidas, alcançando uma precisão de OCR de 97% com uma taxa de compressão sem perdas de 10x e cerca de 60% de precisão com compressão de 20x.
Atualmente, este modelo oferece suporte apenas a tarefas de reconhecimento independentes e de turno único. Ele não oferece suporte a conversas de múltiplos turnos. Apenas uma imagem pode ser enviada por solicitação, e é altamente recomendável usar prompts predefinidos para obter o melhor desempenho.

Prompts predefinidos recomendados

Exemplo de uso

Este exemplo usa o prompt predefinido <|grounding|>OCR this image. para realizar o reconhecimento de texto em imagem.
Imagem de entrada de exemplo:
Imagem de exemplo de OCR
Saída de exemplo:
Última modificação em 15 de maio de 2026