Visão geral
O DeepSeek-OCR foi projetado para cenários de reconhecimento de documentos e conversão de imagem em texto, expandindo os limites da compressão visual e textual. O modelo pode renderizar textos longos em imagens altamente comprimidas, alcançando uma precisão de OCR de 97% com uma taxa de compressão sem perdas de 10x e cerca de 60% de precisão com compressão de 20x.Atualmente, este modelo oferece suporte apenas a tarefas de reconhecimento independentes e de turno único. Ele não oferece suporte a conversas de múltiplos turnos. Apenas uma imagem pode ser enviada por solicitação, e é altamente recomendável usar prompts predefinidos para obter o melhor desempenho.
Prompts predefinidos recomendados
Exemplo de uso
Este exemplo usa o prompt predefinido<|grounding|>OCR this image. para realizar o reconhecimento de texto em imagem.
