Overzicht
DeepSeek-OCR is ontworpen voor documentherkenning en scenario’s voor beeld-naar-tekst, waarbij de grenzen van visuele en tekstuele compressie worden verlegd. Het model kan lange teksten omzetten in sterk gecomprimeerde afbeeldingen, met een OCR-nauwkeurigheid van 97% bij een verliesloze compressieverhouding van 10x en ongeveer 60% nauwkeurigheid bij 20x compressie.Dit model ondersteunt momenteel alleen single-turn, onafhankelijke herkenningstaken. Het ondersteunt geen multi-turn gesprekken. Er kan slechts één afbeelding per verzoek worden geüpload en het wordt sterk aanbevolen om vooraf ingestelde prompts te gebruiken voor optimale prestaties.
Aanbevolen vooraf ingestelde prompts
Gebruiksvoorbeeld
Dit voorbeeld gebruikt de vooraf ingestelde prompt<|grounding|>OCR this image. om tekstherkenning in afbeeldingen uit te voeren.
