Überblick
DeepSeek-OCR ist für Dokumenterkennung und Bild-zu-Text-Szenarien konzipiert und erweitert die Grenzen der visuellen und textuellen Komprimierung. Das Modell kann lange Texte in hochkomprimierte Bilder umwandeln und erreicht dabei eine OCR-Genauigkeit von 97 % bei einem verlustfreien Komprimierungsverhältnis von 10x sowie etwa 60 % Genauigkeit bei 20x Komprimierung.Dieses Modell unterstützt derzeit nur unabhängige Erkennungsaufgaben mit einer einzelnen Anfrage. Mehrstufige Konversationen werden nicht unterstützt. Pro Anfrage kann nur ein Bild hochgeladen werden, und es wird dringend empfohlen, voreingestellte Prompts für optimale Leistung zu verwenden.
Empfohlene voreingestellte Prompts
Nutzungsbeispiel
Dieses Beispiel verwendet den voreingestellten Prompt<|grounding|>OCR this image., um Texterkennung in Bildern durchzuführen.
