> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Eine kurze Einführung in Clip Skip

Clip Skip ist eine Funktion, die buchstäblich einen Teil des Bildgenerierungsprozesses überspringt, was zu leicht unterschiedlichen Ausgaben führt. Dadurch wird auch das Rendern von Bildern schneller.

### Aber warum sollte irgendjemand einen Teil des Diffusionsprozesses überspringen wollen?

Ein typisches Bild eines Stable Diffusion 1.5-Basismodells durchläuft 12 "clip"-Ebenen, die Verfeinerungsstufen darstellen. Die frühen Ebenen sind sehr allgemein, während die späteren Ebenen klarere und spezifischere Bilder erzeugen. Bei einigen Basismodellen, insbesondere solchen, die auf Danbooru-Tags basieren, hat sich durch Ausprobieren gezeigt, dass das Überspringen bestimmter Ebenen zu besseren Bildern führen kann, da die allgemeinen clip-Ebenen unerwünschtes Rauschen einbringen können. Du kannst Ebenen buchstäblich überspringen, GPU-Zeit sparen und bessere Kunst erzielen.

Wenn du ein Bild von "a cow" möchtest, interessieren dich die Unterkategorien von "cow", die das Textmodell möglicherweise kennt, vielleicht nicht. Besonders, da diese in ihrer Qualität variieren können. Wenn du also "a cow" möchtest, willst du vielleicht nicht "an Aberdeen Angus bull". (Der vollständige Beitrag befindet sich am Ende dieser Seite.)

Du kannst dir CLIP Skip als Einstellung dafür vorstellen, "wie genau das Textmodell sein soll". Du kannst es ausprobieren und sehen, dass jede clip-Stufe mehr Definition in Bezug auf die Beschreibung hinzufügt. Wenn du zum Beispiel einen detaillierten Prompt über einen jungen Mann hast, der auf einem Feld steht, würdest du bei niedrigeren clip-Stufen ein Bild von "a man standing" erhalten, während tiefere Stufen "a young man standing" oder "a young man standing in a forest" ergeben würden, und so weiter. CLIP Skip wird besonders effektiv, wenn Modelle verwendet werden, die auf eine bestimmte Weise strukturiert sind, bei der das "1girl"-Tag in viele Unter-Tags zerfallen kann, die mit diesem Haupt-Tag verbunden sind.

### Brauche ich das?

Es ist eine kleine Optimierung, die nur für Hardcore-Enthusiasten empfohlen wird, die auf Qualität fixiert sind. Wenn du an Anime oder Semi-Realismus arbeitest, ist es einen Versuch wert.

### Einschränkungen

**Wie viele Ebenen übersprungen werden sollten**

Allgemein gesagt kann das Überspringen von 1 oder 2 Ebenen gute Ergebnisse liefern. Das Überspringen von mehr als 2 Ebenen kann jedoch Bilder erzeugen, die so wirken, als hätten sie eine geringe Guidance.

**Inkonsistente Kompatibilität**

Clip Skip ist zu einer dieser "Schnall dich an"-Arten von sicheren Standardeinstellungen geworden, bei denen viele Leute sie lieber einmal einstellen und dann vergessen. Dieser Ansatz ist nicht klug. Die Funktion kann auch unvorhersehbare Ergebnisse liefern, wenn sie mit anderen Technologien wie LoRAs und Textual Inversions verwendet wird. Fehlende Ebenen an Stellen, an denen Ebenen erwartet werden, können die Bildqualität verschlechtern oder überhaupt keine Wirkung haben.

Es ist oft schneller, es einfach auszuprobieren, als Ergebnisse zu vergleichen. Achte nur darauf, auch den Seed, die Guidance, das Konzept und den Sampler festzulegen, um die Unterschiede genau beurteilen zu können.
