> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Ratenlimits

## 1. Ratenlimits verstehen

Ratenbegrenzung bezeichnet die Regeln, die festlegen, wie häufig die API eines Benutzers innerhalb eines bestimmten Zeitfensters auf unsere Plattformdienste zugreifen darf. Ihre Ziele sind:

* **API-Missbrauch und Fehlverwendung verhindern:** Durch das Festlegen einer Obergrenze für die Anfragehäufigkeit begrenzen wir ungewöhnlichen oder unbeabsichtigten Datenverkehr.
* **Faire Ressourcenzuteilung sicherstellen:** Wir verhindern, dass eine kleine Anzahl von Benutzern Systemressourcen monopolisiert, sodass alle gleichberechtigt auf den Dienst zugreifen können.
* **API-Leistung und Zuverlässigkeit aufrechterhalten:** Durch das Glätten von Lastspitzen stabilisieren wir die Antwortzeiten und reduzieren aus Überlastung resultierende Fehlerraten, wodurch die allgemeine Dienstqualität verbessert wird.
* **Systemstabilität schützen:** Ratenlimits helfen dabei, plötzliche Verkehrsspitzen abzufangen und zu verhindern, dass hohe Parallelitätsspitzen unsere Infrastruktur überlasten.

## 2. Metriken für Ratenlimits

Für unsere Bild- und Videomodelle verwenden wir zwei primäre Metriken zur Ratenbegrenzung:

* **IPM (Images Per Minute):** Die Anzahl der Bilder, die ein Bildmodell pro Minute generieren darf.
* **RPM (Requests Per Minute):** Die Anzahl der API-Anfragen, die ein Videomodell pro Minute verarbeiten darf.

## 3. Standard-Ratenlimits

Für verschiedene Modelle wendet unsere Plattform differenzierte Strategien zur Ratenbegrenzung an, basierend auf dem Rechenressourcenverbrauch des jeweiligen Modells.

### **IPM**

Das IPM-Limit (Images Per Minute) steuert die Anzahl der Bilder, die pro Minute generiert werden können. Die Standard-IPM-Werte für jedes Modell sind in der folgenden Tabelle aufgeführt.

| Ressource/Service              | Modell-API           | Standardbenutzereinstellungen |
| :----------------------------- | :------------------- | :---------------------------- |
| Text zu Bild                   | `txt2img_v3`         | 20                            |
| Bild zu Bild                   | `img2img_v3`         | 10                            |
| Hintergrund entfernen          | `remove_background`  | 10                            |
| Hintergrund ersetzen           | `replace_background` | 10                            |
| Text entfernen                 | `remove_text`        | 10                            |
| Inpainting                     | `inpainting`         | 10                            |
| Bereinigung                    | `cleanup`            | 10                            |
| Gesicht zusammenführen         | `merge_face`         | 10                            |
| FLUX.1 \[schnell] Text zu Bild | `flux-1-schnell`     | 10                            |
| Hochskalieren                  | `upscale_v3`         | 20                            |

### **RPM**

Das RPM-Limit (Requests Per Minute) steuert die Anzahl der pro Minute zulässigen API-Anfragen. Die Standard-RPM-Werte für jedes Modell sind in der folgenden Tabelle angegeben.

| Ressource/Service             | Modell-API           | Standardbenutzereinstellungen |
| :---------------------------- | :------------------- | :---------------------------- |
| Video: Gesicht zusammenführen | `video_merge_face`   | 10                            |
| Text zu Video                 | `txt2video`          | 2                             |
| Bild zu Video                 | `img2video`          | 2                             |
| Wan 2.1 Text zu Video         | `wan_txt_to_video`   | 20                            |
| Wan 2.1 Bild zu Video         | `wan i2v`            | 20                            |
| Hunyuan Video Fast            | `hunyuan_video_fast` | 20                            |
| KLING V1.6 Bild zu Video      | `Kling i2v`          | 20                            |
| KLING V1.6 Text zu Video      | `Kling t2v`          | 20                            |

## 4. Umgang mit Ratenlimits

### Wie überwacht man Ratenlimits?

Wenn Ihre API-Anfragen die zulässige Rate überschreiten, gibt die API Folgendes zurück:

* **HTTP-Statuscode:** 429 Too Many Requests
* **Antworttext:** Eine Meldung, die angibt, dass das Ratenlimit überschritten wurde.

### Best Practices

**Um das Auslösen von Ratenlimits zu vermeiden, können Sie:**

* **Clientseitige Anfrage-Drosselung implementieren:** Respektieren Sie die Ratenlimits der Plattform, indem Sie die Anfragerate Ihrer Anwendung steuern und sicherstellen, dass Sie nicht zu viele Aufrufe in kurzer Zeit senden.
* **Exponentielles Backoff bei Wiederholungsversuchen verwenden:** Wenn Sie eine Ratenlimit-Antwort erhalten (z. B. HTTP 429), warten Sie zwischen Wiederholungsversuchen schrittweise länger, anstatt sofort erneut zu versuchen, wodurch die Last auf den Dienst reduziert wird.
* **Ihre API-Nutzung überwachen:** Verfolgen und protokollieren Sie kontinuierlich Ihre Anfragezahlen, Häufigkeiten und alle Fehlerantworten, damit Sie Ihre Nutzungsmuster proaktiv anpassen können.

### Wenn Sie Ratenlimits erreichen

**Wenn Sie eine HTTP-429-Antwort ("Too Many Requests") erhalten, können Sie:**

* **Später erneut versuchen:** Warten Sie einen kurzen Zeitraum, bevor Sie Ihre Anfrage erneut senden.
* **Ihre Anfragen optimieren:** Reduzieren Sie die Häufigkeit der Aufrufe, um innerhalb der Ratenlimits der Plattform zu bleiben.
* **Ein höheres Ratenlimit anfordern:** Wenn Sie ein höheres Ratenlimit benötigen, füllen Sie bitte das Kontaktformular unter [Kontingente & Limits](https://novita.ai/quota-limits/image) aus, um mit uns in Kontakt zu treten.
