Skip to main content

1. Ratenlimits verstehen

Ratenbegrenzung bezeichnet die Regeln, die festlegen, wie häufig die API eines Benutzers innerhalb eines bestimmten Zeitfensters auf unsere Plattformdienste zugreifen darf. Ihre Ziele sind:
  • API-Missbrauch und Fehlverwendung verhindern: Durch das Festlegen einer Obergrenze für die Anfragehäufigkeit begrenzen wir ungewöhnlichen oder unbeabsichtigten Datenverkehr.
  • Faire Ressourcenzuteilung sicherstellen: Wir verhindern, dass eine kleine Anzahl von Benutzern Systemressourcen monopolisiert, sodass alle gleichberechtigt auf den Dienst zugreifen können.
  • API-Leistung und Zuverlässigkeit aufrechterhalten: Durch das Glätten von Lastspitzen stabilisieren wir die Antwortzeiten und reduzieren aus Überlastung resultierende Fehlerraten, wodurch die allgemeine Dienstqualität verbessert wird.
  • Systemstabilität schützen: Ratenlimits helfen dabei, plötzliche Verkehrsspitzen abzufangen und zu verhindern, dass hohe Parallelitätsspitzen unsere Infrastruktur überlasten.

2. Metriken für Ratenlimits

Für unsere Bild- und Videomodelle verwenden wir zwei primäre Metriken zur Ratenbegrenzung:
  • IPM (Images Per Minute): Die Anzahl der Bilder, die ein Bildmodell pro Minute generieren darf.
  • RPM (Requests Per Minute): Die Anzahl der API-Anfragen, die ein Videomodell pro Minute verarbeiten darf.

3. Standard-Ratenlimits

Für verschiedene Modelle wendet unsere Plattform differenzierte Strategien zur Ratenbegrenzung an, basierend auf dem Rechenressourcenverbrauch des jeweiligen Modells.

IPM

Das IPM-Limit (Images Per Minute) steuert die Anzahl der Bilder, die pro Minute generiert werden können. Die Standard-IPM-Werte für jedes Modell sind in der folgenden Tabelle aufgeführt.

RPM

Das RPM-Limit (Requests Per Minute) steuert die Anzahl der pro Minute zulässigen API-Anfragen. Die Standard-RPM-Werte für jedes Modell sind in der folgenden Tabelle angegeben.

4. Umgang mit Ratenlimits

Wie überwacht man Ratenlimits?

Wenn Ihre API-Anfragen die zulässige Rate überschreiten, gibt die API Folgendes zurück:
  • HTTP-Statuscode: 429 Too Many Requests
  • Antworttext: Eine Meldung, die angibt, dass das Ratenlimit überschritten wurde.

Best Practices

Um das Auslösen von Ratenlimits zu vermeiden, können Sie:
  • Clientseitige Anfrage-Drosselung implementieren: Respektieren Sie die Ratenlimits der Plattform, indem Sie die Anfragerate Ihrer Anwendung steuern und sicherstellen, dass Sie nicht zu viele Aufrufe in kurzer Zeit senden.
  • Exponentielles Backoff bei Wiederholungsversuchen verwenden: Wenn Sie eine Ratenlimit-Antwort erhalten (z. B. HTTP 429), warten Sie zwischen Wiederholungsversuchen schrittweise länger, anstatt sofort erneut zu versuchen, wodurch die Last auf den Dienst reduziert wird.
  • Ihre API-Nutzung überwachen: Verfolgen und protokollieren Sie kontinuierlich Ihre Anfragezahlen, Häufigkeiten und alle Fehlerantworten, damit Sie Ihre Nutzungsmuster proaktiv anpassen können.

Wenn Sie Ratenlimits erreichen

Wenn Sie eine HTTP-429-Antwort (“Too Many Requests”) erhalten, können Sie:
  • Später erneut versuchen: Warten Sie einen kurzen Zeitraum, bevor Sie Ihre Anfrage erneut senden.
  • Ihre Anfragen optimieren: Reduzieren Sie die Häufigkeit der Aufrufe, um innerhalb der Ratenlimits der Plattform zu bleiben.
  • Ein höheres Ratenlimit anfordern: Wenn Sie ein höheres Ratenlimit benötigen, füllen Sie bitte das Kontaktformular unter Kontingente & Limits aus, um mit uns in Kontakt zu treten.
Zuletzt geändert am 10. August 2026