1. Ratenlimits verstehen
Ratenbegrenzung bezeichnet die Regeln, die festlegen, wie häufig die API eines Benutzers innerhalb eines bestimmten Zeitfensters auf unsere Plattformdienste zugreifen darf. Ihre Ziele sind:- API-Missbrauch und Fehlverwendung verhindern: Durch das Festlegen einer Obergrenze für die Anfragehäufigkeit begrenzen wir ungewöhnlichen oder unbeabsichtigten Datenverkehr.
- Faire Ressourcenzuteilung sicherstellen: Wir verhindern, dass eine kleine Anzahl von Benutzern Systemressourcen monopolisiert, sodass alle gleichberechtigt auf den Dienst zugreifen können.
- API-Leistung und Zuverlässigkeit aufrechterhalten: Durch das Glätten von Lastspitzen stabilisieren wir die Antwortzeiten und reduzieren aus Überlastung resultierende Fehlerraten, wodurch die allgemeine Dienstqualität verbessert wird.
- Systemstabilität schützen: Ratenlimits helfen dabei, plötzliche Verkehrsspitzen abzufangen und zu verhindern, dass hohe Parallelitätsspitzen unsere Infrastruktur überlasten.
2. Metriken für Ratenlimits
Für unsere Bild- und Videomodelle verwenden wir zwei primäre Metriken zur Ratenbegrenzung:- IPM (Images Per Minute): Die Anzahl der Bilder, die ein Bildmodell pro Minute generieren darf.
- RPM (Requests Per Minute): Die Anzahl der API-Anfragen, die ein Videomodell pro Minute verarbeiten darf.
3. Standard-Ratenlimits
Für verschiedene Modelle wendet unsere Plattform differenzierte Strategien zur Ratenbegrenzung an, basierend auf dem Rechenressourcenverbrauch des jeweiligen Modells.IPM
Das IPM-Limit (Images Per Minute) steuert die Anzahl der Bilder, die pro Minute generiert werden können. Die Standard-IPM-Werte für jedes Modell sind in der folgenden Tabelle aufgeführt.RPM
Das RPM-Limit (Requests Per Minute) steuert die Anzahl der pro Minute zulässigen API-Anfragen. Die Standard-RPM-Werte für jedes Modell sind in der folgenden Tabelle angegeben.4. Umgang mit Ratenlimits
Wie überwacht man Ratenlimits?
Wenn Ihre API-Anfragen die zulässige Rate überschreiten, gibt die API Folgendes zurück:- HTTP-Statuscode: 429 Too Many Requests
- Antworttext: Eine Meldung, die angibt, dass das Ratenlimit überschritten wurde.
Best Practices
Um das Auslösen von Ratenlimits zu vermeiden, können Sie:- Clientseitige Anfrage-Drosselung implementieren: Respektieren Sie die Ratenlimits der Plattform, indem Sie die Anfragerate Ihrer Anwendung steuern und sicherstellen, dass Sie nicht zu viele Aufrufe in kurzer Zeit senden.
- Exponentielles Backoff bei Wiederholungsversuchen verwenden: Wenn Sie eine Ratenlimit-Antwort erhalten (z. B. HTTP 429), warten Sie zwischen Wiederholungsversuchen schrittweise länger, anstatt sofort erneut zu versuchen, wodurch die Last auf den Dienst reduziert wird.
- Ihre API-Nutzung überwachen: Verfolgen und protokollieren Sie kontinuierlich Ihre Anfragezahlen, Häufigkeiten und alle Fehlerantworten, damit Sie Ihre Nutzungsmuster proaktiv anpassen können.
Wenn Sie Ratenlimits erreichen
Wenn Sie eine HTTP-429-Antwort (“Too Many Requests”) erhalten, können Sie:- Später erneut versuchen: Warten Sie einen kurzen Zeitraum, bevor Sie Ihre Anfrage erneut senden.
- Ihre Anfragen optimieren: Reduzieren Sie die Häufigkeit der Aufrufe, um innerhalb der Ratenlimits der Plattform zu bleiben.
- Ein höheres Ratenlimit anfordern: Wenn Sie ein höheres Ratenlimit benötigen, füllen Sie bitte das Kontaktformular unter Kontingente & Limits aus, um mit uns in Kontakt zu treten.