Rate-Limits nach Endpunkt
Endpunkte mit expliziten Pro-Minute-Limits ueberschreiben den globalen Standard. Die meisten Lese-Endpunkte (Kanaele, Credits, Posts, Jobs) fallen unter das globale 30/Stunde-Limit. KI-Generierungsendpunkte haben eigene hoeherfrequente Limits.
MCP-Server-Rate-Limits
Rate-Limit-Header
Wenn Sie sich einem Rate-Limit naehern oder es ueberschreiten, gibt die API Standard-Rate-Limit-Header zurueck:Limit ueberschritten
Wenn Sie das Rate-Limit ueberschreiten, gibt die API zurueck:X-RateLimit-Reset-Header), und wiederholen Sie dann Ihre Anfrage.
Best Practices
- KI-Generierungsanfragen verteilen — begrenzen Sie diese auf 10 pro Minute fuer Bild-/Videogenerierung
- Modelllisten cachen — die verfuegbaren Modelle aendern sich nicht haeufig, cachen Sie daher Antworten von
/image-modelsund/video-models - Job-Status vernuenftig abfragen — alle 5-10 Sekunden pruefen, nicht jede Sekunde
- Batch-Operationen verwenden — bei der Generierung mehrerer Bilder verwenden Sie
generate-mediamitquantity: 2-4anstelle mehrerergenerate-image-Aufrufe - 429-Fehler elegant behandeln — implementieren Sie exponentielles Backoff bei Rate-Limiting