Wie ein Rate Limit Ihre Anfrage steuert
Ein Rate Limit begrenzt die Anzahl der Anfragen, die ein Client innerhalb eines Zeitfensters senden darf, und gibt einen 429-Fehler zurück, sobald diese Grenze überschritten wird. Das Limit verhindert, dass ein einzelner Client Kapazitäten beansprucht, die allen zustehen. Daher ist die korrekte Reaktion, die Geschwindigkeit zu drosseln, anstatt dieselbe Anfrage sofort erneut zu senden.
Sofortige Wiederholungsversuche sind genau das, was die meisten ersten Integrationen tun, und sie verwandeln eine vorübergehende Ablehnung in eine dauerhafte. Der Client stößt an das Limit, versucht es erneut, verlängert das Messfenster und wird am Ende viel länger gedrosselt, als der ursprüngliche Ansturm es erfordert hätte – meist während ein Entwickler die API für unzuverlässig hält. Bewusst ausgenommen ist Ihre eigene Limit-Konfiguration: Schwellenwerte pro Stufe, Burst-Kontingente und Endpunkte mit strengeren Limits gehören in die versionierte Dokumentation und nicht in ein Video, das veraltet.
Die Vorlage verfolgt eine Anfrage über acht Szenen hinweg: eine darüber, warum Limits überhaupt existieren, eine über das Zeitfenster und dessen Zählung, eine darüber, was eine 429-Antwort enthält, zwei über Backoff und warum die Verzögerung zunehmen muss, eine über Jitter und den Thundering Herd, eine über das Lesen der Rate-Limit-Header und eine über Designansätze, damit das Limit selten erreicht wird.

