Cómo un Límite de Tasa Determina si tu Solicitud se Ejecuta
Un límite de tasa establece un tope en la cantidad de solicitudes que un cliente puede enviar en una ventana y devuelve un 429 una vez que se supera ese tope. El límite existe para evitar que un cliente consuma la capacidad que pertenece a todos, por lo que la respuesta correcta es reducir la velocidad en lugar de enviar la misma solicitud de nuevo de inmediato.
Reintentar de inmediato es exactamente lo que hacen la mayoría de las primeras integraciones, y esto convierte un rechazo temporal en uno sostenido. El cliente alcanza el límite, reintenta, extiende la ventana de medición y termina siendo ralentizado por mucho más tiempo de lo que la ráfaga original requería, generalmente mientras un desarrollador concluye que la API no es confiable. Se excluye a propósito la configuración de tu propio límite: los umbrales por nivel, las asignaciones de ráfaga y los puntos finales con límites más estrictos pertenecen a la documentación versionada en lugar de a un video que envejece.
La plantilla sigue una solicitud a través de ocho escenas: una sobre por qué existen los límites, una sobre la ventana y cómo se cuenta, una sobre lo que contiene una respuesta 429, dos sobre el 'backoff' y por qué el retraso debe aumentar, una sobre el 'jitter' y el 'thundering herd', una sobre la lectura de los encabezados de límite de tasa, y una sobre cómo diseñar para que el límite rara vez se alcance.

