速率限制如何決定您的請求能否執行
速率限制規定了客戶端在特定時間窗內可發送的請求數量,一旦超過上限,就會返回 429 錯誤。此限制旨在防止單一客戶端佔用所有共享資源,因此正確的回應是放慢速度,而非立即重複發送相同的請求。
大多數首次整合的客戶端都會立即重試,這將暫時的拒絕變成了持續性的問題。客戶端觸及限制後,立即重試,反而延長了測量時間窗,導致被節流的時間遠超最初的突發需求,開發者通常會因此認為 API 不可靠。我們刻意不包含您自己的限制配置:例如各層級的閾值、突發流量額度,以及限制更嚴格的端點,這些資訊應屬於版本化的文件,而非會過時的影片內容。
此範本透過八個場景追蹤一個請求:一個解釋為何存在限制,一個說明時間窗及其計算方式,一個介紹 429 回應的內容,兩個關於退避機制及為何延遲必須增加,一個關於抖動(jitter)和雷鳴般的羊群效應(thundering herd),一個關於如何讀取速率限制標頭,以及一個關於如何設計以避免觸及限制。

