Il rate limiting è un meccanismo di controllo che limita il numero di richieste che un client può inviare a un'API in un determinato intervallo di tempo, proteggendo così il server dagli abusi.
Cos'è il rate limiting?
Il rate limiting (o limitazione della frequenza) è un meccanismo di protezione implementato dalle API per controllare il numero di richieste che un client può effettuare in un determinato intervallo di tempo. Protegge l'infrastruttura dai sovraccarichi e garantisce un servizio equo per tutti gli utenti.
Come funziona?
Quando superi il limite consentito, l'API restituisce un codice HTTP 429 Too Many Requests. Gli header di risposta ti informano sul tuo consumo:
X-RateLimit-Limit: numero massimo di richieste per finestra temporaleX-RateLimit-Remaining: richieste rimanentiX-RateLimit-Reset: timestamp di reset
Strategie di gestione
- Backoff esponenziale: aumentare progressivamente l'intervallo tra i tentativi
- Cache: memorizzare le risposte localmente per evitare chiamate ridondanti
- Coda: mettere in coda le richieste e distanziarle nel tempo
Rate limiting in AILabsAudit
L'API REST di AILabsAudit consente 60 richieste al minuto per chiave API. Gli header di risposta includono sempre le informazioni sul rate limit, per permetterti di gestire il tuo consumo.
Ogni domanda posta a ChatGPT senza il tuo nome nella risposta è un competitor raccomandato al posto tuo — misurato su 6.820 risposte AI reali.