요청 제한(rate limiting)은 클라이언트가 일정 시간 동안 API에 보낼 수 있는 요청 수를 제한하는 제어 메커니즘으로, 서버를 남용으로부터 보호합니다.
요청 제한이란 무엇입니까?
요청 제한(rate limiting)은 클라이언트가 정해진 시간 내에 수행할 수 있는 요청 수를 제어하기 위해 API에 구현되는 보호 메커니즘입니다. 이는 인프라를 과부하로부터 보호하고 모든 사용자에게 공정한 서비스를 보장합니다.
어떻게 작동합니까?
허용된 한도를 초과하면 API는 429 Too Many Requests HTTP 코드를 반환합니다. 응답 헤더는 사용량에 대한 정보를 제공합니다.
X-RateLimit-Limit: 시간 창(window)당 최대 요청 수X-RateLimit-Remaining: 남은 요청 수X-RateLimit-Reset: 초기화 시각(타임스탬프)
관리 전략
- 지수 백오프(Exponential backoff): 재시도 간격을 점진적으로 늘립니다
- 캐시: 중복 호출을 피하기 위해 응답을 로컬에 저장합니다
- 대기열: 요청을 대기열에 넣고 시간 간격을 두어 처리합니다
AILabsAudit의 요청 제한
AILabsAudit의 REST API는 API 키당 분당 60건의 요청을 허용합니다. 응답 헤더에는 사용자가 사용량을 관리할 수 있도록 항상 요청 제한 정보가 포함되어 있습니다.
AI 답변에서 브랜드는 6번 중 1번만 나타납니다. 귀사는 나타납니까?
답변에 귀사의 이름이 없는 ChatGPT에 대한 모든 질문은 귀사 대신 추천되는 경쟁사입니다 — 6,820개의 실제 AI 답변에서 측정되었습니다.