Skip to main content
속도 제한은 모델 및 등급에 따라 다릅니다. 아래의 기본 제한은 유용한 참고 자료이지만, /api_keys/rate_limits API 엔드포인트가 현재 제한을 가져오는 표준 방법입니다. 언제든지 정확한 제한을 확인할 수 있습니다:

제한 보기

인터랙티브 플레이그라운드

속도 제한 로그

제한에 도달한 요청 확인

기본 제한

텍스트 및 임베딩 모델

텍스트 및 임베딩 모델은 네 가지 크기로 그룹화됩니다. 모델 페이지의 각 모델 카드에는 해당 크기 배지가 표시됩니다. 모든 임베딩 모델은 XS입니다.
일부 모델은 전용 인프라 또는 서드파티 인프라에서 실행되며, 이 네 가지 크기에 해당하지 않는 제한을 가집니다. 사용 중인 키에 대한 모델별 공식 제한은 GET /api_keys/rate_limits를 호출하세요.

이미지 및 오디오 모델

비디오 및 음악 모델

비디오 및 음악 생성에는 속도 제한이 적용되지 않습니다. 둘 다 크레딧 잔액에서 생성 건당 청구되므로, 요청 상한이 아니라 비용이 실질적인 제약입니다. 먼저 POST /video/quote 또는 POST /audio/quote로 작업 비용을 산정하세요.

오류 처리

실패한 요청(500, 503, 429)은 지수 백오프로 재시도해야 합니다. 특히 429 오류의 경우, 재시도할 수 있는 정확한 Unix 타임스탬프는 x-ratelimit-reset-requests 헤더를 확인하세요. 대부분의 HTTP 라이브러리는 이를 자동으로 처리하는 내장 재시도 메커니즘을 가지고 있습니다.

오류 버짓

벽에 부딪히면서도 계속 재시도하는 클라이언트로부터 API를 보호하기 위해 두 가지 추가 제한이 있습니다. 둘 다 롤링 30초 동안 API 키별, 모델별로 집계되며, 둘 다 429를 반환합니다: 두 번째 버짓은 모델이 지원하지 않는 기능을 요청하는 경우를 집계합니다. 예를 들어 해당 기능이 없는 모델에 비전이나 도구 호출을 요청하는 경우입니다. 두 버짓 중 하나라도 초과하면 속도 제한 로그FAILED_REQUESTS 또는 UNSUPPORTED_FEATURE_REQUESTS로 표시됩니다. 둘 다 초과된 임계값을 명시하는 customMessage를 반환합니다:
이러한 응답에는 아래의 윈도우별 헤더 대신 x-ratelimit-remainingx-ratelimit-resets가 설정됩니다.

응답 헤더

모든 응답에는 다음 헤더가 포함됩니다: /crypto/rpc/{network} 엔드포인트는 자체 제한과 자체 X-RateLimit-Limit, X-RateLimit-Remaining, X-RateLimit-Reset 헤더를 사용하며, 이 헤더들은 429 응답에서만 설정됩니다. 자세한 내용은 Crypto RPC를 참조하세요.

파트너 등급

파트너 제한은 위 표에서 기본 제한과 함께 나열되어 있습니다. 지속적으로 속도 제한에 도달하고 사용 패턴이 시간 경과에 따른 지속적인 수요를 보이는 경우, 파트너 액세스를 논의하기 위해 연락하세요: api@venice.ai. 파트너 등급 제한은 특정 요구 사항에 따라 조정할 수 있습니다.