429 avec des
headers qui te disent quand réessayer.
Ces limites sont des valeurs par défaut et sont susceptibles de changer. Si
ton intégration a besoin d’un plafond plus élevé, contacte
support@samsa.ai.
Rate de requêtes par clé
Chaque API key peut effectuer jusqu’à 60 requêtes par minute, mesurées comme une fenêtre glissante de 60 secondes. Dépasser cette limite renvoie429 avec
code: "rate_limited".
Les réponses réussies et les 429 de rate limit portent l’état actuel de la fenêtre
(le header Retry-After n’est ajouté que sur les 429) :
Lis
X-RateLimit-Remaining sur les réponses réussies pour ralentir avant
d’atteindre la limite.
Plafond de concurrence par organisation
Indépendamment du rate de requêtes, une organisation peut avoir au plus 5 jobs concurrents en cours — jobs de génération, d’édition, de vidéo et de création de modèles encorepending ou processing, comptés sur toutes les clés de
l’organisation. Soumettre un autre job alors qu’on est au plafond renvoie 429 avec
code: "too_many_active_jobs" et un header Retry-After :
429 Too Many Requests
GET, ou abonne-toi à un
webhook — avant d’en soumettre d’autres.
Un exemple de 429
Un429 de la fenêtre par clé inclut à la fois les headers Retry-After et
X-RateLimit-* :
Gérer les 429
1
Respecte Retry-After
Quand un
429 inclut un header Retry-After, attends au moins ce nombre de
secondes avant de réessayer. C’est le signal qui fait autorité.2
Ralentis de façon exponentielle
Pour des
429 répétés, augmente le délai entre les tentatives (par exemple
1s, 2s, 4s, 8s…), plafonné à un maximum raisonnable, avec un peu de jitter
aléatoire pour éviter les réessais en troupeau (thundering herd).3
Reste sous la limite de façon proactive
Surveille
X-RateLimit-Remaining et throttle côté client avant d’atteindre
0. Pour le plafond de concurrence, borne le nombre de jobs que tu gardes en
cours à la fois.Retry-After et retombe sur un
backoff exponentiel.

