Лимиты запросов
Общий token bucket, заголовки ответа и обработка 429.
Стандартный защитный порог публичного API — 1 000 запросов за 10 секунд на аккаунт (около 100 RPS постоянно). Это высокий предохранитель от злоупотреблений и неконтролируемых клиентов, а не низкая квота для обычного платного трафика. Дополнительные ключи его не увеличивают.
X-RateLimit-Limit: 20
X-RateLimit-Remaining: 7
Retry-After: 2Общий token bucket
Все эндпоинты /api/v1 расходуют один bucket open_api: емкость 1 000 и пополнение примерно 100 токенов в секунду. Для upload-url дополнительно действует отдельный высокий предохранитель 1 000 запросов за 10 секунд. Для usage действует гораздо более строгий отдельный предел — 30 запросов в минуту; когда решение о лимите недоступно, он ничего не пропускает и возвращает 429.
Заголовки ответа
Следите за X-RateLimit-Limit и X-RateLimit-Remaining. При HTTP 429 ждите число секунд из Retry-After. Запросы сверх лимита отклоняются сразу и не ставятся в очередь.
Это не лимит параллельности
Лимит регулирует частоту API-вызовов, а не число выполняющихся задач. Баланс, предел расходов и текущая доступность модели обозначаются отдельно кодами 40201, 40202 и 50301. Webhook помогает не расходовать bucket на опрос.
Полные определения полей приведены в контракте OpenAPI 3.1.

