[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"glossary-concurrency-limit::ru":3,"gloss-cluster-concurrency-limit::ru":20,"gloss-next-concurrency-limit::ru":9},{"slug":4,"category":5,"name":6,"definition":7,"meta_desc":8,"faq":9,"schema_markup":9,"related":10},"concurrency-limit","integration","Лимит параллельных запросов","Лимит параллельных запросов ограничивает, сколько запросов аккаунт может держать в работе одновременно, — в отличие от лимита частоты, который ограничивает, сколько запросов можно начать за отрезок времени. Их постоянно путают, хотя ограничивают они совершенно разные вещи. Лимит в шестьдесят запросов в минуту легко соблюсти одним запросом в секунду; лимит конкурентности, равный пяти, означает, что сколько бы вы ни ждали между партиями, в любой момент открыто может быть только пять запросов. Для ИИ-нагрузок значение имеет именно конкурентность, потому что запросы к моделям медленные. Обычный API-вызов возвращается за десятки миллисекунд, поэтому даже скромный запас параллельности обеспечивает высокую пропускную способность. Модель, генерирующая длинный ответ, может удерживать соединение много секунд — и тогда низкий потолок конкурентности напрямую задаёт вашу максимальную пропускную способность, как бы щедро ни выглядела поминутная квота. Задача обработки десяти тысяч документов ограничена сочетанием конкурентности и задержки, а поминутный лимит частоты к длительности этой работы часто не имеет отношения. Перед тем как строить решение на инструменте, выясните три вещи. Каков реальный лимит конкурентности на вашем тарифе: он документируется куда менее последовательно, чем лимиты частоты, и иногда обнаруживается только при столкновении с ним. Что происходит при превышении: поставленный в очередь запрос, который в итоге выполнится, — это совсем не то же самое, что мгновенная ошибка, которую ваш код обязан поймать и повторить с экспоненциальной паузой. И на что назначен лимит — на ключ, на аккаунт или на модель: в зависимости от вендора распределение работы по нескольким ключам будет либо законным способом масштабирования, либо нарушением условий использования. Проектируйте пакетную обработку под измеренный, а не предполагаемый потолок конкурентности, а его повышение считайте полноценным коммерческим условием для переговоров.","Лимит конкурентности ограничивает число одновременно выполняемых запросов — на ИИ-нагрузках он упирается раньше, чем лимит запросов в минуту.",null,[11,14,17],{"slug":12,"name":13},"exponential-backoff","Стратегия ограничения частоты запросов к API (Backoff)",{"slug":15,"name":16},"rate-limit","Ограничение частоты запросов (Rate Limit)",{"slug":18,"name":19},"throughput","Пропускная способность (Throughput)",[21,25,28,31,34,38,41,44,47,50,53,56],{"slug":22,"category":5,"name":23,"updated_at":24},"backend-for-frontend","Backend for Frontend (BFF)","2026-08-24T02:46:38+00:00",{"slug":26,"category":5,"name":27,"updated_at":24},"event-ordering","Порядок событий",{"slug":29,"category":5,"name":30,"updated_at":24},"field-mapping","Сопоставление полей (field mapping)",{"slug":32,"category":5,"name":33,"updated_at":24},"function-schema","Схема функции",{"slug":35,"category":5,"name":36,"updated_at":37},"grpc","gRPC","2026-08-24T02:46:37+00:00",{"slug":39,"category":5,"name":40,"updated_at":24},"integration-marketplace","Каталог интеграций (integration marketplace)",{"slug":42,"category":5,"name":43,"updated_at":24},"ip-allowlist","IP-allowlist (список разрешённых адресов)",{"slug":45,"category":5,"name":46,"updated_at":24},"json-web-token","JSON Web Token (JWT)",{"slug":48,"category":5,"name":49,"updated_at":24},"mcp-server","MCP-сервер",{"slug":51,"category":5,"name":52,"updated_at":24},"mutual-tls","Взаимный TLS (mTLS)",{"slug":54,"category":5,"name":55,"updated_at":24},"oauth-scopes","OAuth-скоупы",{"slug":57,"category":5,"name":58,"updated_at":24},"openapi-specification","OpenAPI Specification"]