Главный вопрос по этой надписи не «что это», а «сколько ждать», и почти все статьи отвечают на него наугад. Между тем точное время присылает сам сервер в заголовке ответа, и я разобрал по документации, где его смотреть, когда его там не будет и почему ожидание до начала часа это миф.
Короткий ответ
Rate limit exceeded это ответ сервера с кодом 429: запросов или токенов за единицу времени оказалось больше разрешённого. Это не блокировка аккаунта, не поломка и обычно не ваша вина как программиста. Доступ вернётся сам.
Время ожидания сервер сообщает сам: в ответе приходит заголовок retry-after с числом секунд, и повторять раньше бессмысленно, такие попытки просто не проходят. Если этого заголовка в ответе нет, значит дело не в частоте: у Anthropic, например, при исчерпанном месячном потолке расходов приходит тот же тип ошибки, но без retry-after, и доступ возвращается только в начале следующего месяца по всемирному времени.
Главное в одну строку
Смотрите retry-after: есть он, значит ждать секунды или минуты; нет его, значит кончились не запросы, а деньги или квота.
Смысл
Код 429 в протоколе означает «слишком много запросов». Сервис ограничивает не общее количество работы, а её плотность во времени, и измеряется это обычно тремя вещами: запросами в минуту, входными токенами в минуту и исходящими токенами в минуту, причём отдельно для каждого класса моделей. В ответе сервис пишет, какой именно предел вы пробили.
Поэтому первая мысль «у меня кончилась подписка» почти всегда неверна. Подписка кончается другой ошибкой, доступ закрывается третьей, а 429 означает ровно одно: притормозите. Как устроены лимиты подписок у чатов и чем они отличаются от лимитов интерфейса, разобрано в гайде про лимиты нейросетей.
Главное
| Что видно в ответе | Что это значит | Сколько ждать |
|---|---|---|
| 429 и заголовок retry-after | Обычный предел частоты | Ровно столько секунд, сколько в заголовке |
| 429 без retry-after | Исчерпан денежный потолок аккаунта | До начала следующего месяца по всемирному времени или до повышения лимита |
| 429 с кодом про суточную квоту | Кончился дневной объём, а не частота | До сброса квоты или до её увеличения по запросу |
Эти три случая лечатся по-разному, и именно поэтому универсальный совет «подожди час и попробуй снова» работает только в первом. Во втором ожидание бесполезно, в третьем час может не помочь.
Где смотреть
Это самая полезная часть, и её почти никто не читает. Вместе с ошибкой приходят служебные заголовки, по которым видно и остаток, и время восстановления. Ниже набор из документации Anthropic, снятой 10 октября 2026 года, и он показателен для остальных сервисов.
| Заголовок | Что в нём |
|---|---|
| retry-after | Число секунд до повтора. Более ранние попытки не пройдут. Не присылается при упоре в денежный потолок |
| Предел запросов | Максимум запросов за период ограничения |
| Остаток запросов | Сколько запросов ещё можно сделать до ограничения |
| Время восстановления запросов | Момент, когда предел запросов пополнится полностью, в стандартном формате даты и времени |
| Пределы и остатки по токенам | То же самое отдельно для токенов, входных токенов и исходящих токенов, с округлением остатка до тысяч |
Что с этим делать, если вы не программист
Если вы работаете в чате или в редакторе кода, заголовков вы не увидите, их видит программа. Но вывод из них всё равно практичный: интерфейс обычно показывает время сброса сам, и именно ему стоит верить, а не советам из статей. Если время не показано, ориентир простой: при обычном лимите частоты пауза измеряется секундами и минутами, а не часами.
Механика
В документации Anthropic это сказано дословно: используется алгоритм текущего ведра, то есть ваш запас непрерывно пополняется до максимума, а не обнуляется через фиксированные интервалы. Представьте ведро с водой, из которого вы черпаете, и тонкую струйку, которая его всё время наполняет.
Отсюда и правильная стратегия повторов: не «ждать до круглого времени», а наращивать паузу и выравнивать темп. Это ровно то, что советуют в руководствах по устранению неполадок у разных вендоров.
Важный случай
Отдельный и самый коварный случай. По документации Anthropic при достижении потолка расходов вашего уровня использование интерфейса приостанавливается до начала следующего месяца по всемирному времени, если раньше не запросить повышение лимита. Пока пауза действует, запросы возвращают тот же код 429 и тот же тип ошибки, что и обычный лимит частоты.
Как отличить и почему это важно
Отличие одно: в этом ответе нет заголовка retry-after. И документация прямо предупреждает, что повторы, включая автоматические повторы официальных библиотек, будут падать, пока доступ не вернётся. То есть ваш код в этот момент может часами молотить повторы впустую, а в логах будет видна обычная ошибка лимита. Если 429 идёт подряд и без retry-after, проверяйте не частоту, а биллинг.
Полезная деталь из той же документации: в тексте такой ошибки сервис обычно сам пишет дату, когда доступ вернётся. Ещё одно место, где стоит читать сообщение целиком, а не только его начало.
Разница
В справочнике ошибок Gemini это разведено явно: при одном и том же статусе 429 текстовые коды разные. Один означает превышение лимита запросов или токенов в минуту, второй исчерпание суточной квоты, третий просто слишком много запросов за короткий промежуток. Рекомендации к ним тоже разные: первому и третьему пауза с экспоненциальной задержкой, второму дождаться сброса квоты или запросить увеличение.
| Тип предела | Горизонт | Что помогает |
|---|---|---|
| Частота | Секунды и минуты | Пауза, выравнивание темпа |
| Суточная квота | День | Ждать сброса, просить увеличение, уйти на другой уровень |
| Денежный потолок | Месяц | Повысить лимит расходов или ждать нового месяца |
| Предел одновременных запросов | Мгновение | Уменьшить параллельность, ставить задачи в очередь |
Последняя строка часто оказывается настоящей причиной при пакетной обработке. Для примера: в документации DeepSeek предел одновременных запросов указан как 2500 для младшей модели и 500 для старшей, и при разборе тысяч документов упираются именно в него, а не в минутные лимиты. Разбор этих моделей и их цен в гайде про DeepSeek V4.
Причины
Для разработчика
Официальные библиотеки часть этого делают сами: например питоновская библиотека Gemini повторяет временные ошибки до четырёх раз с начальной задержкой около секунды и максимальной в минуту. Но полагаться на это полностью нельзя: при упоре в денежный потолок автоматические повторы только жгут время.
Практика
Причина арифметическая. На одну вашу задачу агент делает десятки обращений: читает файлы, пробует, проверяет результат, исправляет. Чат делает одно обращение на сообщение. Поэтому в редакторе или консольном агенте лимит ловится в разы быстрее, особенно на бесплатных уровнях.
Подробный разбор экономии в гайде про экономию токенов, а про лимиты конкретных агентов в гайдах про лимиты Codex и лимиты ChatGPT.
Рамка
Эта надпись встречается далеко за пределами нейросетей: её показывают почтовые серверы, игры, маркетплейсы, соцсети и любые интерфейсы, потому что код 429 часть общего протокола. Механика везде одинаковая: сервер ограничивает частоту обращений и просит притормозить.
Что меняется: конкретные окна, числа и способ узнать время сброса задаёт тот сервис, который вам ответил. Поэтому искать стоит лимиты именно его интерфейса, а не общий ответ. Эта страница разбирает случай ИИ-сервисов, и если надпись пришла из игры или из почты, из неё вам полезны только два пункта: смотреть retry-after и не повторять запрос в цикле.
Памятка
Коротко
FAQ
Это ответ сервера с кодом 429: вы отправили больше запросов или токенов, чем разрешено за единицу времени. Переводится как «превышен предел частоты». Важно, что это не блокировка аккаунта и не поломка: доступ вернётся сам, вопрос только в том, когда именно. Ни подписка, ни пароль, ни ваш код тут обычно не виноваты.
Точный ответ даёт сам сервер, а не статья. В ответе с кодом 429 приходит заголовок retry-after с числом секунд, и это время ожидания: более ранние повторы просто не пройдут. У Anthropic рядом приходят ещё и заголовки с остатком запросов и токенов и со временем полного восстановления в стандартном формате даты. Если заголовка нет вовсе, причина другая, и про неё ниже.
Потому что у многих сервисов он не привязан к фиксированным интервалам. В документации Anthropic это сказано прямо: используется алгоритм текущего ведра, то есть ваш запас непрерывно пополняется до максимума, а не обнуляется по расписанию. Отсюда практичное следствие: ждать «до начала часа» бессмысленно, обычно достаточно паузы в секунды или минуты, и доступ возвращается постепенно.
Скорее всего это не частота, а исчерпанный денежный потолок. У Anthropic при достижении месячного предела расходов тип ошибки остаётся тем же, но заголовка retry-after в ответе нет, и доступ возобновляется только в начале следующего месяца по всемирному времени либо после повышения лимита. Повторы, включая автоматические повторы официальных библиотек, в этом случае бесполезны: они будут падать, пока доступ не вернут.
Экспоненциальной задержкой со случайным разбросом: подождать секунду, потом две, четыре, восемь, добавляя небольшое случайное смещение, чтобы все клиенты не ломились в одну секунду. Повторять стоит 429, 408 и любые 5xx. Не стоит повторять 400, 402 и 403: это неверный запрос, кончившиеся деньги и отсутствие прав. И обязательно ставьте предел числа попыток, иначе получается цикл, который сам себя душит.
Лимит частоты это сколько можно за минуту, квота это сколько можно за сутки или месяц. У Gemini они даже кодируются разными текстовыми кодами при одном и том же статусе 429: превышение частоты и превышение суточной квоты. Лечатся они по-разному: частота проходит после паузы, квота требует дождаться сброса или запросить увеличение.
Три частые причины. Первая: защита от резкого роста нагрузки, у Anthropic это названо ограничением ускорения, и чтобы не попадать под него, трафик наращивают плавно. Вторая: предел одновременных запросов, у DeepSeek, например, 2500 у младшей модели и 500 у старшей, и при пакетной обработке упираются именно в него. Третья: лимит считается не только на вас, а на весь аккаунт или рабочее пространство.
Главное правило: агент делает десятки запросов на одну задачу, потому что читает файлы, пробует и исправляет. Поэтому в редакторах и консольных агентах лимит ловится быстрее, чем в чате, особенно на бесплатных уровнях. Что помогает: держать запрос короче, пользоваться кэшем контекста, переносить тяжёлые пакетные задачи в асинхронный или пакетный режим, где он есть, и не запускать несколько агентов параллельно на одном ключе.
Надпись стандартная для всего интернета: её показывают почтовые сервисы, игры, маркетплейсы и соцсети, потому что код 429 часть протокола. Механика везде одна: сервер ограничивает частоту обращений. Но конкретные числа, окна и способы узнать время сброса задаёт тот сервис, который вам ответил, поэтому искать надо лимиты именно его интерфейса. Эта страница про ИИ-сервисы.
Нет, и это плохая идея по двум причинам. Первая: условия сервисов прямо запрещают обход ограничений и передачу доступа, и заканчивается это ограничением всех аккаунтов разом. Вторая: обычно проблема не в потолке, а в способе работы, и дешевле починить его: сократить контекст, включить кэш, перейти в пакетный режим или взять тариф с нужным объёмом.
Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.
Посмотреть, что внутриtelegram
Канал с полезными материалами про нейросети
Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.