Лимиты · механика и выходы

Лимиты нейросетей: почему кончаются и что делать дальше

Ограничения есть у всех: и у бесплатных тарифов, и у подписки за 200 долларов. Разбираем на пальцах, как считается лимит, почему он кончается быстрее, чем кажется, и какие выходы работают по-честному.

Кирилл СандаковКирилл СандаковВайбкодер, предприниматель, продюсерОпубликовано 08.09.202611 мин чтения

Лимит в нейросети считается не в сообщениях, а в объёме работы за скользящее окно: у ChatGPT и Claude это пять часов, а на платных планах сверху лежит ещё недельный потолок. Поэтому одно и то же «привет» в начале и в конце длинного чата стоит по-разному. Когда доступ закончился, работают пять честных выходов: подождать сброса, взять модель полегче, начать новый чат, увести часть задач в другой сервис или перейти на оплату по токенам. Безлимита в облаке не бывает ни на одном тарифе.

Что узнаешь из гайда

  • Как устроено скользящее окно и почему лимит «дышит»
  • Что дают тарифы ChatGPT, Claude и Gemini на сентябрь 2026
  • Порядок действий, когда написали «лимит исчерпан»
  • Когда подписку выгоднее заменить оплатой по токенам
  • Почему «нейросеть без лимитов» почти всегда обман

Часть 1 · Механика

Как устроен лимит нейросети

Главное

Лимит меряется не количеством сообщений, а объёмом работы за скользящее окно. Отсчёт идёт от ваших запросов, а не от полуночи, поэтому доступ возвращается не разом, а по кусочкам.

В документации это записано прямым текстом. У Anthropic: лимиты каждого плана сбрасываются в скользящем пятичасовом окне сессии, а платные планы получают сверху недельный потолок. У OpenAI: оценки показывают число сообщений за пятичасовой период, и «недельные лимиты тоже могут действовать». Формулировки разные, механика одна.

Второе, что стоит понять сразу: пул общий. У Anthropic отдельно оговорено, что работа в вебе, на десктопе, на телефоне и в Claude Code тянет из одного и того же объёма. То же у OpenAI: локальные сообщения и облачные чаты делят один бюджет плана. Поэтому ощущение «я почти ничего не спросил, а лимит кончился» обычно означает, что основной расход ушёл в другое окно и другое устройство.

Почему одинаковые сообщения стоят по-разному

Модель не помнит разговор, она каждый раз перечитывает его заново. На двадцатом сообщении она заново читает все девятнадцать предыдущих, ваши файлы и результаты поиска. Отсюда правило, которое экономит нервы: расход зависит не от длины вашего вопроса, а от размера всего, что уже накопилось в чате. Подробный разбор этой механики есть в гайде что такое токены в нейросети.

Третий множитель это тяжесть задачи. Картинки, файлы, поиск по вебу и режимы рассуждения расходуют окно быстрее обычного текста. У OpenAI есть конкретная цифра: генерация изображений съедает включённый лимит в среднем в 3-5 раз быстрее, чем ход без картинок, и на бесплатном плане её просто нет.


Часть 2 · Тарифы

Лимиты у ChatGPT, Claude и Gemini

Точных чисел сообщений почти никто не публикует, и это не жадность, а честность: расход зависит от модели и объёма контекста. Зато публикуют множители и цены. Данные сняты с официальных страниц тарифов 8 сентября 2026 года, все планы платные, кроме строки Free.

СервисБесплатноСредний планСтарший план
ChatGPTFree, 0 долларовGo 8, Plus 20 долларов в месяцPro от 100 долларов, ступени 5x и 20x
ClaudeFree, 0 долларовPro 17 долларов при годовой оплате, 20 помесячноMax от 100 долларов, 5x или 20x к Pro
GeminiFree, 0 долларовAI Plus 4,99 и AI Pro 19,99 доллараAI Ultra 99,99 и 199,99 доллара

Что за этими цифрами стоит на практике. У Claude бесплатный план даёт средние модели (Sonnet и Haiku) и контекст 200 тысяч токенов, но не даёт ни старшую модель Opus, ни Claude Code. Pro описан как минимум впятеро больший объём за ту же пятичасовую сессию, Max ещё в 5 или 20 раз больше Pro.

У Google множители заявлены прямо на странице подписок: AI Plus это 2x доступа к Gemini относительно бесплатного, AI Pro 4x, AI Ultra до 20x к Pro. Бесплатный тариф Gemini при этом заметно щедрее конкурентов по набору: там есть и генерация картинок, и Deep Research, и голосовой режим, просто с меньшим объёмом.

У OpenAI единственные опубликованные числа это оценки сообщений за пять часов на платных планах, и они даны вилкой. Для Plus: от 10 до 100 сообщений на средней модели и от 250 до 2000 на самой лёгкой. Разброс в десять раз внутри одного плана как раз и показывает, что решает не тариф, а то, чем вы его нагружаете. Детальный разбор лимитов терминального агента OpenAI лежит в отдельном гайде лимиты Codex, а лимиты Claude и приёмы экономии в разборе про токены Claude.


Часть 3 · Инструкция

Упёрся в лимит: порядок действий

Порядок именно такой: сверху дешёвые и мгновенные шаги, снизу те, что стоят денег. Первые три пункта закрывают большинство ситуаций за минуту.

  1. Посмотрите остаток и время сброса. У Claude это Settings, дальше Usage. У ChatGPT и Codex панель использования, а в терминале команда /status. Часто выясняется, что ждать не день, а сорок минут.
  2. Поймите, какое окно закрылось. Пятичасовое откроется частями уже сегодня. Недельный потолок (он есть только на платных планах) означает паузу подольше, и тут ожидание уже не стратегия.
  3. Переключитесь на модель полегче. Самый быстрый легальный ход: у OpenAI это рекомендация номер один при подходе к лимиту.
  4. Начните новый чат. Если тема сменилась, длинная ветка просто дорого тащит за собой всю историю.
  5. Уведите часть задач в другой сервис. Лимиты у сервисов независимые, и черновики спокойно живут в бесплатном аккаунте соседа.
  6. Докупите объём, если это разрешено планом. У OpenAI пользователи Plus и Pro могут купить дополнительные кредиты без перехода на другой тариф, у Anthropic на платных планах включается расход по ставкам API поверх лимита.
  7. Перейдите на оплату по токенам. Если потолок встречается ежедневно, подписка вам мала и считать надо иначе.

Что происходит с начатой задачей

Хорошая новость для тех, кого лимит застал на середине: у OpenAI записано, что при достижении лимита во время активного хода агент доведёт текущую задачу до конца в рамках честного использования. Дописать ответ система обычно даёт, а вот следующий запрос уже не уйдёт.


Способ 1

Модель полегче: тот же тариф, больше работы

Внутри одной подписки модели стоят по-разному, и разница огромная. У OpenAI на плане Plus за одно пятичасовое окно выходит 5-45 сообщений на самой тяжёлой модели и 250-2000 на самой лёгкой. Это не разные тарифы, это один и тот же тариф с переключателем модели.

Правило простое: тяжёлую модель берут туда, где нужна голова, а не скорость. Разбор договора, архитектура, сложный код, спорная аналитика. Всё остальное (пересказ, перевод, вычитка, форматирование, черновик письма, идеи заголовков) лёгкая модель делает не хуже, а окно тратит в разы медленнее.

Как это выглядит в жизни

Утро на лёгкой модели: почта, пересказы, черновики. Час на тяжёлой в середине дня, когда реально нужна сложная задача. К вечеру лимит цел, хотя работы сделано больше, чем при попытке делать всё на самой дорогой модели.


Способ 2

Разнести работу по сервисам

Лимиты не общие: у ChatGPT свой, у Claude свой, у Gemini свой. Если платная подписка одна, логично беречь её под то, что она делает лучше всех, а рутину отдавать бесплатным аккаунтам. Это законно, ничего не нарушает и не требует ни VPN, ни ухищрений.

  • Быстрые вопросы и поиск фактов: бесплатный Gemini или DeepSeek, они не трогают вашу подписку вообще.
  • Русскоязычная рутина без VPN: GigaChat и Алиса с YandexGPT, работают из России и бесплатны в базовом режиме.
  • Тексты и длинные документы: Claude, у него на бесплатном плане контекст 200 тысяч токенов.
  • Сложная работа и код: та подписка, за которую вы платите. Её лимит должен уходить только сюда.

Полный разбор, кто из бесплатных на что годится и что открывается из России без ухищрений, лежит в гайде бесплатные нейросети, а сравнение сервисов по задачам в обзоре нейросетей 2026.


Способ 3

Резать контекст, а не количество сообщений

Многие пытаются экономить, задавая меньше вопросов. Работает плохо, потому что дорого не число сообщений, а масса того, что модель перечитывает. OpenAI прямо публикует список приёмов, которые растягивают лимит, и он почти весь про контекст.

  • Держите промпт коротким и точным. Инструкция конкретная, лишнее убрано.
  • Давайте только нужные материалы. Один нужный файл вместо папки, конкретный фрагмент вместо всего отчёта.
  • Задавайте формат и объём ответа. «Пять пунктов, без вступления» дешевле, чем открытый вопрос: выход тарифицируется дороже входа.
  • Отключайте лишние инструменты. Каждый подключённый коннектор добавляет контекст в каждое сообщение.
  • Начинайте новый чат при смене темы. Самый дешёвый способ сбросить накопившуюся историю.

Длинный документ не надо кормить целиком

Если задача по большому файлу, дешевле сначала попросить краткую выжимку по нужному разделу, а дальше работать с ней. Иначе документ будет перечитываться заново на каждом вашем сообщении, и лимит кончится на середине обсуждения.


Способ 4

Оплата по токенам вместо подписки

У подписки потолок сообщений, у ключа API потолка нет: там вы платите за фактический расход и упираетесь только в собственный кошелёк. OpenAI сама предлагает этот выход при исчерпании лимита, у Anthropic он называется usage credits и включается на платных планах.

Когда это выгодно. Если нейросеть нужна волнами (неделя плотной работы, три недели тишины), оплата по факту почти всегда дешевле подписки. Если вы сидите в чате каждый день по несколько часов, подписка выгоднее, и именно поэтому она существует. Считать нужно по своей нагрузке за месяц, а не по чужим отзывам. Как завести ключ и что с ним делать, разобрано в гайде как получить API-ключ Claude.

Оплата из России

И подписка, и пополнение баланса API у зарубежных сервисов требуют иностранной карты, российские не проходят. Способы, которые реально работают, разобраны в гайде как оплатить ChatGPT из России; из платёжных посредников мы пользуемся Платипомиру. Это платный сервис, комиссию он берёт сверху.


Способ 5

Локальная модель: единственный честный безлимит

Модель, запущенная на своём компьютере, не считает ни сообщения, ни токены и не спрашивает карту. Ставится это одной программой, чаще всего через Ollama, работает без интернета, и переписка не уходит наружу вообще. Для рутины (пересказ, черновик, вычитка, разбор своих заметок) этого достаточно.

Честная цена вопроса такая. Лимит меняется на требования к железу: лёгкие модели живут на обычном ноутбуке, средние просят много оперативной памяти, тяжёлые нормально работают только на видеокарте. И качество ниже топовых облачных моделей: локальная семёрка не заменит старшую модель на сложной задаче. Зато она не кончается никогда.

Есть и промежуточный вариант: открытые каталоги моделей. На OpenRouter, например, на 8 сентября 2026 года в каталоге 429 моделей, и у 19 из них нулевая цена и на входе, и на выходе. Лимиты там свои и меняются, но как запасной аэродром на вечер, когда основная подписка закончилась, это рабочий вариант.


Часть 4 · Осторожно

Что не работает и чем это опасно

Вокруг запроса «обойти лимит» крутится много предложений, которые заканчиваются потерей аккаунта или денег. Коротко, чего делать не стоит.

Красные флаги

  • «Аккаунт Plus за 200 рублей». Это либо чужой аккаунт, который заберут, либо перепродажа ключа API, где ваша переписка видна продавцу.
  • Общий аккаунт на несколько человек. Лимит не растёт, а делится, а вход с разных устройств и стран приводит к блокировке.
  • Регистрация пачки аккаунтов на один номер. Отлавливается автоматически, а вместе с клонами обычно улетает и основной аккаунт.
  • Сайты-обёртки «ChatGPT без лимитов и регистрации». Часто под капотом лёгкая старая модель, а вводить туда рабочие документы просто нельзя.

Ещё одна мысль, которая экономит время: если аккаунт уже заблокировали или сервис перестал открываться, это отдельная проблема, а не лимит. Что делать в таком случае, разобрано в гайдах ChatGPT не работает и блокировка аккаунта Claude.

Коротко

  • Лимит считается объёмом работы за скользящее пятичасовое окно, а не числом сообщений.
  • На платных планах сверху лежит недельный потолок.
  • Веб, приложение и терминал тянут из одного общего пула.
  • Модель полегче внутри той же подписки растягивает окно в разы.
  • Новый чат при смене темы сбрасывает накопленный контекст.
  • Лимиты сервисов независимы, рутину можно увести в бесплатный аккаунт.
  • Ключ API снимает потолок сообщений, но включает счётчик денег.
  • Настоящий безлимит существует только у локальной модели.

FAQ

Частые вопросы

Почему в нейросети быстро заканчиваются лимиты

Потому что лимит считается не в сообщениях, а в объёме работы. Каждый раз модель перечитывает весь диалог целиком, поэтому к концу длинной ветки одно и то же сообщение стоит в разы дороже, чем в начале. Плюс тяжёлые модели расходуют окно быстрее лёгких, а картинки и файлы жгут его ещё быстрее: у OpenAI записано, что генерация изображений съедает включённый лимит в среднем в 3-5 раз быстрее обычного хода.

Как обойти лимит ChatGPT

Легально обойти можно только четырьмя способами: дождаться сброса окна, переключиться на модель полегче, докупить кредиты (на планах Plus и Pro это разрешено официально) или запускать запросы по ключу API, где оплата идёт за токены. Сервисы, которые обещают ChatGPT «без лимитов» за копейки, обычно перепродают чужой ключ API: это нарушение правил, риск потерять аккаунт и слить переписку третьей стороне.

Через сколько сбрасывается лимит

У ChatGPT и Claude основное окно скользящее и длится пять часов. Скользящее означает, что отсчёт идёт от ваших запросов, а не от полуночи, поэтому доступ возвращается постепенно: старые сообщения выпадают из окна и место освобождается. На платных планах сверху действует недельный потолок, у Claude он прописан в документации прямым текстом, у OpenAI формулировкой «weekly limits may also apply».

Есть ли нейросети без лимитов

В облаке нет: даже самые дорогие планы описывают лимит как «в 20 раз больше», а не «безлимит». Единственный вариант без потолка сообщений это модель на своём компьютере (Ollama и подобные) или оплата по токенам через API, где вы платите за фактический расход. У локального запуска цена другая: нужны железо и оперативная память, а качество заметно ниже топовых облачных моделей.

Что даёт платная подписка по сравнению с бесплатной

Больший объём в том же пятичасовом окне и доступ к старшим моделям. У Claude в документации записано, что Pro даёт минимум в 5 раз больше использования за сессию, чем Free, а Max ещё в 5 или 20 раз больше, чем Pro. У Google оплаченные планы описаны как 2x, 4x и до 20x доступа к Gemini относительно бесплатного. Бесплатный тариф при этом обычно ещё и лишён тяжёлых моделей и части функций.

Помогает ли новый чат сэкономить лимит

Да, и это самый недооценённый приём. В одном чате модель каждый раз перечитывает всю историю, и расход растёт от сообщения к сообщению. Если тема сменилась, начатый заново чат сбрасывает этот груз до нуля. Обратная сторона: контекст придётся дать заново, поэтому длинную ветку имеет смысл дорабатывать, а новую тему всегда начинать с чистого листа.

Можно ли одним аккаунтом пользоваться вдвоём, чтобы хватало лимитов

Нет, и это плохая идея по трём причинам. Общий аккаунт не увеличивает лимит, а делит его пополам, потому что пул один. Одновременная работа с разных устройств и стран выглядит как взлом и приводит к блокировке. И вся переписка второго человека видна первому. Для двоих дешевле два бесплатных аккаунта на разных сервисах, чем один платный на двоих.

Что делать, если лимит кончается каждый день

Считать, а не терпеть. Если вы регулярно упираетесь в потолок, подписка вам уже мала и есть два выхода: поднять план или перейти на оплату по токенам через ключ API, где нет потолка сообщений, а счёт идёт за фактический расход. Второй путь часто дешевле для нерегулярной работы и дороже для ежедневной, поэтому решение принимается по вашей реальной нагрузке за месяц.


Читать дальше

ИИ-офис
Собери свой ИИ-офис и перестань делать руками то, что делает нейросеть

Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.

Посмотреть, что внутри

telegram

Канал с полезными материалами про нейросети

Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.

Перейти в канал
Кирилл Сандаков

Об авторе

Кирилл Сандаков

Вайбкодер, предприниматель, продюсер

Завайбкодил контент-ферму на США в Instagram (более 300 тыс. подписчиков, среди читателей Дональд Трамп Младший), создатель платформы и сообщества ИИ-офис, автор блога о нейросетях «Выжимаем из ИИ Максимум».

Все статьи автора