Ограничения есть у всех: и у бесплатных тарифов, и у подписки за 200 долларов. Разбираем на пальцах, как считается лимит, почему он кончается быстрее, чем кажется, и какие выходы работают по-честному.
Лимит в нейросети считается не в сообщениях, а в объёме работы за скользящее окно: у ChatGPT и Claude это пять часов, а на платных планах сверху лежит ещё недельный потолок. Поэтому одно и то же «привет» в начале и в конце длинного чата стоит по-разному. Когда доступ закончился, работают пять честных выходов: подождать сброса, взять модель полегче, начать новый чат, увести часть задач в другой сервис или перейти на оплату по токенам. Безлимита в облаке не бывает ни на одном тарифе.
Что узнаешь из гайда
Часть 1 · Механика
Главное
Лимит меряется не количеством сообщений, а объёмом работы за скользящее окно. Отсчёт идёт от ваших запросов, а не от полуночи, поэтому доступ возвращается не разом, а по кусочкам.
В документации это записано прямым текстом. У Anthropic: лимиты каждого плана сбрасываются в скользящем пятичасовом окне сессии, а платные планы получают сверху недельный потолок. У OpenAI: оценки показывают число сообщений за пятичасовой период, и «недельные лимиты тоже могут действовать». Формулировки разные, механика одна.
Второе, что стоит понять сразу: пул общий. У Anthropic отдельно оговорено, что работа в вебе, на десктопе, на телефоне и в Claude Code тянет из одного и того же объёма. То же у OpenAI: локальные сообщения и облачные чаты делят один бюджет плана. Поэтому ощущение «я почти ничего не спросил, а лимит кончился» обычно означает, что основной расход ушёл в другое окно и другое устройство.
Почему одинаковые сообщения стоят по-разному
Модель не помнит разговор, она каждый раз перечитывает его заново. На двадцатом сообщении она заново читает все девятнадцать предыдущих, ваши файлы и результаты поиска. Отсюда правило, которое экономит нервы: расход зависит не от длины вашего вопроса, а от размера всего, что уже накопилось в чате. Подробный разбор этой механики есть в гайде что такое токены в нейросети.
Третий множитель это тяжесть задачи. Картинки, файлы, поиск по вебу и режимы рассуждения расходуют окно быстрее обычного текста. У OpenAI есть конкретная цифра: генерация изображений съедает включённый лимит в среднем в 3-5 раз быстрее, чем ход без картинок, и на бесплатном плане её просто нет.
Часть 2 · Тарифы
Точных чисел сообщений почти никто не публикует, и это не жадность, а честность: расход зависит от модели и объёма контекста. Зато публикуют множители и цены. Данные сняты с официальных страниц тарифов 8 сентября 2026 года, все планы платные, кроме строки Free.
| Сервис | Бесплатно | Средний план | Старший план |
|---|---|---|---|
| ChatGPT | Free, 0 долларов | Go 8, Plus 20 долларов в месяц | Pro от 100 долларов, ступени 5x и 20x |
| Claude | Free, 0 долларов | Pro 17 долларов при годовой оплате, 20 помесячно | Max от 100 долларов, 5x или 20x к Pro |
| Gemini | Free, 0 долларов | AI Plus 4,99 и AI Pro 19,99 доллара | AI Ultra 99,99 и 199,99 доллара |
Что за этими цифрами стоит на практике. У Claude бесплатный план даёт средние модели (Sonnet и Haiku) и контекст 200 тысяч токенов, но не даёт ни старшую модель Opus, ни Claude Code. Pro описан как минимум впятеро больший объём за ту же пятичасовую сессию, Max ещё в 5 или 20 раз больше Pro.
У Google множители заявлены прямо на странице подписок: AI Plus это 2x доступа к Gemini относительно бесплатного, AI Pro 4x, AI Ultra до 20x к Pro. Бесплатный тариф Gemini при этом заметно щедрее конкурентов по набору: там есть и генерация картинок, и Deep Research, и голосовой режим, просто с меньшим объёмом.
У OpenAI единственные опубликованные числа это оценки сообщений за пять часов на платных планах, и они даны вилкой. Для Plus: от 10 до 100 сообщений на средней модели и от 250 до 2000 на самой лёгкой. Разброс в десять раз внутри одного плана как раз и показывает, что решает не тариф, а то, чем вы его нагружаете. Детальный разбор лимитов терминального агента OpenAI лежит в отдельном гайде лимиты Codex, а лимиты Claude и приёмы экономии в разборе про токены Claude.
Часть 3 · Инструкция
Порядок именно такой: сверху дешёвые и мгновенные шаги, снизу те, что стоят денег. Первые три пункта закрывают большинство ситуаций за минуту.
/status. Часто выясняется, что ждать не день, а сорок минут.Что происходит с начатой задачей
Хорошая новость для тех, кого лимит застал на середине: у OpenAI записано, что при достижении лимита во время активного хода агент доведёт текущую задачу до конца в рамках честного использования. Дописать ответ система обычно даёт, а вот следующий запрос уже не уйдёт.
Способ 1
Внутри одной подписки модели стоят по-разному, и разница огромная. У OpenAI на плане Plus за одно пятичасовое окно выходит 5-45 сообщений на самой тяжёлой модели и 250-2000 на самой лёгкой. Это не разные тарифы, это один и тот же тариф с переключателем модели.
Правило простое: тяжёлую модель берут туда, где нужна голова, а не скорость. Разбор договора, архитектура, сложный код, спорная аналитика. Всё остальное (пересказ, перевод, вычитка, форматирование, черновик письма, идеи заголовков) лёгкая модель делает не хуже, а окно тратит в разы медленнее.
Как это выглядит в жизни
Утро на лёгкой модели: почта, пересказы, черновики. Час на тяжёлой в середине дня, когда реально нужна сложная задача. К вечеру лимит цел, хотя работы сделано больше, чем при попытке делать всё на самой дорогой модели.
Способ 2
Лимиты не общие: у ChatGPT свой, у Claude свой, у Gemini свой. Если платная подписка одна, логично беречь её под то, что она делает лучше всех, а рутину отдавать бесплатным аккаунтам. Это законно, ничего не нарушает и не требует ни VPN, ни ухищрений.
Полный разбор, кто из бесплатных на что годится и что открывается из России без ухищрений, лежит в гайде бесплатные нейросети, а сравнение сервисов по задачам в обзоре нейросетей 2026.
Способ 3
Многие пытаются экономить, задавая меньше вопросов. Работает плохо, потому что дорого не число сообщений, а масса того, что модель перечитывает. OpenAI прямо публикует список приёмов, которые растягивают лимит, и он почти весь про контекст.
Длинный документ не надо кормить целиком
Если задача по большому файлу, дешевле сначала попросить краткую выжимку по нужному разделу, а дальше работать с ней. Иначе документ будет перечитываться заново на каждом вашем сообщении, и лимит кончится на середине обсуждения.
Способ 4
У подписки потолок сообщений, у ключа API потолка нет: там вы платите за фактический расход и упираетесь только в собственный кошелёк. OpenAI сама предлагает этот выход при исчерпании лимита, у Anthropic он называется usage credits и включается на платных планах.
Когда это выгодно. Если нейросеть нужна волнами (неделя плотной работы, три недели тишины), оплата по факту почти всегда дешевле подписки. Если вы сидите в чате каждый день по несколько часов, подписка выгоднее, и именно поэтому она существует. Считать нужно по своей нагрузке за месяц, а не по чужим отзывам. Как завести ключ и что с ним делать, разобрано в гайде как получить API-ключ Claude.
Оплата из России
И подписка, и пополнение баланса API у зарубежных сервисов требуют иностранной карты, российские не проходят. Способы, которые реально работают, разобраны в гайде как оплатить ChatGPT из России; из платёжных посредников мы пользуемся Платипомиру. Это платный сервис, комиссию он берёт сверху.
Способ 5
Модель, запущенная на своём компьютере, не считает ни сообщения, ни токены и не спрашивает карту. Ставится это одной программой, чаще всего через Ollama, работает без интернета, и переписка не уходит наружу вообще. Для рутины (пересказ, черновик, вычитка, разбор своих заметок) этого достаточно.
Честная цена вопроса такая. Лимит меняется на требования к железу: лёгкие модели живут на обычном ноутбуке, средние просят много оперативной памяти, тяжёлые нормально работают только на видеокарте. И качество ниже топовых облачных моделей: локальная семёрка не заменит старшую модель на сложной задаче. Зато она не кончается никогда.
Есть и промежуточный вариант: открытые каталоги моделей. На OpenRouter, например, на 8 сентября 2026 года в каталоге 429 моделей, и у 19 из них нулевая цена и на входе, и на выходе. Лимиты там свои и меняются, но как запасной аэродром на вечер, когда основная подписка закончилась, это рабочий вариант.
Часть 4 · Осторожно
Вокруг запроса «обойти лимит» крутится много предложений, которые заканчиваются потерей аккаунта или денег. Коротко, чего делать не стоит.
Красные флаги
Ещё одна мысль, которая экономит время: если аккаунт уже заблокировали или сервис перестал открываться, это отдельная проблема, а не лимит. Что делать в таком случае, разобрано в гайдах ChatGPT не работает и блокировка аккаунта Claude.
Коротко
FAQ
Потому что лимит считается не в сообщениях, а в объёме работы. Каждый раз модель перечитывает весь диалог целиком, поэтому к концу длинной ветки одно и то же сообщение стоит в разы дороже, чем в начале. Плюс тяжёлые модели расходуют окно быстрее лёгких, а картинки и файлы жгут его ещё быстрее: у OpenAI записано, что генерация изображений съедает включённый лимит в среднем в 3-5 раз быстрее обычного хода.
Легально обойти можно только четырьмя способами: дождаться сброса окна, переключиться на модель полегче, докупить кредиты (на планах Plus и Pro это разрешено официально) или запускать запросы по ключу API, где оплата идёт за токены. Сервисы, которые обещают ChatGPT «без лимитов» за копейки, обычно перепродают чужой ключ API: это нарушение правил, риск потерять аккаунт и слить переписку третьей стороне.
У ChatGPT и Claude основное окно скользящее и длится пять часов. Скользящее означает, что отсчёт идёт от ваших запросов, а не от полуночи, поэтому доступ возвращается постепенно: старые сообщения выпадают из окна и место освобождается. На платных планах сверху действует недельный потолок, у Claude он прописан в документации прямым текстом, у OpenAI формулировкой «weekly limits may also apply».
В облаке нет: даже самые дорогие планы описывают лимит как «в 20 раз больше», а не «безлимит». Единственный вариант без потолка сообщений это модель на своём компьютере (Ollama и подобные) или оплата по токенам через API, где вы платите за фактический расход. У локального запуска цена другая: нужны железо и оперативная память, а качество заметно ниже топовых облачных моделей.
Больший объём в том же пятичасовом окне и доступ к старшим моделям. У Claude в документации записано, что Pro даёт минимум в 5 раз больше использования за сессию, чем Free, а Max ещё в 5 или 20 раз больше, чем Pro. У Google оплаченные планы описаны как 2x, 4x и до 20x доступа к Gemini относительно бесплатного. Бесплатный тариф при этом обычно ещё и лишён тяжёлых моделей и части функций.
Да, и это самый недооценённый приём. В одном чате модель каждый раз перечитывает всю историю, и расход растёт от сообщения к сообщению. Если тема сменилась, начатый заново чат сбрасывает этот груз до нуля. Обратная сторона: контекст придётся дать заново, поэтому длинную ветку имеет смысл дорабатывать, а новую тему всегда начинать с чистого листа.
Нет, и это плохая идея по трём причинам. Общий аккаунт не увеличивает лимит, а делит его пополам, потому что пул один. Одновременная работа с разных устройств и стран выглядит как взлом и приводит к блокировке. И вся переписка второго человека видна первому. Для двоих дешевле два бесплатных аккаунта на разных сервисах, чем один платный на двоих.
Считать, а не терпеть. Если вы регулярно упираетесь в потолок, подписка вам уже мала и есть два выхода: поднять план или перейти на оплату по токенам через ключ API, где нет потолка сообщений, а счёт идёт за фактический расход. Второй путь часто дешевле для нерегулярной работы и дороже для ежедневной, поэтому решение принимается по вашей реальной нагрузке за месяц.
Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.
Посмотреть, что внутриtelegram
Канал с полезными материалами про нейросети
Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.