Клод Опус 5 — модель Anthropic для сложной агентной работы. Вышла 24 июля 2026, стоит столько же, сколько Opus 4.8, но при том же ценнике счёт за одинаковую задачу вырос. Разбираем почему.
Claude Opus 5 (claude-opus-5) — модель Anthropic для сложного агентного кодинга и корпоративных задач, выпущенная 24 июля 2026 года. Контекстное окно 1 миллион токенов, вывод до 128 тысяч, мышление включено по умолчанию. Цена по API — 5 долларов за миллион входных токенов и 25 за миллион выходных. В подписке Claude она входит в платные тарифы: Pro от 17 долларов в месяц, Max от 100.
Что узнаешь из разбора
Часть 1 · Модель
Главное
Дата выхода — 24 июля 2026. Идентификатор модели в API — claude-opus-5. Цена осталась такой же, как у Opus 4.8.
В журнале изменений Claude API запись от 24 июля 2026 описывает Opus 5 как заметный шаг вперёд относительно Opus 4.8, с наибольшим приростом в глубоких рассуждениях, агентных и длинных задачах. Модель доступна не только через Claude API: в той же записи перечислены Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry.
| Параметр | Значение |
|---|---|
| Идентификатор в API | claude-opus-5 |
| Дата выхода | 24 июля 2026 |
| Контекстное окно | 1 000 000 токенов (и по умолчанию, и максимум) |
| Максимальный вывод | 128 000 токенов |
| Мышление | адаптивное, включено по умолчанию |
| Граница знаний | май 2026 |
| Priority Tier | не поддерживается |
Отдельная деталь для тех, кто гоняет агентов: у Opus 5 появился режим Fast mode в статусе исследовательского превью, и он есть только на Claude API — на Bedrock, AWS, Google Cloud и Microsoft Foundry его нет. Тарифицируется он дороже обычного режима, по 10 и 50 долларов за миллион токенов.
Часть 2 · Деньги
Цена зависит от того, каким каналом вы пользуетесь. По API платят за токены, по подписке — фиксированную сумму в месяц. Ниже обе таблицы, с цифрами со страницы тарифов Anthropic и из документации по ценам на 2 сентября 2026.
| По API, за миллион токенов | Opus 5 |
|---|---|
| Входные токены | $5 |
| Выходные токены | $25 |
| Запись в кэш на 5 минут | $6,25 |
| Запись в кэш на 1 час | $10 |
| Чтение из кэша | $0,50 |
Кэш здесь не мелочь. Чтение из кэша дешевле обычного входа в десять раз, а минимальная длина кэшируемого куска на Opus 5 снижена до 512 токенов — на Opus 4.8 она была 1024. Практический смысл: короткие системные промты и наборы инструкций, которые раньше просто не попадали в кэш, теперь кэшируются без единой правки в коде.
| Подписка Claude | Цена | Что даёт |
|---|---|---|
| Free | $0 | чат, веб-поиск, память между разговорами |
| Pro | $17/мес при годовой ($200 сразу), $20 помесячно | больше объёма, Claude Code, Cowork, Design, Science |
| Max | от $100/мес | на выбор 5x или 20x к объёму Pro, приоритет в пик |
| Team | $20/место при годовой, $25 помесячно | премиальное место $100 / $125 даёт 5x к обычному |
| Enterprise | $20/место + расход по тарифам API | SSO, SCIM, журналы аудита, лимиты трат |
Что выгоднее именно вам
Ответ упирается в то, сколько токенов вы реально сжигаете за месяц. Разбор с расчётом порога, за которым API дешевле подписки, — в гайде сколько стоит Claude Code и как выгоднее оплатить. Где выпустить ключ и что означают ошибки 401 и 529 — в разборе API-ключ Claude.
Часть 3 · Незаметный рост счёта
Главное
Модели Claude 4.7 и новее считают текст другим токенизатором: тот же текст даёт примерно на 30% больше токенов. Тариф не рос — вырос расход.
Это самая недооценённая строка в документации по ценам, и она объясняет жалобы вида «лимит стал кончаться быстрее, хотя я ничего не менял». Цена за миллион токенов у Opus 5 такая же, как у Opus 4.8, но на одинаковом тексте токенов теперь набегает больше. Точный коэффициент зависит от содержимого: код, русский текст и разметка ведут себя по-разному.
max_tokens надо пересмотреть. Значение, подогнанное под старую модель, может обрезать эквивалентный ответ на середине.Двойной эффект с мышлением
Токены мышления тарифицируются как выходные, а выходные у Opus 5 стоят 25 долларов за миллион. Если раньше ваш код гонял Opus 4.8 без мышления, теперь он платит и за более длинную токенизацию, и за размышления. Как это гасить на практике — в разборе лимиты Claude быстро кончаются.
Часть 4 · Контекст
Миллион токенов — это про API. Там окно в 1 000 000 одновременно и значение по умолчанию, и потолок: варианта модели с меньшим окном просто не существует. А вот в подписке для чата картина другая: в таблице сравнения тарифов на claude.com строка контекстного окна на всех четырёх уровнях — Free, Pro, Max 5x и Max 20x — показывает 200 тысяч токенов.
Почему это важно на практике
Обещание «миллион токенов» часто переносят на чат, и человек загружает в диалог книгу, а потом удивляется, что модель забыла начало. Если вам нужен по-настоящему длинный контекст — это работа через API или через инструмент, который ходит в API. Как работает память между сессиями и почему она не то же самое, что окно контекста, — в разборе память сессий Claude.
Ещё одна деталь для тех, кто работает через редакторы. В Cursor у Opus 5 контекст по умолчанию 300 тысяч токенов, а миллион заявлен как максимум — то есть окно зависит не только от модели, но и от обёртки, через которую вы её вызываете.
Часть 5 · Выбор
В линейке Anthropic на 2 сентября 2026 четыре актуальные модели. Ниже сводка из таблицы сравнения в документации — с ценами, окном и скоростью.
| Модель | Цена вход / выход | Контекст | Вывод | Скорость |
|---|---|---|---|---|
| Fable 5.1 | $10 / $50 | 1M | 128K | медленнее всех |
| Opus 5 | $5 / $25 | 1M | 128K | средняя |
| Sonnet 5 | $2 / $10 | 1M | 128K | быстрая |
| Haiku 4.5 | $1 / $5 | 200K | 64K | самая быстрая |
Официальная рекомендация в документации звучит прямо: начинать стоит с Opus 5 для большинства задач, а Fable 5.1 брать для тяжёлых рассуждений и долгих агентных прогонов либо когда ваши собственные проверки на Opus 5 на высоком уровне усилия всё ещё не дотягивают.
Часть 6 · Миграция
Anthropic называет два ломающих изменения, и оба про мышление. На Opus 4.8 запрос без параметра thinking выполнялся без размышлений. На Opus 5 тот же самый запрос выполняется с адаптивным мышлением: модель сама решает, когда и сколько думать.
# Сломается на Opus 5, если ответ начинается с thinking
text = response.content[0].text
# Правильно: выбирать блок по типу
text = next(b.text for b in response.content if b.type == "text")thinking, и при стандартном режиме отображения поле придёт пустым. Код, который берёт первый блок как текст, нужно переписать на выбор по типу.max_tokens. Это жёсткий потолок на весь вывод целиком, размышления плюс текст. Значение, подобранное под работу без мышления, придётся поднять.Пять уровней усилия
Параметр effort принимает low, medium, high, xhigh и max. По умолчанию стоит high, и это в точности то же самое, что не передавать параметр вовсе. Уровень влияет на все выходные токены, включая вызовы инструментов: на низком модель и думает меньше, и инструменты дёргает реже. Opus 5 поддерживает все пять уровней. Подробный разбор уровней и слов-подсказок вроде ultrathink — в гайде effort и расширенное мышление.
Часть 7 · Доступ
Проверку делали не рассуждением, а запросами с московского адреса 2 сентября 2026. Картина неоднородная, и это важно: «Claude не открывается» и «Claude недоступен» — разные утверждения.
| Адрес | Ответ из Москвы | Что это значит |
|---|---|---|
| claude.com | 200 | сайт и тарифы открываются напрямую |
| console.anthropic.com | 200 | консоль разработчика отвечает |
| api.anthropic.com/v1/models | 401 | запрос дошёл, отказ только по ключу |
| claude.ai | 403, cf-mitigated: challenge | проверка посетителя Cloudflare, не обрыв сети |
Разница между 401 и 403 здесь и есть ответ на вопрос «работает ли Opus 5 из России». Код 401 на API означает, что соединение установилось и сервис попросил ключ — то есть сеть до модели есть. Код 403 на веб-версии с заголовком проверки Cloudflare означает не географический запрет, а заслон от автоматики, который обычный браузер проходит. Реальные препятствия лежат в другой плоскости: оплата российской картой и правила доступа по стране аккаунта.
Коротко
FAQ
24 июля 2026 года. В журнале изменений Claude API за эту дату записано: запущен Claude Opus 5 с идентификатором claude-opus-5, контекстным окном 1 миллион токенов, выводом до 128 тысяч токенов и мышлением, включённым по умолчанию, по цене 5 и 25 долларов за миллион токенов, то есть по той же цене, что и Opus 4.8.
По API 5 долларов за миллион входных токенов и 25 за миллион выходных. Запись в кэш стоит 6,25 доллара при пятиминутном хранении и 10 при часовом, чтение из кэша 0,50 доллара за миллион. В подписке модель не тарифицируется отдельно: Pro стоит 17 долларов в месяц при годовой оплате и 20 при помесячной, Max начинается со 100 долларов в месяц.
Отдельного бесплатного доступа именно к Opus 5 нет. Бесплатный тариф Claude существует, но в таблице сравнения тарифов на claude.com доступ к моделям и объём использования у тарифов разный, а Opus заявлен как модель платных уровней. Обещания бесплатного безлимитного Opus 5 на сторонних сайтах означают либо перепродажу чужого аккаунта, либо посредника, который видит всю вашу переписку.
Да, и это отдельно оговорено в документации по ценам. Модели Claude 4.7 и новее используют новый токенизатор, который даёт примерно на 30 процентов больше токенов на том же тексте. Цена за миллион токенов не изменилась, но токенов на ту же задачу уходит больше, поэтому счёт за эквивалентный запрос выше.
1 миллион токенов, причём это одновременно значение по умолчанию и максимум: варианта с меньшим окном у модели нет. Максимальный вывод 128 тысяч токенов. Важная оговорка: миллион относится к API. В таблице тарифов Claude для чата в строке контекстного окна на всех уровнях, от бесплатного до Max, указано 200 тысяч токенов.
Ценой и назначением. Fable 5.1 стоит 10 и 50 долларов за миллион и рекомендован для тяжёлых рассуждений и длинных агентных прогонов. Opus 5 стоит 5 и 25 и в документации назван стартовой рекомендацией для большинства задач. Sonnet 5 стоит 2 и 10 и позиционируется как лучший баланс скорости и интеллекта. У всех трёх контекст 1 миллион и вывод 128 тысяч токенов.
Два изменения. Первое: мышление включено по умолчанию, поэтому ответ может начинаться с блоков thinking, и код, который читает content[0].text, сломается — блоки надо выбирать по полю type. Второе: отключить мышление можно только на уровне усилия high и ниже. Плюс токены мышления считаются выходными и входят в max_tokens.
Инфраструктура из Москвы отвечает: замер 2 сентября 2026 показал 200 на claude.com и console.anthropic.com, 401 на api.anthropic.com без ключа, то есть запрос доходит до сервиса. Веб-версия claude.ai возвращает 403 с заголовком cf-mitigated: challenge, то есть это проверка посетителя Cloudflare, а не сетевой обрыв. Отдельная сложность не в сети, а в оплате и в правилах доступа по стране аккаунта.
Это параметр глубины работы модели. Значений пять: low, medium, high, xhigh и max, по умолчанию high. Он влияет на все выходные токены, включая мышление и вызовы инструментов. Low заметно экономит на простых задачах и подзадачах агента, xhigh и max нужны для долгих прогонов, где важнее качество, чем счёт.
Платформа и сообщество, где я по шагам показываю, как поставить ИИ на рутину: контент, код, продажи, аналитика. Заходи и забирай рабочие связки, которыми пользуюсь сам.
Посмотреть, что внутриtelegram
Канал с полезными материалами про нейросети
Разборы, новые инструменты и приёмы по ИИ — то, чем пользуюсь сам, без воды. Подпишись, чтобы не потерять.