ClaudeLab

Лимиты нейросетей 2026: сколько запросов даёт подписка и что делать

Опубликовано 28 августа 2026 г.Beginner
Что вы узнаете
  • Что именно лимитируется на каждом тарифе ChatGPT и Claude, с цифрами и датой снятия
  • Что заканчивается 31 августа 2026 и почему счётчик обнулится раньше, чем вы привыкли
  • Шесть привычек, которые расходуют лимит впустую
  • Семь ходов на случай, когда лимит уже закончился, с ценой и подвохом каждого
  • Расчёт, при каком объёме работы подписка проигрывает оплате за токены
Новичок

Вы платите за подписку 20 долларов в месяц, в четверг днём отправляете обычный запрос и получаете ответ, что лимит исчерпан и вернуться можно через три часа. Работа встала. Лимиты нейросетей устроены так, что счётчик почти нигде не привязан к календарному месяцу, и понять свой реальный потолок по странице тарифов невозможно.

Разбираю по порядку: что именно считают ChatGPT и Claude, что заканчивается 31 августа 2026 года, почему один и тот же тариф у вас и у коллеги ведёт себя по-разному, и в какой момент подписка перестаёт быть подходящим способом платить за нейросеть.

Каждую неделю разбираю, как малому бизнесу применять нейросети в рабочих задачах без штата разработчиков. Продолжение - в канале.

Что такое лимиты нейросетей и почему подписка кончается раньше месяца?

Слово «запрос» в тарифах почти ничего не значит. Считают не запросы, а токены. В глоссарии Anthropic токен описан как примерно три с половиной символа английского текста, и оговорено, что для других языков число другое. В справке OpenAI это описано прямо: токены расходуют ваш промпт, приложенные файлы, история переписки, результаты работы инструментов и сам ответ модели.

Главное здесь - история переписки. В каждый следующий ход диалога заново отправляется всё, что вы уже написали. Двадцатое сообщение в длинном чате стоит в разы дороже первого, хотя выглядит так же.

Второе, что работает не так, как ожидаешь, - окно. Лимиты нейросетей почти везде скользящие. Правило звучит так: «не больше N за любые последние пять часов». Полуночного сброса тут нет.

Окно начинается с вашего первого запроса и отсчитывается от него. Отправите всю дневную работу за час - закроете себе доступ на четыре часа вперёд. Растянете ту же работу на день - не закроете.

Поверх пятичасового окна лежит недельное. У Anthropic их даже два: отдельный на модель Opus и отдельный на все остальные модели.

Отсюда практический вывод. Если ваш ответ на «кончился лимит» - подождать, вы платите за подписку и не получаете её целиком. Про то, сколько вообще стоит работа с моделями и что выгодно отдавать нейросети, есть отдельный разбор цен на нейросети; здесь речь именно про потолок.

Что происходит 31 августа 2026 и кого это заденет?

Разбор Жемала Хамидуна на Хабре от 28 августа 2026 года описывает ситуацию так: промо «+50 % к недельным лимитам» действовало с 13 мая, продлевалось трижды - 13 июля, 19 июля и 19 августа - и заканчивается 31 августа. Автор отдельно оговаривает, что четвёртое продление исключать нельзя, но планировать на него не стоит.

⚠️ Важная оговорка про источник. Я искал первоисточник у Anthropic и не нашёл: страница anthropic.com/news/claude-code-weekly-limits отдаёт 404, в справке поддержки промо не упоминается. Даты подтверждаются разбором на Хабре и агрегаторами новостей, но не самим вендором. Читайте эту цифру как «по разбору на Хабре», а не «по данным Anthropic».

Есть и вторая часть арифметики, из-за которой лимиты нейросетей заканчиваются быстрее, чем обещает процент. Одновременно работает второй множитель, и он из того же разбора: с моделей Claude 4.7 действует новый токенизатор, и тот же самый текст считается примерно на 30 % дороже в токенах. На странице цен Anthropic слова «токенизатор» я 28 августа не нашёл, так что это тоже цифра с Хабра. Формально урезали треть, а по ощущению доступ заканчивается заметно быстрее.

Кого это касается на практике. Пул общий: в справке Anthropic сказано, что лимиты Pro и Max делятся между Claude и Claude Code, и вся активность в обоих инструментах считается в один счётчик. То есть можно не открывать Claude Code вовсе, израсходовать неделю в обычном чате и обнаружить, что рабочий инструмент недоступен.

И общий сигнал темпа: за две недели с 14 по 27 августа в реестре npm вышло 16 релизов Claude Code, с версии 2.1.233 по 2.1.250. Инструмент, про который вы читали в июле, сегодня другой - вместе с правилами расхода.

Сколько запросов даёт ChatGPT и что именно там лимитируется?

6 августа 2026 года OpenAI объявила, что снимает ограничения на текстовые чаты для всех пользователей. Об этом писал TechCrunch со ссылкой на анонс компании; там же прямо сказано, что отдельные лимиты сохраняются на файлы, изображения, голос и генерацию картинок. Раскатка шла не мгновенно, в тексте стоит «на следующей неделе», так что аккуратная формулировка - с середины августа 2026 года.

Цифры по рабочим сценариям OpenAI публикует на странице тарифов для разработчиков. Лимиты нейросетей там даны диапазонами, без единого точного числа. Данные сняты 28 августа 2026 года.

ТарифСообщений за 5-часовое окно, GPT-5.6 SolТо же, TerraТо же, Luna
Plus10-10025-200250-2 000
Pro 5x50-500125-1 0001 250-10 000
Pro 20x200-2 000500-4 0005 000-40 000
Business (за место)10-10025-200250-2 000

Посмотрите на строку Plus. Нижняя граница у тяжёлой модели - 10 сообщений, у лёгкой - 250. Верхняя - 100 против 2 000. По сопоставимым границам разрыв доходит до 25 раз, и зависит он только от того, какую модель вы выбрали в выпадающем списке.

Под таблицей OpenAI оставляет сноску, что локальные сообщения и облачные чаты делят одно пятичасовое окно и что поверх могут действовать дополнительные недельные лимиты. Конкретных недельных цифр компания не публикует.

Отдельно от текста считаются лимиты нейросетей на голос: на Plus это порядка 15-30 минут за пятичасовое окно, а на старшем тарифе Pro ограничения нет. Генерация картинок формально идёт в общий счёт, но расходует его в 3-5 раз быстрее обычного хода.

⚠️ Цены самих подписок ChatGPT я здесь не привожу намеренно. Страницы openai.com и chatgpt.com отдают роботу 403, а перепечатывать суммы из чужих блогов без первоисточника - способ опубликовать неверную цифру. Смотрите цену на странице тарифов в своём аккаунте.

Сколько даёт Claude и почему Anthropic не называет цифры?

На странице тарифов Anthropic по состоянию на 28 августа 2026 года есть цены и множители, но лимиты нейросетей в штуках сообщений там не названы. Pro - 17 долларов в месяц при годовой оплате или 20 при помесячной. Max - от 100 долларов, с выбором «в 5 или в 20 раз больше использования, чем Pro». Команда - от 2 до 150 человек, стандартное место 20 долларов при годовой оплате, премиальное 100 с пятикратным объёмом.

Окно контекста - 200 тысяч токенов на всех тарифах, кроме корпоративного: там оно больше.

Вместо чисел справка Anthropic перечисляет, от чего лимиты нейросетей зависят: длина сообщения, размер вложенных файлов, текущая длина разговора, использование инструментов вроде веб-поиска, выбор модели, уровень «усилия» и создание артефактов.

Это и есть отрицательный факт, который стоит держать в голове: точного числа сообщений на тарифах Claude не существует в публичном доступе. Любая конкретная цифра из обзора или подборки - домысел автора обзора. Проверить свой потолок можно только в интерфейсе: у Claude это раздел Usage в настройках, у Codex - команда /status.

Если тема тарифов и того, сколько на самом деле стоит рабочая нейросеть, для вас сейчас основная - собирайте систему целиком. ClaudeLab - продукты и решения на нейросетях для бизнеса: разбираем задачу, считаем экономику и доводим до работающего результата.

Почему у вас лимит кончается быстрее, чем у коллеги на том же тарифе?

Формулировка OpenAI на этот счёт довольно прямая: задачи, которые выглядят одинаково, могут расходовать разный объём, потому что влияют выбор модели, контекст, рассуждение, инструменты, поиск и кэширование, и по одной длине промпта расход предсказать нельзя.

Разберу три причины, по которым лимиты нейросетей расходуются с разной скоростью.

  1. Модель. Это самый крупный множитель и одновременно самый простой в управлении. Разница между Sol и Luna на тарифе Plus - до 25 раз за одно и то же окно. Сама OpenAI ставит смену модели первым пунктом в ответе на вопрос, что делать при приближении к лимиту.
  2. Кэш. В справке Anthropic сказано, что документы, загруженные в проект, кэшируются, и при повторном обращении в лимит идут только новые, некэшированные части. Человек, который держит регламент и прайс в проекте, расходует меньше того, кто вставляет те же файлы в каждый новый чат.
  3. Скрытые множители. Генерация картинок расходует счётчик в 3-5 раз быстрее. По разбору на Хабре, команды агентов у Claude расходуют примерно в 7 раз больше токенов, чем обычная сессия, а кэш на подписке держится час против пяти минут на оплате по факту.

Отсюда же берётся частая путаница. Пользователь описывает, что «модель поглупела», хотя на деле он подошёл к потолку и получил ответ подешевле. В треде на Hacker News от 14 августа 2026 года (993 очка, 873 комментария) люди обсуждают ровно это: у одних всё работает отлично, у других качество падает, и никто не может объяснить разницу. Тред от 22 августа (216 очков, 190 комментариев) прямо предполагает, что уровни «усилия» в Claude Code тестируются выборочно.

Что расходует лимит впустую: шесть привычек

Ни одна из них не связана со сложностью задач. Лимиты нейросетей расходует способ работы, сами задачи тут ни при чём.

  1. Флагман на мелкой задаче. Переписать письмо младшей моделью стоит в разы дешевле. Держите тяжёлую модель для разбора договора и планирования, лёгкую - для черновиков и переформулировок.
  2. Один бесконечный диалог. Anthropic называет текущую длину разговора фактором расхода прямым текстом. Новая задача - новый чат.
  3. Повторная загрузка одного и того же. Прайс, регламент, бриф загружаются в проект один раз. Дальше они кэшируются, и в счёт идут только новые части.
  4. Дробление задачи на десять сообщений. Официальная рекомендация Anthropic - собирать похожие запросы в одно сообщение вместо десяти отдельных.
  5. Работа без дашборда. OpenAI советует заглядывать в панель расхода раз в одну-две недели, чтобы понимать свой темп. У Claude это Settings, раздел Usage, с прогресс-барами по сессии и по неделе.
  6. Работа урывками на оплате по факту. Кэш там держится пять минут против часа на подписке. При паузах по 10-15 минут вы каждый раз платите за один и тот же контекст заново.

Что делать прямо сейчас, когда лимит кончился?

ХодСколько стоитПодвох
Подождать сброса окна0 ₽Простой в рабочее время. Пауза без решения
Переключить модель полегче0 ₽Качество разбора длинного документа падает, проверять всё равно вам
Поднять тариф Pro → Maxс 20 до 100+ долларов в месяцПлатите за пик, расходуете в среднем; неиспользованное не переносится
Купить второе место в команде25 долларов в месяц против 100 за MaxМесто именное, лимиты двух мест не суммируются
Перейти на оплату за токеныпо фактуУпирается в доступность: нужен отдельный клиент для работы и юрлицо в стране из списка обслуживания
Поставить модель локальноот стоимости подходящего железаЖелезо без загрузки обходится дороже платного доступа
Взять российский сервисот 600 ₽ в месяц для юрлицаДругой набор моделей и другое качество на сложных задачах

Первые четыре хода не выводят вас за пределы подписки, последние три меняют сам способ платить, и вместе с ним лимиты нейросетей перестают быть чужим параметром. Локальный вариант разберу отдельно, потому что его чаще всего представляют неправильно.

В опросе Orion soft, опубликованном на Хабре 26 августа 2026 года, серверная конфигурация под собственную модель оценивается в 7-10 млн ₽, кластер - от 20 млн ₽ капитальных затрат. Это цифры крупного бизнеса. Контраргумент даёт Михаил Дремин из Cloud.ru в другом материале, опросе Хабра и Cloud.ru от 27 августа: если карта загружена на 10 %, реальная стоимость токена оказывается на порядок выше номинала. Как выглядит разумный локальный сценарий для небольшой компании, я разбирал в материале про локальную нейросеть.

Отдельный ход, который выглядит бесплатным и таковым не оказывается, - бесплатные посредники-роутеры к платным моделям. Обзор на Хабре от 16 августа 2026 года перечисляет шесть таких сервисов и сразу предупреждает: условия у них меняются быстро, модели исчезают, лимиты пересматриваются, а бесплатные тарифы закрываются. Там же приводится прайс одного из посредников на Opus 5 - 2 доллара за миллион входных токенов, тогда как на официальной странице Anthropic на 28 августа стоит 5 долларов. Это цена личного кабинета посредника, и она ничего не говорит о цене вендора.

Когда подписка проигрывает оплате за токены?

Официальные цены за миллион токенов на 28 августа 2026 года, вход и выход.

МодельВходВыход
Claude Opus 55 $25 $
Claude Sonnet 52 $10 $
Claude Haiku 4.51 $5 $
GPT-5.6 Sol4 $20 $
GPT-5.6 Terra2 $12 $
GPT-5.6 Luna0,2 $1,2 $

При оплате за токены лимиты нейросетей в привычном виде исчезают: вы платите за фактический объём работы. Пакетная обработка у обоих поставщиков дешевле вдвое. У промо-цены на Sol есть срок: на странице OpenAI указано, что она действует как минимум до 21 ноября 2026 года.

Дальше моя арифметика по этим ставкам, вендорам её приписывать не надо. Двадцать долларов - цена месячной подписки. Те же 20 долларов по факту дают около 4 млн входных токенов на Opus 5, около 10 млн на Sonnet 5 и около 100 млн на самой дешёвой Luna.

Звучит так, будто подписка проигрывает всегда. Это не так по одной причине: в чате при каждом ходе заново уходит вся история диалога, системная инструкция и содержимое проекта. Реальный расход на тот же результат заметно выше «чистого» объёма задачи, а посчитать его заранее по формуле нельзя. Отсюда рабочее правило: включайте оплату за токены на один месяц параллельно с подпиской и сравнивайте фактические счета. Как считать отдачу от такого перехода, я подробно разбирал в материале про окупаемость ИИ для бизнеса.

Сколько дают российские сервисы и чем за них платить?

По тарифной странице Сбера для юрлиц, обновлённой 15 июля 2026 года, минимальные расходы на сервис составляют 600 ₽ в месяц с НДС. Это не абонентская плата: формулировка на странице говорит, что это минимальная сумма, которую вы заплатите, если услугами воспользуетесь.

Ставки за 1000 токенов в синхронном режиме: Lite - 0,065 ₽, Pro - 0,5 ₽, Max - 0,65 ₽. Асинхронный режим ровно вдвое дешевле. По моему пересчёту, минимальные 600 ₽ - это примерно 9,2 млн токенов Lite или 0,92 млн токенов Max.

Лимиты нейросетей здесь устроены иначе: потолка по числу сообщений нет вовсе, есть только оплаченный объём токенов. Одно отличие мешает сравнивать эти ставки с зарубежными напрямую: у Сбера одна цена за токен, без деления на входные и выходные. Сравнивать в лоб с 5 $ / 25 $ у Opus некорректно.

Для физлиц действует бесплатный режим на 365 млн токенов сроком на 12 месяцев, генерация в один поток.

У Алисы Про квоты названы прямо на странице продукта: бесплатная версия - 25 документов на проект, 50 запросов в месяц, 10 проектов; для клиентов Яндекс 360 - 200 запросов в месяц и неограниченное число проектов. У опции Алиса Плюс числовых квот в справке нет вовсе, там формулировки «приоритетный доступ» и «расширенный лимит», зато прямо указано геоограничение: подключить её можно только в России и Беларуси при наличии подписки Яндекс Плюс.

Что из этого выбрать под конкретную задачу - отдельный разговор; сравнение российских моделей есть в разборе про GigaChat для бизнеса, а варианты замены зарубежных сервисов - в материале про аналоги ChatGPT.

Что с лимитами в команде и при увольнении сотрудника?

У Anthropic командный тариф начинается с двух человек и допускает смешивание типов мест: часть команды на стандартных, часть на премиальных с пятикратным объёмом. Управление и оплата централизованные, места можно добавлять в середине срока.

На корпоративном тарифе логика меняется: 20 долларов за место плюс потребление по ставкам за токены, администратор задаёт лимиты расхода на пользователя и на организацию. То есть компания уходит от «лимита на человека» к бюджету на организацию.

Два свежих изменения касаются уровня компании: там лимиты нейросетей устроены иначе, чем у одного человека.

27 августа 2026 года в заметках о выпуске Anthropic появились персональные ключи и ключи сервисных аккаунтов. Формулировка важная: ключ перестаёт работать, когда связанная учётная запись удаляется из организации. Практический вывод для владельца: процесс, построенный на персональном ключе сотрудника, останавливается вместе с его увольнением. На ключе сервисного аккаунта - переживает.

25 августа 2026 года OpenAI выпустила плагин администратора для ChatGPT Work и Codex: добавление и удаление участников, просмотр расхода кредитов, изменение лимитов и обработка запросов на их повышение. Официальную страницу анонса робот открыть не может, формулировки цитируются по публикации 9to5Mac. Смысл для бизнеса тот же: в корпоративных продуктах лимит настраивает администратор.

Почему подписка - слабое основание для рабочего процесса?

Начну с проверяемого факта. 28 августа 2026 года я открыл страницы поддерживаемых стран обоих вендоров и прошёл по алфавитному перечню. У Anthropic между Romania и Rwanda России нет. У OpenAI в том же месте списка - Romania, Rwanda, дальше Saint Barthelemy. Формулировка на странице Anthropic ещё жёстче: компания оставляет за собой право не предоставлять продукты организациям, принадлежность которых относится к странам вне списка.

Второе. Потребительские условия Anthropic прямо запрещают передавать данные для входа, ключ или доступ к аккаунту кому-либо ещё, и возлагают на владельца ответственность за всю активность под учётной записью. По этой формулировке под запрет попадает и привычная схема «один аккаунт на отдел». В редакции для потребителей Европейской экономической зоны, которую отдаёт сайт, есть и отдельный пункт про использование сервиса только в личных, некоммерческих целях, а предел ответственности вендора ограничен суммой уровня полугодовой оплаты или 100 евро.

⚠️ Редакции условий различаются по регионам, и я проверял ту, которую сайт отдал мне. Перед тем как строить на подписке процесс, от которого зависят выплаты или обязательства перед клиентами, свои условия стоит прочитать самому и показать юристу.

Третье, что видно по свежим русским данным. В опросе Хабра и Cloud.ru от 27 августа 2026 года участвовали 173 респондента. Каждый третий ответил, что сотрудники сами находят инструменты и сами за них платят, а более чем в четверти компаний работают на личных подписках. Про регламенты картина такая: 28 % сказали, что отправка реальных данных в их компаниях запрещена, а 31 % - что не регламентировано ничего и каждый решает сам. Михаил Дремин из Cloud.ru замечает, что в небольших компаниях теневое использование плотнее, потому что там обычно нет ни развитой службы информационной безопасности, ни бюджета на корпоративные лицензии.

Сложите это вместе, и лимиты нейросетей окажутся не главной проблемой. Рабочий процесс компании держится на личной подписке сотрудника, оформленной на страну вне списка обслуживания, с запретом на передачу доступа и без всякого соглашения об уровне сервиса.

Когда переезжать на своё решение, а когда этого делать не надо?

Признаки по порядку. Все они про одно: задача переросла формат чата, и лимиты нейросетей тут уже вторичны.

  1. Людей больше одного. Командный тариф начинается ровно с двух человек, потому что второй по условиям не может работать под вашим аккаунтом. Порог здесь договорный.
  2. Задача повторяется десятки раз в месяц и одинакова по форме. Одинаковый запрос, одинаковый формат ответа, человек в середине не нужен. Это уже не работа в чате, это процесс.
  3. Вы упираетесь в недельное окно регулярно, а не раз в квартал. Апгрейд с Pro на Max покупает пятикратный объём за пятикратную цену. Это разумно при стабильной перегрузке и бессмысленно при разовых пиках.
  4. Есть данные, которые нельзя отправлять наружу. Если у вас пока «не регламентировано ничего», это читается как свобода, а работает как отложенный инцидент.
  5. Процесс должен пережить увольнение. Персональный ключ перестаёт работать вместе с учётной записью. Если завтра уход сотрудника останавливает выставление счетов, опора выбрана неверно.

Когда собранное решение окупается, речь идёт про автоматизацию бизнеса с ИИ: процесс работает на ключе компании, расход виден по счёту и не зависит от того, чей аккаунт оплачен в этом месяце. Порядок цен на такую сборку я разбирал отдельно в материале про стоимость ИИ-агента.

Здесь честно оговорюсь: собранные решения на API - это то, чем занимается ClaudeLab, так что раздел про переезд написан заинтересованной стороной. Поэтому дальше - обратная сторона, без которой он был бы рекламой. Переезжать не надо, если вы работаете один и в чате, если задачи каждый раз разные, если вы упираетесь в лимит раз в месяц и если у вас нет данных под ограничениями. В этом сценарии подписка за 20 долларов остаётся самым дешёвым способом получить топовую модель, а собранное решение добавит вам поддержку, которую придётся оплачивать. Отдельный случай - когда решение нужно, но своими силами не собирается: тогда имеет смысл посчитать разработку под ключ, но начинать всё равно стоит с замера.

С чего начать на этой неделе?

  1. Откройте дашборд расхода и посмотрите, на что уходят лимиты нейросетей. У Claude это Settings, раздел Usage. У Codex - команда /status. Посмотрите, что именно расходует ваш недельный лимит.
  2. Переведите рутину на модель полегче. Это единственный ход, который стоит ноль и даёт кратный эффект в тот же день.
  3. Вынесите повторяющиеся файлы в проект. Прайс, регламент, шаблон договора загружаются в проект один раз и дальше берутся оттуда.
  4. Заведите параллельный счёт по оплате за токены на один месяц. Через месяц у вас будет две цифры вместо одной догадки, и лимиты нейросетей перестанут быть неожиданностью.

И пятое, если вы работаете в Claude Code: посмотрите на календарь. Проверьте свой недельный расход в первую неделю сентября: в конце месяца перестраивать работу уже поздно.

Источники

Все цифры сняты 28 августа 2026 года. Тарифы и лимиты нейросетей меняются часто - перед решением сверяйтесь со страницей тарифов своего поставщика.

Максим Самусь
Автор
Основатель ClaudeLab

Десять лет в маркетинге: агентства, продвижение услуг, трафик из таргета и контекста. Весной 2026 взял в руки Claude Code и собрал первый собственный продукт и систему ИИ-агентов под свои задачи. С тех пор строит на этом агентство - сайты, автоматизацию и заказную разработку для бизнеса. Пишет о том, что делает сам: разбирает задачи, которые проходит на своих проектах и проектах клиентов. Свои продукты - Photogenia, нейрофотосессии с сайтом и Telegram-ботом, и Reachen, сервис генерации рекламных креативов. Ведёт Telegram-канал о Claude Code и нейросетях для бизнеса - @ai_smart_usage.

Эта статья была полезна?

Похожие статьи

Создание сайта нейросетью: что соберёт сама, а что доделать руками

Создание сайта нейросетью в 2026 году: что ИИ-конструктор собирает по запросу, что в такой заготовке не работает и девять вещей, которые владелец доделывает руками - тексты о своём деле, фото, форма заявки, домен, согласие по 152-ФЗ, Метрика, Вебмастер.

14 мин

Коммерческое предложение нейросетью: чтобы его дочитали

Коммерческое предложение нейросетью пишется за пять минут, и вся выдача обещает именно это. Разбираю обратную сторону: по каким шести признакам получатель узнаёт машинный документ, что отдать модели, какой промпт не даёт ей выдумывать цифры и что проверить перед отправкой.

14 мин

Автоматизация малого бизнеса: с чего начать и что не трогать

Автоматизация малого бизнеса чаще всего срывается не из-за денег, а из-за порядка: берутся за сложное вместо частого. Разбираем пять процессов, с которых начинают, что автоматизировать рано и как посчитать результат.

5 мин

MVP: что это, зачем нужен и как собрать первую версию

MVP путают с недоделанным продуктом, и из-за этого он перестаёт работать как проверка идеи. Разбираем, чем первая версия отличается от урезанной, как выбрать единственный сценарий и по какому признаку понять, что гипотеза не подтвердилась.

6 мин

Самое читаемое за 7 дней