
Счёт за модель у агента ограничен по умолчанию, а за сервер, который он выкатил, нет. Где включить жёсткий потолок?
API модели сам остановит агента на потолке тарифа, а облако, где агент выкатил сервис, обычно шлёт только письмо. Где включить жёсткий лимит и где он не спасёт.
В этой статье8
- Мягкий лимит пишет письмо, жёсткий выключает сервис
- Где жёсткий лимит расходов уже есть, а где только уведомление
- API моделей: лимит расходов в OpenAI и Anthropic
- AWS: spend limit для новых проектов и budget actions для старых аккаунтов
- Google Cloud Spend Caps: четыре сервиса и ручное снятие
- Vercel и Supabase: переключатель, который надо включить самому
- Чего не остановит ни один потолок
- Что сделать до того, как агент получит ключ
Жёсткий лимит расходов отключает сервис, когда счёт доходит до заданной суммы; мягкий только присылает письмо. По умолчанию жёсткий потолок сейчас стоит у API моделей: у Anthropic он привязан к тарифу ($500 в месяц на Start), у OpenAI есть одобренный лимит по тарифу, а с 23 июля 2026 свой жёсткий лимит можно поставить на организацию и на каждый проект. В облаках, куда агент выкатывает результат, его надо включать руками, и везде с оговорками. AWS запустила spend limit на проект 16 сентября 2026, но только в новом опыте для ограниченного числа клиентов. Google Cloud Spend Caps с 28 июля в превью и работают для четырёх сервисов. Vercel по умолчанию шлёт только письма, паузу надо включить самому. И потолок срабатывает с задержкой: OpenAI, Google и Vercel прямо пишут, что перерасход за это время оплачиваете вы.
Никто не хочет проснуться от отправленного в полночь письма о превышении бюджета и узнать, что, пока он спал, вышедший из-под контроля сервис потратил ещё несколько сотен (или несколько тысяч) долларов.
Пост Уиллисона короткий, и требование в нём одно: жёсткий лимит расходов должен стоять по умолчанию у любого сервиса с оплатой за использование. Снять его можно, но только явной галочкой «я понимаю, что сервис не отключат, и плачу за всё сверх». Повод он называет прямо: агенты сделали запуск кода почти бесплатным, а код, который запустили, умеет тратить деньги на платные API, хостинг, хранилище и вычисления.
Мы проверили, что из этого уже есть. Картина получилась странная. Потолок по умолчанию стоит ровно там, где агент думает: в API моделей. А там, куда агент выкатывает то, что написал, потолка по умолчанию нет нигде, и включается он с оговорками, которых нет в пересказах.
Мягкий лимит пишет письмо, жёсткий выключает сервис
Почти у каждого облака давно есть «бюджет». Это мягкий лимит: дошли до суммы, вам письмо. Сервис работает дальше, счёт растёт дальше.
Хуже то, что письмо опаздывает. В AWS Budgets данные обновляются до трёх раз в день, обычно через 8–12 часов после предыдущего обновления. За это время сервис, который агент развернул и забыл, успевает прожить половину суток без присмотра.
Жёсткий лимит работает иначе: дошли до суммы, сервис останавливается или API начинает отвечать ошибкой. Для бизнеса это больно, сайт лежит. Уиллисон отвечает на это так: большинство компаний и людей выберут ошибки, а не неожиданный счёт на $10 000. Мы с ним согласны, особенно для всего, что агент поднял в экспериментальном проекте.
Где жёсткий лимит расходов уже есть, а где только уведомление
| Жёсткий потолок по умолчанию | Что останавливается | Главная оговорка | |
|---|---|---|---|
| Anthropic API | Да, потолок тарифа | API отвечает 429 до 1-го числа | Default workspace нельзя ограничить отдельно |
| OpenAI API | Одобренный лимит по тарифу; свой включается тумблером | API отвечает 429 | Срабатывает не мгновенно |
| AWS | Нет | Весь проект на паузе | Только новый опыт, доступен не всем |
| Google Cloud | Нет | Новые вызовы одного сервиса | Превью, 4 сервиса |
| Vercel | Нет, только письма | Production-деплои всех проектов | Пауза включается отдельно |
| Supabase | Не проверили; переключатель Spend Cap на Pro | Использование сверх квоты плана | Compute не покрывает |
API моделей: лимит расходов в OpenAI и Anthropic
У Anthropic потолок стоит без вашего участия. У тарифов Start, Build и Scale месячный предел $500, $1 000 и $200 000. Дошли до него, и API останавливается до 00:00 UTC первого числа следующего месяца. Свой лимит можно поставить ниже потолка тарифа в Settings → Billing, раздел Spend limits. Там же, через workspaces, можно выдать отдельный лимит каждой группе ключей.
У OpenAI тоже есть одобренный месячный лимит по тарифу, а с недели 23 июля 2026 жёсткий лимит, который ставите вы сами, доступен всем аккаунтам. Его можно задать на всю организацию и на отдельный проект.
- 1
OpenAI: организация
Organization limits → Spend → Edit spend limit. Введите месячную сумму и включите Enforce a hard limit. Без этого тумблера сумма работает как обычное уведомление.
- 2
OpenAI: проект
Project settings → Limits → Spend → Edit spend limit, тот же тумблер Enforce a hard limit. Лимит проекта действует только на трафик, который оплачивается этим проектом.
- 3
Anthropic: своя сумма
Settings → Billing → Spend limits → Set limit или Adjust limit. Выше потолка вашего тарифа поставить нельзя.
- 4
Anthropic: отдельный workspace под агента
Создайте workspace, задайте ему свой лимит расходов и выпустите ключ агента там. На default workspace отдельный лимит поставить нельзя.
Самое полезное в документации обоих вендоров это коды ошибок. Агент, который упёрся в лимит, увидит 429, и SDK по умолчанию будет повторять запрос. У Anthropic на потолке тарифа нет заголовка retry-after, и повторы ничего не дадут до начала следующего месяца. Отличить потолок от обычного rate limit можно только по коду:
# Anthropic, потолок тарифа: HTTP 429error.type = rate_limit_errorerror.details.error_code = enforced_spend_limit_reached# Anthropic, ваш собственный лимит: HTTP 400error.type = invalid_request_error"You have reached your specified API usage limits..."# OpenAI: HTTP 429error.code = organization_spend_limit_exceedederror.code = project_spend_limit_exceeded
Если агент работает по расписанию, научите его обработчик различать эти коды и останавливаться, а не ретраить. Иначе вы узнаете о потолке из логов, где тысяча одинаковых ошибок.
AWS: spend limit для новых проектов и budget actions для старых аккаунтов
16 сентября AWS объявила новый опыт для разработчиков, и в нём наконец появился лимит, который останавливает расходы. Он ставится на проект: AWS Settings → Billing → Cost by project → Set limit. Дошли до суммы, AWS ставит проект на паузу и останавливает все его ресурсы до конца месяца. Данные сохраняются.
Оговорок больше, чем в анонсе.
- Попробовать новый опыт AWS предлагает через создание нового аккаунта, а в документации прямо написано, что он раскатывается на ограниченное число клиентов. Уиллисон тоже это заметил и надеется на общий доступ.
- Нужен платный план. Минимальный лимит это большее из $20 и консервативной оценки ваших расходов, а оценка учитывает прошлый месяц и запущенные ресурсы. Поставить $5 на проект, где уже крутятся инстансы, не выйдет.
- Лимит можно поставить максимум на 10 проектов.
- Если 90 дней ничего не делать с остановленным проектом, AWS удаляет его данные навсегда.
Зато есть ранние меры, которые включаются отдельно и срабатывают по прогнозу. Примерно за 7 дней до лимита перестают запускаться новые ресурсы, за 5 дней ставятся на паузу простаивающие, за 4 дня самые дорогие из EC2, RDS, Lambda, Bedrock и SageMaker. Последняя мера как раз про «Lambda зациклилась» и «Bedrock внезапно разогнался».
Если у вас обычный аккаунт и новой кнопки нет, ближайший рабочий вариант это budget actions в AWS Budgets. На порог можно повесить действие: применить запрещающую IAM-политику или SCP, чтобы ничего нового не создавалось, или остановить конкретные инстансы EC2 и RDS. Это не потолок: Lambda, хранилище и всё, что не перечислено, продолжат тратить, а сами данные бюджета, напомним, опаздывают на 8–12 часов. Но для учебного аккаунта, где агент экспериментирует, лучше так, чем никак.
Google Cloud Spend Caps: четыре сервиса и ручное снятие
Google анонсировала Spend Caps 28 июля 2026. Это новый тип бюджета: в Budgets & alerts выбираете Create new budget, затем Spend cap enforcement вместо Alerts only, указываете проект, сервис и сумму. Существующий бюджет переделать в spend cap нельзя, только создать новый.
Ограничения превью жёсткие:
- Один бюджет это один проект и один сервис, период только месяц.
- Сервисов четыре: Gemini API, Gemini Enterprise Agent Platform (бывший Vertex AI), Cloud Run и Cloud Run functions.
- Блокируются только новые вызовы. Запросы, которые уже идут, доработают и будут оплачены. Постоянные ресурсы вроде вычислений и хранилища продолжают начисляться.
- Снять блокировку можно только вручную, кнопкой в консоли.
Для AI-сервисов Google обещает срабатывание в течение минут. Для агента, который развернул бэкенд на Cloud Run и ходит в Gemini API, это два бюджета, и их стоит завести оба.
Vercel и Supabase: переключатель, который надо включить самому
Здесь и находится главная ловушка формулировок. В сентябре 2025 Vercel объявила, что Spend Management включён по умолчанию для новых Pro-команд. Звучит как жёсткий лимит. Но в той же заметке написано, что деплои продолжат работать без перерыва, пока жёсткий лимит не настроен вручную. По умолчанию вы получаете письма на 50%, 75% и 100%.
Чтобы сумма реально останавливала расходы, в Settings → Billing → Spend Management нужно включить Pause Production Deployments. Тогда при достижении суммы Vercel остановит production всех проектов команды: сайты, API и функции станут недоступны, пока вы не включите каждый проект обратно. Проверка идёт раз в несколько минут, поэтому сам Vercel советует ставить сумму ниже той, которую вы готовы потерять. Spend Management доступен на Pro и на Enterprise с Flexible Commitment; на бесплатном Hobby проекты и так встают на паузу, когда кончаются бесплатные лимиты.
У Supabase Spend Cap есть на Pro и управляется в Cost Control на странице биллинга организации. Он закрывает диск, трафик, вызовы Edge Functions, активных пользователей и хранилище. Compute, реплики чтения, восстановление на момент времени и IPv4 он не закрывает: это то, что вы подключаете сознательно, и за это спишут в любом случае.
Чего не остановит ни один потолок
Мы прочитали шесть документаций подряд, и у трёх вендоров одна и та же фраза разными словами: срабатывание не мгновенное, перерасход оплачиваете вы. OpenAI пишет, что расход может слегка превысить лимит. Google советует ставить бюджет чуть ниже абсолютного предела и прямо говорит, что перерасход из-за задержки на вас. Vercel говорит про несколько минут задержки. Остальные об этом молчат, и мы бы не рассчитывали, что у них иначе. Жёсткий потолок ограничивает ущерб, но не обнуляет его.
Где пересказ сильнее документации
Фраза «AWS и Google Cloud запустили жёсткие лимиты» верна, но неполна. У AWS это новый опыт, который пока доступен не всем. У Google это превью на четыре сервиса, где постоянные ресурсы продолжают тарифицироваться. Прежде чем рассчитывать на потолок, откройте свою консоль и проверьте, есть ли там нужная кнопка.
Второе: потолок защищает от счёта, а не от того, что агент сделал. Он не отменит рассылку по чужим адресам и не закроет доступ, который агент открыл наружу. Как это выглядит, когда агент выходит за пределы песочницы, мы разбирали на инциденте с DNS в песочнице OpenAI.
И третье, специально для AWS: остановленный проект надо разморозить в течение 90 дней. Лимит, который спас вас от счёта, может через три месяца стоить вам данных, если про него забыть.
Что сделать до того, как агент получит ключ
Наше мнение, с которым можно спорить: ставить потолок нужно не на аккаунт целиком, а на отдельное место, где живёт агент. Мы ошибаемся, если у вас один продакшн-проект и агент работает только в нём: тогда отдельное место ничего не даст, и вопрос в том, готовы ли вы, что сайт ляжет на потолке.
- Отдельный проект или workspace под агента. Проект в OpenAI, workspace в Anthropic, проект в AWS или Google Cloud. Ключ агента выпускается только там, и лимит этого места меньше, чем вы готовы потерять за ночь.
- Потолок ниже предела. Лимиты срабатывают с задержкой. Если готовы потерять $100, ставьте $70–80. Сумму считайте от цены задачи, а не токена: почему они расходятся, видно из сравнения GPT-6 Sol и Opus 5.5 по стоимости задачи.
- Код останавливается на потолке, а не ретраит. Коды ошибок выше, обработка занимает несколько строк.
- Агент выбирает провайдера с потолком. Это идея самого Уиллисона: хорошо бы агенты сами советовали сервисы с жёстким лимитом и предупреждали новичков о сервисах без него. Пока этого нет, правило можно дописать в инструкции проекта, например в CLAUDE.md: «не разворачивай ничего платного без лимита расходов и сначала спроси».
Бюджет на уровне оркестратора, когда агенту выдают сумму на задачу, это другой слой защиты, и у него свои дыры: где он опаздывает, мы показали на разборе Paperclip. Потолок у провайдера срабатывает последним и поэтому нужен всегда.
Версии и цены на 4 октября 2026
Потолки тарифов Anthropic, пути в консолях и списки сервисов Google Cloud Spend Caps взяты из документации вендоров на 4 октября 2026. AWS spend limits и Google Spend Caps ещё раскатываются и в превью: интерфейс и ограничения будут меняться. Проверяйте свою консоль перед тем, как полагаться на лимит.
Источники12развернуть
- Simon Willison, «We're going to need default hard budget caps on pretty much everything», 3 октября 2026 — https://simonwillison.net/2026/Oct/3/default-hard-budget-caps/
- AWS, «New AWS experience helps builders get started and ship faster», 16 сентября 2026 — https://aws.amazon.com/about-aws/whats-new/2026/09/New-AWS-Builder-Experience/
- AWS Docs, «Create a spend limit in AWS Settings», проверено 4 октября 2026 — https://docs.aws.amazon.com/accounts/latest/reference/create-spend-limit.html
- AWS Docs, «Managing your costs with AWS Budgets» и «Configuring budget actions», проверено 4 октября 2026 — https://docs.aws.amazon.com/cost-management/latest/userguide/budgets-managing-costs.html
- Google Cloud, «New early anomalies and spend caps on Google Cloud Budgets», 28 июля 2026 — https://cloud.google.com/blog/topics/cost-management/new-early-anomalies-and-spend-caps-on-google-cloud-budgets
- Google Cloud Docs, «Spend cap budgets», проверено 4 октября 2026 — https://docs.cloud.google.com/billing/docs/how-to/budgets-spend-caps
- OpenAI, «Spend limits», проверено 4 октября 2026 — https://developers.openai.com/api/docs/guides/spend-limits
- OpenAI Developer Community, «Hard spend limits rolling out to all API Platform accounts», 23 июля 2026 — https://community.openai.com/t/hard-spend-limits-rolling-out-to-all-api-platform-accounts/1387914
- Anthropic, Claude Docs, «Rate limits», раздел Spend limits, проверено 4 октября 2026 — https://docs.claude.com/en/api/rate-limits
- Vercel Docs, «Spend Management», обновлено 18 сентября 2026 — https://vercel.com/docs/spend-management
- Vercel, «Spend Management now enabled by default on Pro», 9 сентября 2025 — https://vercel.com/changelog/spend-management-now-enabled-by-default-on-pro
- Supabase Docs, «Control your costs», проверено 4 октября 2026 — https://supabase.com/docs/guides/platform/cost-control
Читать дальше
Агентам выдали начальника, задачи и бюджет. Нужен ли он тем, кто уже работает в Claude Code?26 сентября 2026
Тревогу подняли через 12 минут, агента остановили через два с половиной часа. Что на самом деле сломалось в песочнице OpenAI?27 сентября 2026
GPT-6 Sol вдвое дешевле Opus 5.5 за токен. Почему за задачу разница всего 20%?26 сентября 2026
Комментарии