CodeariaAcademy
Обложка статьи: предмет, который сам обрывает расход, и надпись «Счёт без потолка»
4 октября 202613 мин чтенияAI-агентыAI-автоматизация

Счёт за модель у агента ограничен по умолчанию, а за сервер, который он выкатил, нет. Где включить жёсткий потолок?

API модели сам остановит агента на потолке тарифа, а облако, где агент выкатил сервис, обычно шлёт только письмо. Где включить жёсткий лимит и где он не спасёт.

В этой статье8
Коротко

Жёсткий лимит расходов отключает сервис, когда счёт доходит до заданной суммы; мягкий только присылает письмо. По умолчанию жёсткий потолок сейчас стоит у API моделей: у Anthropic он привязан к тарифу ($500 в месяц на Start), у OpenAI есть одобренный лимит по тарифу, а с 23 июля 2026 свой жёсткий лимит можно поставить на организацию и на каждый проект. В облаках, куда агент выкатывает результат, его надо включать руками, и везде с оговорками. AWS запустила spend limit на проект 16 сентября 2026, но только в новом опыте для ограниченного числа клиентов. Google Cloud Spend Caps с 28 июля в превью и работают для четырёх сервисов. Vercel по умолчанию шлёт только письма, паузу надо включить самому. И потолок срабатывает с задержкой: OpenAI, Google и Vercel прямо пишут, что перерасход за это время оплачиваете вы.

Никто не хочет проснуться от отправленного в полночь письма о превышении бюджета и узнать, что, пока он спал, вышедший из-под контроля сервис потратил ещё несколько сотен (или несколько тысяч) долларов.
Саймон Уиллисон · «We're going to need default hard budget caps on pretty much everything», 3 октября 2026, перевод наш

Пост Уиллисона короткий, и требование в нём одно: жёсткий лимит расходов должен стоять по умолчанию у любого сервиса с оплатой за использование. Снять его можно, но только явной галочкой «я понимаю, что сервис не отключат, и плачу за всё сверх». Повод он называет прямо: агенты сделали запуск кода почти бесплатным, а код, который запустили, умеет тратить деньги на платные API, хостинг, хранилище и вычисления.

Мы проверили, что из этого уже есть. Картина получилась странная. Потолок по умолчанию стоит ровно там, где агент думает: в API моделей. А там, куда агент выкатывает то, что написал, потолка по умолчанию нет нигде, и включается он с оговорками, которых нет в пересказах.

Мягкий лимит пишет письмо, жёсткий выключает сервис

Почти у каждого облака давно есть «бюджет». Это мягкий лимит: дошли до суммы, вам письмо. Сервис работает дальше, счёт растёт дальше.

Хуже то, что письмо опаздывает. В AWS Budgets данные обновляются до трёх раз в день, обычно через 8–12 часов после предыдущего обновления. За это время сервис, который агент развернул и забыл, успевает прожить половину суток без присмотра.

Жёсткий лимит работает иначе: дошли до суммы, сервис останавливается или API начинает отвечать ошибкой. Для бизнеса это больно, сайт лежит. Уиллисон отвечает на это так: большинство компаний и людей выберут ошибки, а не неожиданный счёт на $10 000. Мы с ним согласны, особенно для всего, что агент поднял в экспериментальном проекте.

Где жёсткий лимит расходов уже есть, а где только уведомление

Жёсткий потолок по умолчаниюЧто останавливаетсяГлавная оговорка
Anthropic APIДа, потолок тарифаAPI отвечает 429 до 1-го числаDefault workspace нельзя ограничить отдельно
OpenAI APIОдобренный лимит по тарифу; свой включается тумблеромAPI отвечает 429Срабатывает не мгновенно
AWSНетВесь проект на паузеТолько новый опыт, доступен не всем
Google CloudНетНовые вызовы одного сервисаПревью, 4 сервиса
VercelНет, только письмаProduction-деплои всех проектовПауза включается отдельно
SupabaseНе проверили; переключатель Spend Cap на ProИспользование сверх квоты планаCompute не покрывает

API моделей: лимит расходов в OpenAI и Anthropic

У Anthropic потолок стоит без вашего участия. У тарифов Start, Build и Scale месячный предел $500, $1 000 и $200 000. Дошли до него, и API останавливается до 00:00 UTC первого числа следующего месяца. Свой лимит можно поставить ниже потолка тарифа в Settings → Billing, раздел Spend limits. Там же, через workspaces, можно выдать отдельный лимит каждой группе ключей.

У OpenAI тоже есть одобренный месячный лимит по тарифу, а с недели 23 июля 2026 жёсткий лимит, который ставите вы сами, доступен всем аккаунтам. Его можно задать на всю организацию и на отдельный проект.

  1. 1

    OpenAI: организация

    Organization limits → Spend → Edit spend limit. Введите месячную сумму и включите Enforce a hard limit. Без этого тумблера сумма работает как обычное уведомление.

  2. 2

    OpenAI: проект

    Project settings → Limits → Spend → Edit spend limit, тот же тумблер Enforce a hard limit. Лимит проекта действует только на трафик, который оплачивается этим проектом.

  3. 3

    Anthropic: своя сумма

    Settings → Billing → Spend limits → Set limit или Adjust limit. Выше потолка вашего тарифа поставить нельзя.

  4. 4

    Anthropic: отдельный workspace под агента

    Создайте workspace, задайте ему свой лимит расходов и выпустите ключ агента там. На default workspace отдельный лимит поставить нельзя.

Самое полезное в документации обоих вендоров это коды ошибок. Агент, который упёрся в лимит, увидит 429, и SDK по умолчанию будет повторять запрос. У Anthropic на потолке тарифа нет заголовка retry-after, и повторы ничего не дадут до начала следующего месяца. Отличить потолок от обычного rate limit можно только по коду:

как выглядит потолок в ответе API
# Anthropic, потолок тарифа: HTTP 429
error.type = rate_limit_error
error.details.error_code = enforced_spend_limit_reached
# Anthropic, ваш собственный лимит: HTTP 400
error.type = invalid_request_error
"You have reached your specified API usage limits..."
# OpenAI: HTTP 429
error.code = organization_spend_limit_exceeded
error.code = project_spend_limit_exceeded

Если агент работает по расписанию, научите его обработчик различать эти коды и останавливаться, а не ретраить. Иначе вы узнаете о потолке из логов, где тысяча одинаковых ошибок.

AWS: spend limit для новых проектов и budget actions для старых аккаунтов

16 сентября AWS объявила новый опыт для разработчиков, и в нём наконец появился лимит, который останавливает расходы. Он ставится на проект: AWS Settings → Billing → Cost by project → Set limit. Дошли до суммы, AWS ставит проект на паузу и останавливает все его ресурсы до конца месяца. Данные сохраняются.

Оговорок больше, чем в анонсе.

  • Попробовать новый опыт AWS предлагает через создание нового аккаунта, а в документации прямо написано, что он раскатывается на ограниченное число клиентов. Уиллисон тоже это заметил и надеется на общий доступ.
  • Нужен платный план. Минимальный лимит это большее из $20 и консервативной оценки ваших расходов, а оценка учитывает прошлый месяц и запущенные ресурсы. Поставить $5 на проект, где уже крутятся инстансы, не выйдет.
  • Лимит можно поставить максимум на 10 проектов.
  • Если 90 дней ничего не делать с остановленным проектом, AWS удаляет его данные навсегда.

Зато есть ранние меры, которые включаются отдельно и срабатывают по прогнозу. Примерно за 7 дней до лимита перестают запускаться новые ресурсы, за 5 дней ставятся на паузу простаивающие, за 4 дня самые дорогие из EC2, RDS, Lambda, Bedrock и SageMaker. Последняя мера как раз про «Lambda зациклилась» и «Bedrock внезапно разогнался».

Если у вас обычный аккаунт и новой кнопки нет, ближайший рабочий вариант это budget actions в AWS Budgets. На порог можно повесить действие: применить запрещающую IAM-политику или SCP, чтобы ничего нового не создавалось, или остановить конкретные инстансы EC2 и RDS. Это не потолок: Lambda, хранилище и всё, что не перечислено, продолжат тратить, а сами данные бюджета, напомним, опаздывают на 8–12 часов. Но для учебного аккаунта, где агент экспериментирует, лучше так, чем никак.

Google Cloud Spend Caps: четыре сервиса и ручное снятие

Google анонсировала Spend Caps 28 июля 2026. Это новый тип бюджета: в Budgets & alerts выбираете Create new budget, затем Spend cap enforcement вместо Alerts only, указываете проект, сервис и сумму. Существующий бюджет переделать в spend cap нельзя, только создать новый.

Создание бюджета в Google Cloud: жёсткий режим выбирается на первом шаге, и рядом честно стоит Preview. Скриншот из блога Google Cloud, 28 июля 2026

Ограничения превью жёсткие:

  • Один бюджет это один проект и один сервис, период только месяц.
  • Сервисов четыре: Gemini API, Gemini Enterprise Agent Platform (бывший Vertex AI), Cloud Run и Cloud Run functions.
  • Блокируются только новые вызовы. Запросы, которые уже идут, доработают и будут оплачены. Постоянные ресурсы вроде вычислений и хранилища продолжают начисляться.
  • Снять блокировку можно только вручную, кнопкой в консоли.

Для AI-сервисов Google обещает срабатывание в течение минут. Для агента, который развернул бэкенд на Cloud Run и ходит в Gemini API, это два бюджета, и их стоит завести оба.

Vercel и Supabase: переключатель, который надо включить самому

Здесь и находится главная ловушка формулировок. В сентябре 2025 Vercel объявила, что Spend Management включён по умолчанию для новых Pro-команд. Звучит как жёсткий лимит. Но в той же заметке написано, что деплои продолжат работать без перерыва, пока жёсткий лимит не настроен вручную. По умолчанию вы получаете письма на 50%, 75% и 100%.

Чтобы сумма реально останавливала расходы, в Settings → Billing → Spend Management нужно включить Pause Production Deployments. Тогда при достижении суммы Vercel остановит production всех проектов команды: сайты, API и функции станут недоступны, пока вы не включите каждый проект обратно. Проверка идёт раз в несколько минут, поэтому сам Vercel советует ставить сумму ниже той, которую вы готовы потерять. Spend Management доступен на Pro и на Enterprise с Flexible Commitment; на бесплатном Hobby проекты и так встают на паузу, когда кончаются бесплатные лимиты.

У Supabase Spend Cap есть на Pro и управляется в Cost Control на странице биллинга организации. Он закрывает диск, трафик, вызовы Edge Functions, активных пользователей и хранилище. Compute, реплики чтения, восстановление на момент времени и IPv4 он не закрывает: это то, что вы подключаете сознательно, и за это спишут в любом случае.

Чего не остановит ни один потолок

Мы прочитали шесть документаций подряд, и у трёх вендоров одна и та же фраза разными словами: срабатывание не мгновенное, перерасход оплачиваете вы. OpenAI пишет, что расход может слегка превысить лимит. Google советует ставить бюджет чуть ниже абсолютного предела и прямо говорит, что перерасход из-за задержки на вас. Vercel говорит про несколько минут задержки. Остальные об этом молчат, и мы бы не рассчитывали, что у них иначе. Жёсткий потолок ограничивает ущерб, но не обнуляет его.

Где пересказ сильнее документации

Фраза «AWS и Google Cloud запустили жёсткие лимиты» верна, но неполна. У AWS это новый опыт, который пока доступен не всем. У Google это превью на четыре сервиса, где постоянные ресурсы продолжают тарифицироваться. Прежде чем рассчитывать на потолок, откройте свою консоль и проверьте, есть ли там нужная кнопка.

Второе: потолок защищает от счёта, а не от того, что агент сделал. Он не отменит рассылку по чужим адресам и не закроет доступ, который агент открыл наружу. Как это выглядит, когда агент выходит за пределы песочницы, мы разбирали на инциденте с DNS в песочнице OpenAI.

И третье, специально для AWS: остановленный проект надо разморозить в течение 90 дней. Лимит, который спас вас от счёта, может через три месяца стоить вам данных, если про него забыть.

Что сделать до того, как агент получит ключ

Наше мнение, с которым можно спорить: ставить потолок нужно не на аккаунт целиком, а на отдельное место, где живёт агент. Мы ошибаемся, если у вас один продакшн-проект и агент работает только в нём: тогда отдельное место ничего не даст, и вопрос в том, готовы ли вы, что сайт ляжет на потолке.

  1. Отдельный проект или workspace под агента. Проект в OpenAI, workspace в Anthropic, проект в AWS или Google Cloud. Ключ агента выпускается только там, и лимит этого места меньше, чем вы готовы потерять за ночь.
  2. Потолок ниже предела. Лимиты срабатывают с задержкой. Если готовы потерять $100, ставьте $70–80. Сумму считайте от цены задачи, а не токена: почему они расходятся, видно из сравнения GPT-6 Sol и Opus 5.5 по стоимости задачи.
  3. Код останавливается на потолке, а не ретраит. Коды ошибок выше, обработка занимает несколько строк.
  4. Агент выбирает провайдера с потолком. Это идея самого Уиллисона: хорошо бы агенты сами советовали сервисы с жёстким лимитом и предупреждали новичков о сервисах без него. Пока этого нет, правило можно дописать в инструкции проекта, например в CLAUDE.md: «не разворачивай ничего платного без лимита расходов и сначала спроси».

Бюджет на уровне оркестратора, когда агенту выдают сумму на задачу, это другой слой защиты, и у него свои дыры: где он опаздывает, мы показали на разборе Paperclip. Потолок у провайдера срабатывает последним и поэтому нужен всегда.

Версии и цены на 4 октября 2026

Потолки тарифов Anthropic, пути в консолях и списки сервисов Google Cloud Spend Caps взяты из документации вендоров на 4 октября 2026. AWS spend limits и Google Spend Caps ещё раскатываются и в превью: интерфейс и ограничения будут меняться. Проверяйте свою консоль перед тем, как полагаться на лимит.

Источники12развернуть
  1. Simon Willison, «We're going to need default hard budget caps on pretty much everything», 3 октября 2026 — https://simonwillison.net/2026/Oct/3/default-hard-budget-caps/
  2. AWS, «New AWS experience helps builders get started and ship faster», 16 сентября 2026 — https://aws.amazon.com/about-aws/whats-new/2026/09/New-AWS-Builder-Experience/
  3. AWS Docs, «Create a spend limit in AWS Settings», проверено 4 октября 2026 — https://docs.aws.amazon.com/accounts/latest/reference/create-spend-limit.html
  4. AWS Docs, «Managing your costs with AWS Budgets» и «Configuring budget actions», проверено 4 октября 2026 — https://docs.aws.amazon.com/cost-management/latest/userguide/budgets-managing-costs.html
  5. Google Cloud, «New early anomalies and spend caps on Google Cloud Budgets», 28 июля 2026 — https://cloud.google.com/blog/topics/cost-management/new-early-anomalies-and-spend-caps-on-google-cloud-budgets
  6. Google Cloud Docs, «Spend cap budgets», проверено 4 октября 2026 — https://docs.cloud.google.com/billing/docs/how-to/budgets-spend-caps
  7. OpenAI, «Spend limits», проверено 4 октября 2026 — https://developers.openai.com/api/docs/guides/spend-limits
  8. OpenAI Developer Community, «Hard spend limits rolling out to all API Platform accounts», 23 июля 2026 — https://community.openai.com/t/hard-spend-limits-rolling-out-to-all-api-platform-accounts/1387914
  9. Anthropic, Claude Docs, «Rate limits», раздел Spend limits, проверено 4 октября 2026 — https://docs.claude.com/en/api/rate-limits
  10. Vercel Docs, «Spend Management», обновлено 18 сентября 2026 — https://vercel.com/docs/spend-management
  11. Vercel, «Spend Management now enabled by default on Pro», 9 сентября 2025 — https://vercel.com/changelog/spend-management-now-enabled-by-default-on-pro
  12. Supabase Docs, «Control your costs», проверено 4 октября 2026 — https://supabase.com/docs/guides/platform/cost-control

Комментарии