Limity wydatków w chmurze powinny działać domyślnie i twardo odcinać usługę po przekroczeniu budżetu. Z takim postulatem wystąpił 3 października Simon Willison, programista i autor jednego z najczęściej czytanych blogów o narzędziach LLM. Jego argument jest prosty: agenci kodujący sprawiają, że postawienie płatnej usługi zajmuje minuty, a rachunek może rosnąć szybciej, niż ktokolwiek to zauważy.
Willison odróżnia limity miękkie od twardych. Miękki limit to e-mail z ostrzeżeniem, który łatwo przeoczyć. Twardy limit oznacza, że po przekroczeniu ustalonej kwoty usługa przestaje działać i zwraca błędy. Jego zdaniem właśnie to powinno być ustawieniem domyślnym, a wyłączenie zabezpieczenia powinno wymagać świadomej decyzji osoby gotowej przyjąć ryzyko. Idzie też dalej: sami agenci AI powinni polecać dostawców z twardymi limitami i ostrzegać mniej doświadczonych twórców przed wdrażaniem aplikacji tam, gdzie takiej ochrony nie ma.
Chmury wprowadzają twarde limity wydatków
Rynek już przesuwa się w tę stronę. Google Cloud w lipcu 2026 roku udostępnił Spend Caps, czyli miesięczne limity kwotowe dla wybranych usług w projekcie. We wrześniu własne limity wydatków uruchomił AWS. Według dokumentacji Amazona limit ustawia się na poziomie projektu, a po jego osiągnięciu AWS wstrzymuje projekt i zatrzymuje zasoby. Dane zostają zachowane, ale jeśli właściciel nie zareaguje w ciągu 90 dni, zostaną trwale usunięte.
Rozwiązanie AWS ma kilka istotnych szczegółów:
- Minimalny limit to wyższa z dwóch wartości: 20 dolarów albo ostrożny szacunek bieżących wydatków.
- Powiadomienia przychodzą przy 50, 75 i 90 procentach limitu oraz wtedy, gdy prognoza wskazuje jego przekroczenie w ciągu 10 dni.
- Opcjonalne wczesne hamulce: około 7 dni przed limitem blokada nowych zasobów, około 5 dni przed nim pauza bezczynnych instancji, a około 4 dni przed nim wstrzymanie największych źródeł kosztów, w tym Lambdy i Bedrocka.
- Ograniczenia: funkcja trafia na razie do części klientów, wymaga płatnego planu i obejmuje maksymalnie 10 projektów.
Sam AWS opisuje limity jako narzędzie przede wszystkim do eksperymentów, nauki i środowisk testowych. W produkcji mają sens tam, gdzie krótka przerwa w działaniu jest akceptowalną ceną za ochronę przed nieoczekiwanym rachunkiem.
Co limity wydatków w chmurze znaczą dla polskich firm
W wielu organizacjach z agentów kodujących korzystają już nie tylko programiści, ale też analitycy, marketerzy i zespoły operacyjne. Prototyp postawiony w piątek po południu może przez cały weekend generować koszty, o których nikt nie wie. Dotyczy to zwłaszcza wywołań modeli AI w pętli oraz zasobów, które ktoś uruchomił i zapomniał wyłączyć.
Wnioski praktyczne są proste. Warto oddzielić projekty eksperymentalne od produkcyjnych i na tych pierwszych ustawić twardy limit. Dobrze też przypisać każdemu projektowi właściciela odpowiedzialnego za koszty i sprawdzić, czy używane API modeli językowych oferują limity, czy tylko alerty. Twardy limit nie zastąpi nadzoru człowieka, ale skutecznie ogranicza skalę pomyłki. To ta sama logika, którą stosuje się przy uprawnieniach: zaczynamy od minimum i rozszerzamy świadomie.
Źródło: Simon Willison, „We're going to need default hard budget caps on pretty much everything” (EN), 3 października 2026; AWS: dokumentacja limitów wydatków (EN).



