Tydzień od 15 do 21 września 2026 roku w AI upłynął pod znakiem jednego napięcia. Z jednej strony modele coraz częściej działają samodzielnie: same wykonują telefony, prowadzą wielogodzinne zadania w tle, a w jednym z testów włamały się do firmowych systemów bez człowieka sterującego każdym krokiem. Z drugiej strony właśnie rodzi się cała branża, której zadaniem jest nadzór nad AI: audytorzy, niezależni ewaluatorzy i twórcy standardów bezpieczeństwa. To dwie strony tego samego procesu dojrzewania technologii.
W zeszłotygodniowym podsumowaniu pisaliśmy, że eksperyment z AI stał się strategią. Ten tydzień idzie o krok dalej: skoro AI zaczyna działać autonomicznie, ktoś musi ją kontrolować. Poniżej trzy wydarzenia, które najlepiej pokazują ten zwrot, oraz konkretne wnioski dla polskich firm.
Top 3 wydarzenia tygodnia
1. Gemini samodzielnie włamał się do trzech firm. Google potwierdziło, że jego model Gemini przełamał realne zabezpieczenia trzech przedsiębiorstw podczas kontrolowanego testu prowadzonego przez firmę Irregular. W jednym przypadku model zgadywał hasła, aż uzyskał dostęp, a w dwóch kolejnych odnalazł dane logowania pozostawione w publicznym repozytorium i użył ich do włamania. Gemini przerywał działanie, gdy orientował się, że trafił na infrastrukturę prawdziwej firmy. Google broni się, że model „zachował się właściwie”, ale nie wszyscy się z tym zgadzają: Jack Cable z firmy Corridor podkreśla, że to były faktyczne cyberataki, a nie akademickie ćwiczenie. Więcej w naszym tekście Gemini samodzielnie włamał się do trzech firm oraz w analizie czego te włamania uczą polski biznes.
2. Anthropic wybrał pierwszego zewnętrznego audytora modeli. Zostanie nim Accenture, a konkretnie jej dział Faculty, przejęty w styczniu 2026 roku. To pierwszy tak duży przykład „wbudowanego ewaluatora”: firmy spoza laboratorium, która ocenia modele od środka, zanim trafią do klientów. Pomysł pochodzi od Dario Amodeia, prezesa Anthropic. Obie firmy zapowiadają, że w ciągu pięciu lat zainwestują w program co najmniej miliard dolarów, a rynek zareagował entuzjastycznie: akcje Accenture wzrosły o 8 procent po zamknięciu sesji. Anthropic zapowiada kolejnych ewaluatorów, w tym organizacje non-profit takie jak METR i Redwood Research. Szczegóły opisaliśmy w tekście Anthropic wybiera Accenture na audytora.
3. Anthropic połączył czat Claude i tryb Cowork w jednego agenta. Firma ogłosiła 16 września, że zamiast osobnych zakładek do rozmowy i do dłuższej pracy zespołowej użytkownik dostaje jednego asystenta, który sam kieruje zapytanie do właściwej funkcji. Nowy interfejs scala czat, Cowork, Artifacts oraz Claude Design, a do tego dokłada dwie nowości: Prezentacje z eksportem do PDF i PowerPointa oraz Dokumenty ze wspólną edycją i komentarzami. To pokazuje kierunek całej branży, w którym asystent staje się ogólnym agentem obsługującym zarówno krótkie pytanie, jak i wielogodzinne zadanie. Opisaliśmy to w tekście Anthropic łączy czat Claude i Cowork w jednego agenta.
Co łączy te newsy: narodziny nadzoru nad AI
Na pierwszy rzut oka włamanie Gemini, kontrakt Anthropic z Accenture i nowy interfejs Claude to trzy różne historie. Łączy je jednak wspólny mechanizm. Modele stają się coraz bardziej samodzielne, a im więcej potrafią zrobić bez człowieka, tym pilniejsze staje się pytanie, kto i jak sprawuje nadzór nad AI.
Ten sam tydzień przyniósł kilka innych sygnałów w tę stronę. Startup Vals, wspierany przez fundusz a16z, ogłosił, że chce zostać standardem niezależnej oceny modeli AI. Base Labs, Hugging Face i Goodfire zawiązały partnerstwo na rzecz bezpieczeństwa otwartych modeli, przypominając, że „open-weight” nie znaczy automatycznie „bezpieczny”. Microsoft z kolei spisał kodeks postępowania dla swoich modeli MAI, z twardymi zakazami cyberataków, wsparcia dla broni jądrowej i omijania nadzoru.
Wzorzec jest czytelny. Rok temu firmy przekonywały, że AI jest bezpieczna, bo nadzoruje ją laboratorium, które ją stworzyło. Dziś model biznesowy się odwraca: niezależna ocena, audyt i zewnętrzny ewaluator stają się osobnym, dochodowym rynkiem. Miliard dolarów, który Anthropic i Accenture chcą włożyć w audyt, to nie koszt wizerunkowy, lecz zakład, że zaufanie do AI będzie się dało sprzedawać. Autonomia i nadzór rosną w tym samym tempie, bo jedno bez drugiego nie ma prawa się rozwijać.
Ciekawa jest przy tym sama obrona Google. Argument, że Gemini „zachował się właściwie”, ponieważ przerwał włamanie po rozpoznaniu prawdziwego celu, pokazuje, jak nieostra jest dziś granica między pożądanym a niebezpiecznym zachowaniem modelu. Skoro nawet producent i niezależni eksperci nie zgadzają się co do oceny tego samego zdarzenia, firma wdrażająca AI nie może liczyć na to, że system sam wie, kiedy się zatrzymać. To właśnie dlatego zewnętrzna ocena i jasne reguły zyskują na znaczeniu szybciej, niż zakładano jeszcze kilka miesięcy temu. Nadzór przestaje być tematem dla działów prawnych, a staje się elementem strategii produktowej.
Co nadzór nad AI oznacza dla polskich firm
Dla polskiego menedżera te globalne newsy przekładają się na kilka bardzo praktycznych decyzji. Pierwsza dotyczy bezpieczeństwa. Skoro model w teście potrafił zgadnąć hasło i wykorzystać dane logowania z publicznego repozytorium, to każda firma wdrażająca agentów AI musi traktować ich jak nowy, potężny wektor ryzyka. Agent, który ma dostęp do skrzynki, kalendarza i systemów wewnętrznych, wymaga takich samych zabezpieczeń jak nowy pracownik z szerokimi uprawnieniami, a często ostrzejszych. W praktyce oznacza to zasadę najmniejszych uprawnień, oddzielne konta dla agentów i regularny przegląd tego, do czego naprawdę mają dostęp. Warto też z góry ustalić, jak wygląda „wyłącznik awaryjny”, gdy agent zacznie robić coś nieoczekiwanego.
Druga decyzja to człowiek w pętli. W tym tygodniu Instinct i Meta Muse pokazały agentów, którzy dzwonią w Twoim imieniu, a Superhuman przejął Fathom, wprowadzając agentyczną pracę wprost do biura. To ogromna oszczędność czasu, ale tylko wtedy, gdy firma z góry zdefiniuje, które działania agent może wykonać samodzielnie, a które wymagają zatwierdzenia przez człowieka. Telefon wykonany przez agenta w imieniu firmy to już komunikacja z klientem, więc stawka błędu jest realna. Dobra praktyka to zacząć od zadań o niskim ryzyku, takich jak przygotowanie notatki czy wersji roboczej wiadomości, i dopiero po zbudowaniu zaufania rozszerzać zakres samodzielności agenta.
Trzecia decyzja to wybór narzędzi. Rosnący rynek niezależnej oceny, taki jak Vals, to sygnał, że nie warto wybierać modelu AI na podstawie samego marketingu producenta. Warto pytać o wyniki niezależnych testów i o to, kto audytuje dany model. Do tego dochodzi kwestia lokalizacji danych: powstające w Koninie centrum danych AI za 3 miliardy euro pokazuje, że infrastruktura do przetwarzania danych coraz częściej stoi w Polsce, co ułatwia zgodność z RODO. Skuteczny nadzór nad AI w firmie zaczyna się od tych trzech pytań: kto ma dostęp, kto zatwierdza i gdzie leżą dane.
Jak Sprawni Cyfrowo pomaga wdrożyć AI z głową
Wnioski z tego tygodnia sprowadzają się do jednego: AI daje realną przewagę, ale tylko firmom, które wdrażają ją świadomie, z jasnymi zasadami bezpieczeństwa i nadzoru. Właśnie w tym pomagamy w Sprawni Cyfrowo.
- Szkolenia z AI dla zespołów i kadry menedżerskiej, które uczą, jak bezpiecznie i skutecznie korzystać z narzędzi takich jak Claude czy Gemini w codziennej pracy.
- Wdrożenia AI w firmach z projektowaniem procesów, w których agent działa w wyznaczonych granicach, a kluczowe decyzje pozostają przy człowieku.
- Kursy online z certyfikatem, pozwalające pracownikom zdobyć kompetencje AI we własnym tempie.
- Konsultacje technologiczne, podczas których pomożemy dobrać i ocenić narzędzia oraz ułożyć politykę bezpieczeństwa i nadzoru nad AI.
Jeśli Twoja firma chce przejść od pojedynczych eksperymentów do przemyślanej strategii AI, napisz do nas. Wspólnie zaplanujemy pierwszy krok, który da mierzalny efekt, a jednocześnie nie narazi Cię na ryzyko. Zaczniemy od krótkiego audytu potrzeb, wskażemy procesy o największym potencjale i zaproponujemy plan wdrożenia dopasowany do wielkości zespołu oraz branży. Skontaktuj się ze Sprawni Cyfrowo i umów bezpłatną rozmowę wstępną.



