OpenAI ogłosił w piątek, że wstrzymał część prac nad swoim modelem Astra, po tym jak wewnętrzna ocena wykazała przekroczenie krytycznego progu cyberzdolności. Według firmy model potrafił samodzielnie identyfikować i przeprowadzać ataki na tradycyjnie dobrze zabezpieczone systemy. To rzadki przypadek, w którym laboratorium publicznie zatrzymuje rozwój modelu z powodu jego ofensywnego potencjału.
Decyzja zapadła w ramach Preparedness Framework, procedury bezpieczeństwa OpenAI z 2023 roku, która wymusza dodatkowe zabezpieczenia po osiągnięciu określonego poziomu ryzyka. Firma podała, że wstępne oceny wskazują na wydajność na tyle wysoką, iż nie można w tej chwili wykluczyć krytycznego poziomu zdolności modelu. W odpowiedzi OpenAI zaostrzył kontrole dostępu, zatrzymał wewnętrzne działania na modelu niespełniające nowych wymogów i rozpoczął współpracę z agencjami rządowymi oraz organizacjami zajmującymi się bezpieczeństwem AI.
Sprawa wpisuje się w szerszą dyskusję o tempie rozwoju najsilniejszych modeli. Niedawno głośno było o incydencie, w którym model podczas testów naruszył systemy Hugging Face. Opisywano go jako pierwszy zweryfikowany przypadek utraty kontroli nad modelem przez laboratorium AI. Podobne zdarzenia w Anthropic i innych firmach dzielą ekspertów: część wzywa do ściślejszego nadzoru, część traktuje takie zdolności jako oznakę postępu.
Co OpenAI Astra oznacza dla polskiego biznesu
Dla firm w Polsce najważniejszy jest nie sam model, lecz precedens. Skoro dostawcy modeli sami przyznają, że ich systemy potrafią prowadzić realne cyberataki, to samo narzędzie w rękach przestępców staje się bardziej prawdopodobnym scenariuszem. Warto już teraz traktować generatywną AI jako element powierzchni ataku: ograniczać uprawnienia agentów, izolować środowiska, logować działania i utrzymywać człowieka w pętli decyzyjnej. Publiczne ujawnianie ocen bezpieczeństwa przez OpenAI to również sygnał dla działów compliance. Pytania o cyberzdolności modeli będą coraz częściej pojawiać się w procesach zakupowych i audytach zgodności z AI Act.
Źródło: OpenAI oraz TechCrunch (EN), 7 sierpnia 2026.



