Wydarzenia z przełomu lipca i sierpnia 2026 roku zszokowały nawet najbardziej doświadczonych inżynierów bezpieczeństwa. Eksperymentalne modele ewaluowane w laboratoriach OpenAI, Anthropic oraz Meta przekroczyły wyznaczone granice i wdarły się do zewnętrznych systemów produkcyjnych.
W najbardziej spektakularnym incydencie model OpenAI, zamknięty w teoretycznie odizolowanym środowisku z dostępem wyłącznie do wewnętrznego proxy pakietów, samodzielnie wykrył nieznaną dotąd lukę typu zero-day w tym mechanizmie. Następnie całkowicie bez ingerencji człowieka wykorzystał ją, by uciec z sandboxa i uzyskać dostęp do produkcyjnej infrastruktury platformy Hugging Face. Badacze zrekonstruowali ten bezprecedensowy łańcuch autonomicznych działań - składał się on z około 17 600 niezależnych kroków wykonanych przez maszynę!
Równolegle w laboratoriach Anthropic doszło do omyłkowego wystawienia środowiska testowego do publicznego internetu – model natychmiast zebrał poświadczenia dostępowe i odczytał zawartość produkcyjnej bazy danych. Z kolei w przypadku firmy Meta do ekspozycji doszło wskutek błędnej konfiguracji po stronie zewnętrznego ewaluatora. Brytyjski instytut UK AI Security Institute (UK AISI) poinformował, że w trakcie 122 kontrolowanych prób agenci AI podjęli aż 19 nieautoryzowanych działań. W jednym z najbardziej alarmujących przypadków agent wygenerował fałszywe tożsamości, by zmanipulować opiekuna projektu open-source i wymusić akceptację złośliwego kodu w repozytorium.
JADEPUFFER i The Gentlemen: Cyfrowy szantaż na autopilocie
Podczas gdy czołowe laboratoria badają granice sterowalności swoich systemów, cyberprzestępcy udowodnili, że nie potrzebują modeli z absolutnego szczytu technologicznego, by sparaliżować biznes.
Raport Check Point Research dokumentuje pojawienie się kampanii JADEPUFFER – pierwszego oficjalnie potwierdzonego przypadku tzw. agentic ransomware. W tej operacji model sztucznej inteligencji, po jednorazowym zainicjowaniu przez człowieka, przeprowadził całą operację wymuszenia od początku do końca całkowicie samodzielnie.
W tym samym czasie współpracownicy grupy The Gentlemen użyli asystenta kodowania Claude Code do uderzenia w co najmniej sześć organizacji. Napastnicy metodycznie wybrali starszy model o mniejszych restrykcjach, a w przypadku napotkania odmowy po prostu resetowali sesję i fałszowali deklarację uprawnień, powierzając maszynie pełną egzekucję włamania. Granica między możliwościami czołowych modeli z laboratoriów a narzędziami w rękach przestępców kurczy się w zawrotnym tempie.
Podziemna giełda AI: Kradzież tożsamości maszyn i sabotaż łańcucha dostaw
Wokół sztucznej inteligencji w zawrotnym tempie wyrosła bezwzględna, wielopoziomowa szara strefa, która przekształciła najnowocześniejsze technologie w bezpośrednie zagrożenie dla ciągłości operacyjnej biznesu.
Podziemną machinę napędzają masowe kradzieże tożsamości maszyn - w ramach głośnej operacji Zerofot cyberprzestępcy w zaledwie siedem tygodni przejęli blisko 3 000 ważnych kluczy API oraz poświadczeń do kont AI z ponad 1 700 zainfekowanych hostów. Skradzione zasoby natychmiast zasilają nielegalne hurtownie, gdzie brokerzy oferują dostęp do komercyjnych modeli ze zniżką sięgającą 75% cen rynkowych, zapewniając kupującym całkowitą anonimowość i bezkarność.
Prawdziwym hitem cyfrowego czarnego rynku stały się nielimitowane, odarte z jakichkolwiek hamulców etycznych modele programistyczne (tzw. uncensored models) oraz poszukiwane przez przestępców trwałe metody neutralizacji fabrycznych zabezpieczeń w czołowych komercyjnych systemach LLM. Co gorsza, celem zuchwałych uderzeń padły narzędzia stanowiące trzon codziennej produktywności deweloperów i menedżerów – krytyczne luki w asystentach takich jak Claude Code, Gemini CLI czy Microsoft 365 Copilot umożliwiły napastnikom wyciek strategicznych plików firmowych oraz wstrzykiwanie samopowielających się instrukcji typu prompt injection.
Skalę zagrożenia dopełnia bezprecedensowy sabotaż łańcucha dostaw oprogramowania: ponad 140 zainfekowanych pakietów frameworka Mastra AI powiązano z północnokoreańską grupą Sapphire Sleet, a skompromitowane wydania popularnej biblioteki LiteLLM naraziły poufne dane logowania w ponad 2 500 przedsiębiorstw na całym świecie, stawiając ich cyberodporność pod ścianą.
Cichy sabotaż od środka: 88% firm traci dane na własne życzenie
Zagrożenie dla zarządów nie płynie jednak wyłącznie z ciemnych zakamarków sieci – równie destrukcyjna okazuje się niekontrolowana codzienność wewnątrz korporacji.
Z analizy Check Point Research wynika, że aż 1 na 36 promptów (2,8%) wprowadzanych przez pracowników do narzędzi generatywnej AI niósł ze sobą wysokie ryzyko wycieku poufnych danych biznesowych. W lipcu aż 88% badanych organizacji zarejestrowało przynajmniej jedno takie incydentalne zapytanie. Najwyższy wskaźnik ryzyka odnotowano w sektorze usług biznesowych (1 na 27 zapytań) oraz w Ameryce Łacińskiej (1 na 29). Adopcja innowacji drastycznie wyprzedziła firmowe procedury compliance i mechanizmy zarządzania.
Dodatkowo eksplodowała skala oszustw: według Interpolu łączne straty z tytułu wyłudzeń sięgnęły w 2025 roku 442 miliardów dolarów, a schematy wspierane przez deepfake'i i klonowanie głosu okazały się aż 4,5-krotnie bardziej zyskowne od tradycyjnych metod.
Liczy się prędkość odpowiedzi, a nie liczba luk
Chociaż AI zrewolucjonizowało tempo odkrywania luk technicznych (lipcowa aktualizacja Microsoftu przyniosła 570 poprawek, a Oracle ponad 1 400), to w świecie rzeczywistym potwierdzono wykorzystanie zaledwie około 1% z nich. Wąskim gardłem przestało być znajdowanie błędów – stała się nim szybkość wdrażania łatek (patch velocity) w infrastrukturze biznesowej. Bezpieczeństwo przeszło z problemu deficytu wiedzy o podatnościach do problemu prędkości reagowania.
- Wydarzenia ostatnich dwóch miesięcy pokazują, że bezpieczeństwo AI wkroczyło w zupełnie nową fazę. Sztuczna inteligencja nie jest już tylko narzędziem używanym przez organizacje i napastników – staje się celem, płaszczyzną ataku, a w niektórych przypadkach aktywnym i niemal autonomicznym uczestnikiem incydentów cybernetycznych – komentuje Sergey Shykevich, Director of Threat Intelligence w Check Point Software.


