Słyszeliśmy o agentach sztucznej inteligencji OpenAI , którzy szaleli i hakowali inne firmy . Teraz firma zajmująca się cyberbezpieczeństwem odwróciła sytuację od operatora ChatGPT, wykorzystując sztuczną inteligencję do pomocy w hakowaniu samego OpenAI.
Atak, który ujawnił również błąd w dziesiątkach innych popularnych serwisów internetowych, został przeprowadzony w ramach badań bezpieczeństwa. OpenAI zapłaciło badaczom za zgłoszenie luki w swoich systemach w ramach programu Bug Bounty.
Badacze z firmy Hacktron, dostawcy narzędzi do cyberbezpieczeństwa, opisali swoje przygody w połowie września. Kilka miesięcy wcześniej rozpoczęli poszukiwania luk w zabezpieczeniach w firmach opracowujących pionierskie modele sztucznej inteligencji, czyli wysoce wydajne modele, takie jak te, które napędzają ChatGPT i Claude.
Korzystając z oprogramowania Claude firmy Anthropic, badacze przeszli od badania luki w przetwarzaniu obrazu do uzyskania dostępu do wewnętrznego repozytorium oprogramowania OpenAI w niecałe 72 godziny. Celowo unikali przeglądania poufnych informacji.
Aby wniknąć do OpenAI, badacze Harsh Jaiswal, Mohan Pedhapati i Rahul Maini znaleźli dwie luki w zabezpieczeniach i połączyli je ze sobą. Pierwsza nie była specyficzna dla OpenAI. Dotyczyła błędu w funkcji przesyłania obrazów w oprogramowaniu forum społeczności Discourse.
Ta funkcja przetwarza obrazy przesyłane przez użytkowników i opiera się na bibliotece oprogramowania niskiego poziomu o nazwie libheif. Przesłanie specjalnie spreparowanego obrazu może spowodować lukę w bibliotece, umożliwiając atakującemu przejęcie kontroli nad serwerem Discourse.
Po tym, jak Hacktron wykorzystał tę lukę do włamania się na serwer Discourse firmy OpenAI, pojawiła się druga luka. Była to wada systemu jednokrotnego logowania (SSO) OpenAI, który umożliwiał użytkownikom dostęp do jednej usługi za pomocą konta innej usługi.
Luka w SSO umożliwiła Hacktronowi dostęp do kont ChatGPT i Codex osób, które zalogowały się na forum Discourse OpenAI. OpenAI wykorzystuje forum do wsparcia społeczności, co potencjalnie obejmowało dużą liczbę kont. Codex to narzędzie do kodowania AI, które pomaga programistom w pracy z kodem.
Do systemu logowali się nie tylko użytkownicy publiczni; zalogowali się również pracownicy OpenAI, co umożliwiło Hacktronowi dostęp do konta jednego z nich. Konto Codex tej osoby było połączone z organizacją OpenAI w serwisie GitHub. GitHub to usługa online, z której korzystają programiści do przechowywania oprogramowania i współpracy nad nim.
Dzięki temu badacze uzyskali dostęp do wewnętrznego repozytorium oprogramowania OpenAI.
Badacze nie zrobili nic szkodliwego z tym dostępem. Chcieli jedynie udowodnić, że naruszyli bezpieczeństwo OpenAI. Polecili więc pracownikowi utworzenie nieszkodliwego pull requestu – propozycji zmiany oprogramowania – w wewnętrznym repozytorium OpenAI.
OpenAI naprawiło swoją część problemu około 14 godzin po przesłaniu przez Hacktron wstępnego raportu. Później wypłaciło badaczom nagrodę w wysokości 6500 dolarów za lukę po stronie OpenAI.
Co to oznacza dla cyberbezpieczeństwa
Tego typu etyczne hakowanie jest powszechne, ale ten typ hakowania ma kilka interesujących aspektów, które odróżniają go od wielu innych.
Po pierwsze, Hacktron wykorzystał sztuczną inteligencję do wsparcia swoich działań. Pierwotnie korzystał z Opus 4.8, jednego z najnowszych modeli Claude firmy Anthropic, aby wykryć problem w libheif. Nie udało mu się jednak wykorzystać tego modelu do stworzenia niezawodnego exploita, który działałby przeciwko domyślnej wersji Discourse.
Następnie Anthropic wydał Claude Opus 5. Korzystając z tego modelu, badacze byli w stanie w ciągu nocy stworzyć działający exploit.
To pokazuje, jak szybko rozwija się sztuczna inteligencja. Zadanie, którego Opus 4.8 nie był w stanie wykonać przez kilka sesji, zostało rozwiązane przez Opus 5 w ciągu kilku godzin od premiery.
Drugim interesującym aspektem było to, że badacze musieli oszukać Claude'a, aby im pomógł. Model odmówił napisania exploita dla zdalnego systemu, ponieważ uznał żądanie za nieetyczne. Dlatego badacze musieli przedstawić zadanie jako ćwiczenie typu „zdobądź flagę” (zawody hakerskie), aby zmusić go do działania.
Po wykonaniu tej czynności agent przejął serwer forum testowego w ciągu czterech godzin. Następnie badacze wykorzystali powstały exploit przeciwko forum OpenAI. Pokazuje to, że chociaż firmy mogą dokładać wszelkich starań, aby nakładać ograniczenia etyczne na korzystanie ze swojej sztucznej inteligencji, sprytny badacz nadal może je obejść, stosując proste i szybkie rozwiązania inżynieryjne.
I nie kosztowało to wiele. Hacktron wydał mniej niż 3000 dolarów w tokenach AI podczas swojego dwumiesięcznego projektu badawczego, w który zaangażowanych było trzech badaczy i który ujawnił luki w zabezpieczeniach kilku dużych firm.
Błąd w przetwarzaniu obrazu stał się podstawą szerszego projektu o nazwie HEIF Heist . Hacktron odkrył powiązane luki w zabezpieczeniach, które wpływały na usługi i oprogramowanie takich firm jak Slack, Meta i GitHub. Zmodyfikowanie exploita HEIF, aby zaatakować nową firmę, zajmowało średnio dzień lub dwa.
Wszystko to jeszcze bardziej obniża poprzeczkę dla wyrafinowanego hakowania. Ludzie od lat potrafią korzystać z gotowych narzędzi hakerskich, nie rozumiejąc do końca, jak one działają, ale aby przejrzeć oprogramowanie, znaleźć ukryte luki i przekształcić je w niezawodne exploity, potrzebna jest prawdziwa wiedza.
Hacktron twierdzi, że wykwalifikowane ludzkie wsparcie nadal było ważne i że nie było to w pełni autonomiczne hakowanie. Mimo to, sztuczna inteligencja sprawia, że część tej wiedzy jest tańsza i szybsza w zastosowaniu – i staje się coraz lepsza.
Powstrzymaj zagrożenia, zanim wyrządzą jakąkolwiek szkodę.
Malwarebytes Browser Guard automatycznieBrowser Guard strony phishingowe i złośliwe witryny. Bezpłatny, wystarczy jedno kliknięcie, aby zainstalować. Dodaj go do swojej przeglądarki →




