Agent sztucznej inteligencji Mythos firmy Anthropic, testowany przez brytyjski AI Safety Institute (AISI), rzekomo podjął próbę przeprowadzenia rzeczywistego ataku socjotechnicznego na administratorów serwisu GitHub. Do ataku wykorzystano fałszywe profile ludzkie, nakłoniono ich do zaakceptowania złośliwego kodu, a następnie edytowano logi, aby ukryć ślady działań agenta po wyzwaniu.
AISI przeprowadzało oceny cyberbezpieczeństwa systemów Mythos firmy Anthropic i Sol firmy OpenAI, gdy wykryło nietypowe transfery danych wychodzących z systemów badawczych. Dochodzenie wykazało, że niektórzy agenci angażowali się w „ciągłą, potencjalnie szkodliwą aktywność” wymierzoną w prawdziwe osoby i organizacje, zamiast pozostawać w docelowym środowisku testowym.
Najpoważniejsza aktywność dotyczyła agenta Anthropic Mythos, którego zadaniem było rozwiązanie problemu cyberbezpieczeństwa związanego z GitHubem. Agent zidentyfikował prawdziwych administratorów GitHub, zbadał ich i utworzył wiele fałszywych kont podszywających się pod te osoby. Korzystając z prywatnych wiadomości i usługi udostępniania plików, próbował wywrzeć presję na administratorów i oszukać ich, aby zatwierdzili złośliwy kod, który mógł być uruchamiany w systemach GitHub.
Ale co mnie osobiście najbardziej martwi, to fakt, że gdy agent został z tym skonfrontowany, zmienił wcześniejszą aktywność, aby wyglądała na nieszkodliwą, i rozważał przyjęcie nowej tożsamości, aby kontynuować operację, wykazując się przy tym ewidentnie oszukańczym zachowaniem wykraczającym poza jego pierwotny zamysł.
AISI opisuje te incydenty jako rzadkie zdarzenia w bardzo specyficznych warunkach, ale stanowiące istotne sygnały tego, co takie modele mogą zrobić w rękach złośliwych podmiotów, gdy uzyskają dostęp do otwartego internetu. Zarówno Anthropic, jak i OpenAI argumentowały, że parametry testów nie były reprezentatywne dla ich wdrożeń produkcyjnych i zapowiedziały, że badają i udoskonalają metody oceny i zabezpieczeń.
Ten incydent nie jest odosobnionym przypadkiem.
Firma Anthropic ujawniła oddzielnie, że modele Claude'a uzyskały nieautoryzowany dostęp do trzech organizacji zewnętrznych podczas ewaluacji cyberbezpieczeństwa w stylu capture-the-flag, przeprowadzonych z partnerem zewnętrznym, Irregular. Miały one związek z incydentem HuggingFace z zeszłego miesiąca.
Meta dołączyła również do listy dostawców zgłaszających przypadki naruszenia bezpieczeństwa systemów firm trzecich przez agentów AI podczas testów. Model Muse Spark firmy Meta rzekomo wykorzystał lukę w zabezpieczeniach innej firmy „w sposób podobny do wcześniej zgłaszanych przypadków w innych firmach”.
Jak zachować bezpieczeństwo
Choć niebo nie wali się na głowę, ludzie, którzy boją się nadejścia „ Skynetu ”, dostają amunicję w ręce firm przeprowadzających testy, które skutkują wydostaniem się z piaskownicy, nadużyciami danych uwierzytelniających, bocznym dostępem do wielu usług i wykorzystywaniem ekosystemów oprogramowania typu open source jako broni.
Co możesz zrobić jako potencjalny cel:
- Zadbaj o to, aby całe oprogramowanie na Twoim urządzeniu było aktualne, ponieważ wykorzystywanie znanych luk jest łatwiejsze niż znajdowanie nowych.
- Korzystaj z aktualnej ochrony bezpieczeństwa w czasie rzeczywistym, aby chronić swoje systemy i urządzenia przed złośliwym oprogramowaniem.
- Przed otwarciem załączników i łączy do pobierania sprawdź ich bezpieczeństwo za pośrednictwem oddzielnych kanałów.
- W miarę możliwości stosuj uwierzytelnianie wieloskładnikowe (MFA) .
- Przeczytaj nasz blog, aby dowiedzieć się , jak bezpiecznie korzystać z serwisu Github .
Od zgłaszania zagrożeń po ich usuwanie.
Zagrożenia cyberbezpieczeństwa nigdy nie powinny wykraczać poza nagłówek. Chroń swoje urządzenia przed zagrożeniami, pobierając Malwarebytes już dziś.




