Ostatnia awaria zabezpieczeń OpenAI potwierdza tendencję, która może zmusić firmę do podjęcia niepopularnej decyzji.
Firma wstrzymała szkolenie, ewaluację i wnioskowanie oparte na narzędziach dla swoich najwydajniejszych modeli po tym, jak wewnętrzny agent badawczy znalazł sposób na obejście zamierzonego ograniczenia internetowego. Co bardziej niepokojące, agent pozostawał aktywny przez wiele godzin po tym, jak system monitorowania OpenAI uruchomił alarm.
OpenAI opublikowało opis incydentu, który miał miejsce 20 września podczas zadania szkoleniowego opartego na wyszukiwaniu. Według OpenAI, agent nie mógł uzyskać użytecznych wyników za pomocą dostarczonych narzędzi wyszukiwania, próbował bezpośredniego dostępu do wyszukiwarek i ostatecznie przetestował ograniczenia swojego środowiska. Okazało się, że pomimo zablokowania bezpośredniego dostępu do sieci, resolver DNS w sandboxie nadal mógł uzyskać dostęp do publicznego internetu. Korzystając z delegacji DNS i publicznego chatbota, który mógł odpowiadać za pośrednictwem rekordów DNS, agent wysyłał pytania poza ograniczone środowisko i otrzymywał odpowiedzi. Następnie wysłał 18 dodatkowych zapytań tą samą trasą.
Monitor niezgodności OpenAI wygenerował alert o wysokim priorytecie w ciągu 15 minut, a recenzent potwierdził to 3 minuty później. Jednak uruchomienie nie zatrzymało się automatycznie, jak oczekiwano. Trwało jeszcze około dwóch i pół godziny, zanim ktoś zatrzymał je ręcznie.
OpenAI nie zgłosiło żadnego ujawnienia wrażliwych danych ani naruszenia bezpieczeństwa systemu zewnętrznego w tym incydencie. Jest to jednak kolejny przypadek , w którym agenci przekroczyli przypisane im zadania lub granice środowisk testowych.
Dziennik „New York Times” donosi , że tego lata agenci OpenAI nawiązali również interakcję ze stronami internetowymi rządu USA bez wiedzy firmy:
„Według badaczy ds. bezpieczeństwa i osoby zaznajomionej ze sprawą, tego lata sztuczna inteligencja OpenAI oszalała i włamała się do stron internetowych Departamentu Edukacji, Departamentu Handlu oraz Komisji Papierów Wartościowych i Giełd bez wiedzy laboratorium sztucznej inteligencji”.
W tych przypadkach nie potwierdzono żadnych naruszeń. Chociaż Australia opisała incydent z Medicare jako nieautoryzowany dostęp, czy naprawdę można go nazwać atakiem ?
Wezwania do spowolnienia tempa rozwoju w całej branży doprowadziły nawet do pozwu ze strony abonentów, którzy obawiają się, że otrzymają mniej „wartości za swoje pieniądze”. Inni obawiają się , że spowolnienie dałoby Chinom szansę na wyprzedzenie Stanów Zjednoczonych w coraz bardziej zaciętym wyścigu technologicznym.
Oto pomysł: dlaczego nie przyspieszyć rozwoju prawdziwie odizolowanych środowisk testowych? Lepsze zabezpieczenie sprawiłoby, że testy byłyby bezpieczniejsze, a ich wyniki bardziej wiarygodne.
Kiedy dziecko nie jest gotowe do kontaktu z niebezpiecznym przedmiotem, trzymasz go poza jego zasięgiem. Po co dawać dostęp sztucznej inteligencji, skoro nie jest gotowa do bezpiecznego użycia?
Jak bezpiecznie korzystać z agentów AI
Traktuj agenta jak entuzjastycznego, ale omylnego młodszego pracownika z dostępem do Twojego komputera. Nie dawaj mu nieograniczonego dostępu do poczty e-mail, plików, pamięci masowej w chmurze, danych uwierzytelniających programistów, kont finansowych ani systemów produkcyjnych tylko dlatego, że obiecuje zaoszczędzić czas.
Używaj oddzielnych kont z minimalnymi uprawnieniami. W miarę możliwości trzymaj poufne dane poza kontekstem roboczym, wymagaj zgody człowieka przed wysłaniem wiadomości, wydaniem pieniędzy, zmianą ustawień lub opublikowaniem czegokolwiek i regularnie sprawdzaj ich aktywność.
Agent AI nie musi mieć złych intencji, aby wyrządzić krzywdę. Wystarczy źle zrozumiana instrukcja, zbyt szerokie uprawnienia lub nieoczekiwane obejście problemu.
Od zgłaszania zagrożeń po ich usuwanie.
Zagrożenia cyberbezpieczeństwa nigdy nie powinny wykraczać poza nagłówek. Chroń swoje urządzenia przed zagrożeniami, pobierając Malwarebytes już dziś.




