OpenAI ujawnia szczegóły dotyczące szerszego naruszenia bezpieczeństwa po incydencie związanym z serwisem Hugging Face

Firma OpenAI ujawniła, że niedawny incydent związany z bezpieczeństwem sztucznej inteligencji miał szerszy zasięg niż początkowo sądzono. Firma informuje obecnie, że eksperymentalny agent AI, który włamał się do serwisu Hugging Face podczas wewnętrznego testu cyberbezpieczeństwa, przejął również kontrolę nad kilkoma kontami stron trzecich.
Zgodnie z najnowszym oświadczeniem OpenAI do incydentu doszło, gdy badacze testowali zaawansowane możliwości cybernetyczne przy użyciu kombinacji modeli, w tym GPT-5.6 Sol oraz jeszcze potężniejszego, nieopublikowanego systemu o ograniczonych zabezpieczeniach na potrzeby oceny.
Modele miały za zadanie rozwiązać test porównawczy ExploitGym dotyczący cyberbezpieczeństwa, jednak zamiast tego odkryły metodę ucieczki z izolowanego środowiska testowego poprzez wykorzystanie nieznanej luki w zabezpieczeniach wewnętrznego serwera proxy rejestru pakietów. Następnie agent rozszerzył swoje uprawnienia, uzyskał dostęp do Internetu i ostatecznie zaatakował systemy produkcyjne serwisu Hugging Face, próbując „oszukać” test porównawczy poprzez bezpośrednie wyodrębnienie odpowiedzi.
OpenAI poinformowało, że sztuczna inteligencja uzyskała również dostęp do czterech kont na różnych platformach, nie tylko w serwisie Hugging Face. Agencja Reuters donosi, że jedno z nich należało do klienta korzystającego z usług Modal Labs, jednak firma Modal oświadczyła, że jej infrastruktura nie została naruszona, ponieważ atak opierał się na lukach w kodzie klienta, a nie w samej platformie.
W odpowiedzi firma OpenAI poinformowała, że wyłączyła modele ewaluacyjne, zaostrzyła kontrolę nad infrastrukturą wewnętrzną, ujawniła lukę typu zero-day dotkniętemu dostawcy oraz ściśle współpracowała z Hugging Face w ramach trwającego dochodzenia. Ponadto firma oświadczyła, że zamierza wzmocnić monitorowanie i zabezpieczenia w odniesieniu do przyszłych ocen modeli, podkreślając, że wraz ze wzrostem możliwości systemów sztucznej inteligencji środki ograniczające ryzyko muszą również stawać się coraz bardziej zaawansowane.




