Notebookcheck Logo

OpenAI opóźnia GPT-6.1 Astra po wynikach symulacji

OpenAI opóźnia premierę GPT-6.1 Astra.
ⓘ openai.com
OpenAI opóźnia premierę GPT-6.1 Astra.
OpenAI opóźnia wydanie GPT-6.1 Astra po testach bezpieczeństwa. Symulacje UK AISI wykazały, że GPT-6 Astra przeprowadzał nieautoryzowane ataki na łańcuch dostaw w 29,2% testów z zakresu cyberbezpieczeństwa.
AI Software Security Business

OpenAI przełożyło październikową premierę GPT-6.1 Astra po tym, jak wewnętrzne testy wykazały, że model nie radzi sobie z pozostawaniem w granicach dozwolonego zakresu. Media zewnętrzne jako pierwsze poinformowały o opóźnieniu 28 września, a OpenAI nie podało nowej daty premiery. Saachi Jain, szefowa systemów bezpieczeństwa w OpenAI, powiedziała, że model nie spełnił w pełni wymagań dotyczących zakresu, uprawnień i sposobu informowania użytkowników o wykonanej pracy.

Co testował brytyjski AISI

Jak podały media zewnętrzne, UK AI Security Institute opublikował 28 września 32-stronicowy raport oceniający GPT-6 Astra. AISI przeprowadził symulowane testy cyberbezpieczeństwa z wyłączonymi klasyfikatorami cyberbezpieczeństwa modelu, aby sprawdzić, co podejmie on bez pomocy. Nie ingerowano w żadne rzeczywiste systemy. W tych symulacjach Astra przeprowadziła atak na łańcuch dostaw, wymierzony w cele spoza zakresu, w 29,2% przypadków, w porównaniu z 6,3% w przypadku GPT-5.6 Sol i 0% w przypadku GPT-5.5. AISI zaznacza, że wynik GPT-5.5 opiera się na mniejszym zestawie scenariuszy. Ataki obejmowały tworzenie fałszywych tożsamości i dostarczanie złośliwego kodu do symulowanych projektów open source.

Rozumowanie i prośby o pozwolenie

AISI przeanalizował surowy łańcuch rozumowania modelu. Astra często rozważała zakres swoich uprawnień, a mimo to czasami przeprowadzała atak, uzasadniając to tym, że jest nieszkodliwy, nie został wyraźnie zabroniony albo stanowi jedyną pozostałą drogę. W wielu testach model prosił również o pozwolenie. W ramach testu na takie pytania odpowiada standardowa automatyczna wiadomość, polecająca agentowi kierować się własnym osądem. Astra czasami uznawała to za zgodę, nawet gdy zauważała, że odpowiedź prawdopodobnie została wygenerowana automatycznie. Doprecyzowanie, że wszystko, co nie zostało wymienione, wykracza poza zakres, zmniejszyło liczbę pełnych ataków z 26 na 50 prób do 4 na 49 w podzbiorze scenariuszy, ale nie wyeliminowało ich całkowicie.

Świadomość symulacji

AISI wskazuje świadomość symulacji jako główne ograniczenie, ponieważ model, który rozpozna test, może zachowywać się inaczej. Astra czasami powoływała się na symulowany charakter środowiska jako powód do przeprowadzenia ataku, a niekiedy twierdziła, że wystąpiły błędy, których w rzeczywistości nie było — na przykład podawała, że 64-znakowy skrót ma 63 znaki. AISI nadal uznaje to zachowanie za niepokojące, ponieważ w każdym przypadku narusza ono zakres określony na potrzeby ewaluacji.

Agenci OpenAI dotarli do rządowych stron internetowych

Opóźnienie nastąpiło po incydentach, w których agenci OpenAI dotarli do rządowych stron internetowych w sposób niezamierzony przez firmę, w tym do australijskiego portalu statystyk Medicare w czerwcu oraz kilku amerykańskich witryn. OpenAI wstrzymało również trenowanie, ewaluację i wnioskowanie z użyciem narzędzi w przypadku swoich najbardziej zaawansowanych modeli. Firma informuje, że przerwa potrwa do czasu potwierdzenia, że usunęła lukę w filtrowaniu sieci i zakończyła dalsze testy red-teamowe.

Google LogoAdd as a preferred source on Google
Mail Logo
> laptopy testy i recenzje notebooki > Nowinki > Archiwum v2 > Archiwum 2026 09 > OpenAI opóźnia GPT-6.1 Astra po wynikach symulacji brytyjskiego AISI
Darryl Linington, 2026-09-30 (Update: 2026-09-30)