OpenAI ogłosił, że GPT-5.6 Sol - najnowszy i najbardziej zaawansowany model sztucznej inteligencji firmy - oraz "jeszcze bardziej wydajny model przedpremierowy" przeprowadziły w minionym tygodniu cyberatak na Hugging Face. Jest to działająca od 10 lat nowojorska firma - największa na świecie platforma społecznościowa dla AI - gdzie programiści dzielą się doświadczeniami, modelami uczenia maszynowego, zbiorami danych oraz aplikacjami.
Model OpenAI miał zaliczyć test. Postanowił do niego ściągać
OpenAI ujawniło, że w ramach testów algorytmy miały rozwiązywać zadania hakerskie. Ich zachowanie wymknęło się spod kontroli. "Modele samodzielnie wykryły i wykorzystały nieznaną wcześniej lukę bezpieczeństwa i uciekły do otwartego internetu" - informuje portal The Hacker News.
W opinii jego ekspertów, "modele uznały, że najprostszym sposobem na zaliczenie testu hakerskiego będzie kradzież gotowych odpowiedzi" - informuje portal. OpenAI podejrzewa, że włamały się do Hugging Face, bo - jak to ujął - "wywnioskowały", że w zasobach jego pamięci znajdą odpowiedzi na pytania testowe.
Eksperci ostrzegają. Ataki zagrażają bezpieczeństwu
Clément Delangue, współzałożyciel i dyrektor generalny Hugging Face, nazwał incydent "atakiem, jakiego nigdy wcześniej nie widzieliśmy". "To niesamowite, że to wszystko wydarzyło się samodzielnie" - cytuje Delangue'a portal Axios. Zaś członkowie Frontier Red - specjaliści od kontrolowanych cyberataków w Anthropic - polecili swoim pracownikom "zapamiętać ten moment jako pierwszy prawdziwy incydent związany z bezpieczeństwem sztucznej inteligencji".
Hugging Face nie jest jedyną firmą, którą zhakował system agentów OpenAI po złamaniu zabezpieczeń podczas testów. Inną jest Modal Labs - platforma chmurowa stworzona specjalnie do uruchamiania zadań sztucznej inteligencji (AI), które przeprowadzono na początku miesiąca. Dzięki jednemu z klientów firmy, system złamał główne zabezpieczenia platformy. OpenAI potwierdziło, że jego agenci uzyskali nieautoryzowany dostęp do łącznie czterech kont w różnych publicznych serwisach. Nazwy dwóch nie zostały podane do wiadomości.
Najnowsze modele OpenAI nie są jedynymi, które znalazły sposób na oszukiwanie podczas oceniania. Brytyjski Instytut Bezpieczeństwa Sztucznej Inteligencji (AI Security Institute) poinformował we wtorek, że każdy testowany przez niego model, przynajmniej czasami próbował oszukiwać podczas ocen cyberbezpieczeństwa.











