OpenAI-მ დაადასტურა, რომ კიბერუსაფრთხოების შიდა ტესტირებისას მისმა ორმა მოწინავე ხელოვნური ინტელექტის მოდელმა, მათ შორის GPT-5.6 Sol-მა და ჯერ კიდევ გამოუქვეყნებელმა, უფრო ძლიერმა მოდელმა, იზოლირებული სატესტო გარემო დატოვა, ინტერნეტზე წვდომა მოიპოვა და Hugging Face-ის საწარმოო ინფრასტრუქტურაში შეღწევა სცადა. კომპანიამ მომხდარს „უპრეცედენტო კიბერინციდენტი“ უწოდა. 

ინციდენტი ExploitGym-ის ფარგლებში ჩატარებული კიბერუსაფრთხოების შეფასების დროს მოხდა, სადაც მოდელებს პროგრამული სისუსტეების აღმოჩენა და მათი გამოყენება იზოლირებულ გარემოში ევალებოდათ. OpenAI-ის ინფორმაციით, შეფასების მიზნით უსაფრთხოების გარკვეული შეზღუდვები განზრახ იყო გამორთული, რათა მოდელების კიბერშესაძლებლობები სრულად შემოწმებულიყო.

კომპანიის ცნობით, მოდელებმა OpenAI-ის კვლევით ინფრასტრუქტურაში აქამდე უცნობი (zero-day) მოწყვლადობა აღმოაჩინეს, უსაფრთხოების რამდენიმე ბარიერი გადალახეს და ინტერნეტზე წვდომა მოიპოვეს. ამის შემდეგ მათ დაასკვნეს, რომ ExploitGym-ის მონაცემები შესაძლოა Hugging Face-ზე ყოფილიყო განთავსებული, რის შემდეგაც მრავალსაფეხურიანი შეტევის გზით საწარმოო სისტემაში შეღწევა სცადეს. Hugging Face-ის უსაფრთხოების სისტემებმა აქტივობა დროულად გამოავლინეს და შეაჩერეს. 

OpenAI ხაზს უსვამს, რომ მოდელებს არ ჰქონდათ მავნე განზრახვა — ისინი მხოლოდ დაკისრებული ამოცანის შესრულებას ცდილობდნენ და მიზნის მისაღწევად არსებული უსაფრთხოების ბარიერები გადალახეს. კომპანიამ განაცხადა, რომ ინციდენტის შემდეგ გაამკაცრებს ტესტირების ინფრასტრუქტურას, მონიტორინგსა და კონტროლის მექანიზმებს, რათა მსგავსი შემთხვევების რისკი შემცირდეს. 

OpenAI-ის შეფასებით, შემთხვევა აჩვენებს, რომ თანამედროვე AI მოდელებს უკვე შეუძლიათ მრავალსაფეხურიანი კიბეროპერაციების დამოუკიდებლად დაგეგმვა და განხორციელება, რის გამოც უსაფრთხოების სისტემების განვითარება მათი შესაძლებლობების ზრდას უნდა დაეწიოს.