Google-ის ხელოვნური ინტელექტის მოდელმა Gemini-მ კიბერუსაფრთხოების შესაძლებლობების ტესტირებისას ინტერნეტში მოიძია ინფორმაცია და სამი კომპანიის დაცულ სისტემებზე წვდომა მოიპოვა. Reuters-ის ცნობით, ეს Google-ის AI სისტემის მიერ ასეთი ქმედების ავტონომიურად განხორციელების პირველი ცნობილი შემთხვევაა.

„როიტერსის“ ინფორმაციით, ინციდენტები მაისში მოხდა, როდესაც დამოუკიდებელი კიბერუსაფრთხოების შემფასებელი კომპანია Irregular ხელოვნური ინტელექტის სისტემებს ტესტავდა.

Google-ის უსაფრთხოების ინჟინერიის ვიცე-პრეზიდენტის, ჰიზერ ადკინსის განცხადებით, სტანდარტული ტესტირების ფარგლებში Gemini-მ ინტერნეტში საჯაროდ ხელმისაწვდომი ინფორმაცია აღმოაჩინა და ავტორიზაციის მონაცემები გამოიცნო, რის შემდეგაც წვდომა მოიპოვა სამ ვებსაიტზე, რომლებიც მოდელს ტესტირების ფარგლებში დასაშვებად მიაჩნდა.

„ჩვენ უზრუნველვყავით, რომ სამივე ორგანიზაციამ მომხდარის შესახებ იცოდა და ჩვენს სასწავლო პარტნიორთან ერთად ვიმუშავეთ იმ ცვლილებებზე, რომლებიც მათ ტესტირების პროცესებში უკვე განახორციელეს“, — განაცხადა ადკინსმა.

მისი თქმით, აღნიშნული შემთხვევები აჩვენებს, რამდენად მნიშვნელოვანია ძლიერი AI მოდელების პასუხისმგებლობიანი ქცევისთვის მომზადება.

Irregular-ის წარმომადგენლის განცხადებით, ეს შემთხვევა იგივე პრობლემას უკავშირდებოდა, რომელიც სხვა AI ლაბორატორიებთან ჩატარებული ტესტირების დროსაც გამოვლინდა. მისი თქმით, ყველა შესაბამის ლაბორატორიას ამის შესახებ ინფორმაცია ივლისის ბოლოს მიაწოდეს, ხოლო კომპანიასთან დაკავშირებული ყველა ცნობილი პრობლემა რამდენიმე კვირის წინ გამოსწორდა.

მსგავსი შემთხვევები, რომლებიც Irregular-ის ტესტირებას უკავშირდებოდა, Meta-მ, Anthropic-მა და OpenAI-მაც გაასაჯაროვეს. Meta-მ აგვისტოში განაცხადა, რომ მისი შემთხვევა არ მოიცავდა sandbox-ისგან გაქცევას ან რთულ კიბერშეტევას. Irregular-მა კი აღნიშნა, რომ მუშაობს რეკომენდაციებსა და საუკეთესო პრაქტიკებზე, რათა AI სისტემების კიბერუსაფრთხოების ტესტირება უფრო უსაფრთხოდ ჩატარდეს.

შემთხვევებმა კითხვები გააჩინა იმ უსაფრთხოების ზომებთან დაკავშირებით, რომლებიც საჭიროა მაშინ, როდესაც AI აგენტებს სულ უფრო მეტი ავტონომიურობა და ინტერნეტსა და კომპიუტერულ სისტემებზე წვდომა ეძლევათ.

Wall Street Journal-ის ინფორმაციით, ერთ-ერთ შემთხვევაში Gemini-მ პაროლების გამოცნობა სცადა და საბოლოოდ დაცულ სისტემაზე წვდომა მოიპოვა. დანარჩენ ორ შემთხვევაში მოდელმა საჯარო რეპოზიტორიაში ავტორიზაციის მონაცემები აღმოაჩინა, რის შემდეგაც მათი გამოყენებით დაცულ სისტემებში შევიდა.

Google-ის წარმომადგენლის განცხადებით, სამივე შემთხვევაში Gemini-მ ჰაკერული მოქმედება შეწყვიტა.