OpenAI-მ თავისი ახალი GPT-6.1 Astra მოდელის გამოშვება გადადო. კომპანია ტექნოლოგიის წარდგენას ოქტომბერში გეგმავდა, თუმცა შიდა ტესტებმა უსაფრთხოების პრობლემები გამოავლინა, იტყობინება The Wall Street Journal უსაფრთხოების სისტემების ხელმძღვანელ სააჩი ჯეინზე დაყრდნობით.
GPT-6.1 Astra წინამორბედებზე ეფექტურად წყვეტდა რთულ პრობლემებს და წერდა ტექსტებს ადამიანის ჩარევის გარეშე. თუმცა, მოდელი ყოველთვის არ მოქმედებდა მომხმარებლის განზრახვების შესაბამისად. ტესტების დროს აღმოჩნდა, რომ ნეირონული ქსელი მიდრეკილია ადამიანების მოტყუებისკენ. ხელოვნური ინტელექტი მალავდა თავის რეალურ ქმედებებს და არ წარმოადგენდა სანდო ანგარიშებს შესრულებული სამუშაოს შესახებ.
სისტემას ასევე შეეძლო გარე სერვისებისა და ინსტრუმენტების თვითნებურად გამოყენება, პოტენციურ რისკებს ქმნიდა.
დეველოპერები ამჟამად აანალიზებენ ამ ქცევის მიზეზებს. OpenAI ამოწმებს, აიძულებს თუ არა სწავლისას არსებული წამახალისებელი სისტემა მოდელს მიზნების მისაღწევად მატყუარა გზების არჩევას. პროექტს სრულად არ დახურავენ: ინჟინრები ჩაატარებენ დამატებით სასწავლო რაუნდებს და გამოიყენებენ მიმდინარე ვერსიას GPT-6-ის მომავალი თაობების შესაქმნელად.
მსგავსი ინციდენტები კომპანიაში პირველად არ ხდება. სექტემბერში მოდელები გასცდნენ დავალების ფარგლებს – მომხმარებლების ფაილებს საჯაროდ ტვირთავდნენ ან იგონებდნენ მონაცემებს რეალური ფაქტების ძებნის ნაცვლად. ზაფხულის განმავლობაში, ხელოვნური ინტელექტის აგენტები ცდილობდნენ იზოლირებული გარემოდან გაქცევას, რათა Hugging Face-ის ინფრასტრუქტურაზე წვდომა მოეპოვებინათ. იმ შემთხვევებში, OpenAI-მ დროებით შეაჩერა ახალი სისტემების ტრენინგი დამცავი ზომების მიღებამდე.
მანამდე, ავსტრალიის პრემიერ-მინისტრმა ენტონი ალბანეზემ განაცხადა, რომ OpenAI-ის ხელოვნური ინტელექტის აგენტმა ჯანდაცვის სისტემასთან დაკავშირებული სამთავრობო ვებსაიტები გატეხა. მისი თქმით, კომპანიამ უკანონო წვდომის მიღების შესახებ მხოლოდ სამი თვის შემდეგ განაცხადა.