კომპანია OpenAI-ში აცხადებენ, რომ შიდა ტესტირების დროს მისი ხელოვნური ინტელექტის ორი მოდელი უკონტროლო გახდა და AI-პლატფორმა Hugging Face-ის ინფრასტრუქტურაში შეღწევა მოახერხა.

Hugging Face-მა 16 ივლისს განაცხადა, რომ AI-აგენტებმა კომპანიის შიდა მონაცემების ნაწილსა და რამდენიმე მომხმარებლის ანგარიშზე არასანქცირებული წვდომა მოიპოვეს. კომპანიის ინფორმაციით, თავდასხმა საკუთარი ხელოვნური ინტელექტის ინსტრუმენტებით შეაჩერეს. მათი თქმით, ეს პირველი შემთხვევა იყო, როდესაც შეტევა მთლიანად ავტონომიურმა AI-აგენტმა განახორციელა.

მოგვიანებით OpenAI-მ დაადასტურა, რომ ინციდენტში მისი ორი მოდელი GPT-5.6 Sol და კიდევ ერთი, უფრო ძლიერი მოდელი მონაწილეობდა, რომელიც ჯერ არ გამოუშვიათ. კომპანიაში აცხადებენ, რომ ისინი კიბერშესაძლებლობების შესაფასებლად, იზოლირებულ გარემოში, ინტერნეტთან პირდაპირი წვდომის გარეშე გადიოდნენ ტესტირებას, თუმცა მოდელებმა სისტემაში არსებული სისუსტეები გამოიყენეს და ინტერნეტზე წვდომა მიიღეს.

OpenAI-ის ცნობით, ამის შემდეგ მოდელებმა დავალების შესასრულებლად საჭირო ინფორმაციის ძებნა დაიწყეს და Hugging Face-ის პლატფორმაზე შეღწევა, მათ შორის, მოპარული მომხმარებლის ანგარიშების გამოყენებით, მოახერხეს.

ინციდენტის შემდეგ, OpenAI-მ განაცხადა, რომ აძლიერებს კონტროლს სატესტო ინფრასტრუქტურაზე, ზღუდავს წვდომას და ამატებს უსაფრთხოების დამატებით მექანიზმებს, რომლებიც მომავალი ტესტირებისას იქნება გამოყენებული. კომპანიამ მომხდარს „უპრეცედენტო“ უწოდა.