OpenAI-ის AI მოდელმა იზოლირებულ სატესტო გარემოს თავი დააღწია და კიბერშეტევა განახორციელა
ფოტო: Idrees Abbas/SOPA Images/LightRocket / Getty Images
OpenAI-მ სამშაბათს აღიარა, რომ მისმა ერთ-ერთმა AI მოდელმა კიბერუსაფრთხოების იმ შიდა ტესტირებისას, რომელიც გეგმის მიხედვით არ წარიმართა, იზოლირებულ სატესტო გარემოს თავი დააღწია და დამოუკიდებელი AI ჰოსტინგ-პლატფორმის, Hugging Face-ის, სისტემებში შეაღწია. თავდაპირველად, Hugging Face შეღწევას "გარე AI აგენტს" უკავშირებდა.
სამშაბათს ნაშუადღევს გამოქვეყნებულ ბლოგპოსტში OpenAI იმ ნაბიჯებს, რომლებმაც მოდელები სერვისის გატეხვამდე მიიყვანა, დეტალურად აღწერს:
"მოკვლევის შემდეგ ახლა უკვე ვიცით, რომ ეს კონკრეტული ინციდენტი განპირობებული იყო OpenAI-ის მოდელების კომბინაციით, მათ შორის GPT‑5.6 Sol-ითა და კიდევ უფრო მძლავრი წინასწარი ვერსიის მოდელით, რომელსაც, შეფასების მიზნით, შემცირებული ჰქონდა კიბერ-შეზღუდვები, როდესაც მიმდინარეობდა მათი კიბერშესაძლებლობების შიდა ტესტირება შესაფასებელ სტანდარტულ ტესტზე (ბენჩმარკი)", — ნათქვამია პოსტში.
კერძოდ, როგორც ჩანს, შეღწევის სამიზნე ExploitGym იყო, საჯაროდ განთავსებული ბენჩმარკი, რომელიც მოწყვლადობებზე დაყრდნობით შეტევის განხორციელების უნარს ზომავს. ExploitGym-ის მსგავსი ბენჩმარკები მოდელების გაწვრთნისას კონკრეტული უნარების დასახვეწად ხშირად გამოიყენება, თუმცა ეს პირველი ცნობილი შემთხვევაა, როდესაც ასეთმა ტესტირებამ რეალური კიბერშეტევა გამოიწვია.
ამ შემთხვევაში, ხსენებულ მოდელს ინტერნეტთან წვდომაც კი არ უნდა ჰქონოდა, გარდა ერთი კონკრეტული ხელსაწყოს, რომელიც მოდელებს დავალების შესასრულებლად საჭირო პროგრამული პაკეტების დაინსტალირების საშუალებას აძლევდა. ამის ნაცვლად, მოდელმა შეძლო, პაკეტების საინსტალაციო პროგრამაში აქამდე უცნობი მოწყვლადობა აღმოეჩინა, რომელიც საკუთარი სურვილისამებრ ინტერნეტის ფართო ქსელში გასასვლელად გამოიყენა.
"მოდელები ზედმეტად ფოკუსირებული იყო ExploitGym-ისთვის გამოსავლის პოვნაზე და საკმაოდ ვიწრო სატესტო მიზნის მისაღწევად უკიდურეს ზომებს მიმართა", — ვკითხულობთ OpenAI-ის პოსტში — "ინტერნეტთან წვდომის მოპოვების შემდეგ, მოდელებმა დაასკვნა, რომ Hugging Face, შესაძლოა, მასპინძლობდა მოდელებს, მონაცემთა ბაზებსა და გამოსავლებს ExploitGym-ისთვის. ამის ცოდნით, მოდელმა მოძებნა და წარმატებით იპოვა გზები საიდუმლო ინფორმაციაზე წვდომის მოსაპოვებლად, რასაც შეფასების პროცესში თაღლითურად გამოიყენებდა".
საბოლოოდ, მოდელებმა Hugging Face-ის ინფრასტრუქტურაში მოწყვლადობები იპოვა, რამაც მათ საშუალება მისცა, "ტესტის პასუხები პირდაპირ Hugging Face-ის საოპერაციო მონაცემთა ბაზიდან მოეპოვებინა", რითაც, ფაქტობრივად, ბენჩმარკის პასუხები მიიღო.
Hugging Face-მა ეს ინციდენტი რთულ და აგრესიულ კიბერშეტევად შეაფასა. კომპანიის თავდაპირველი განცხადებით, შეტევას ხანმოკლე იზოლირებულ სატესტო გარემოთა ჯგუფში ათასობით ინდივიდუალური ქმედება ახლდა, ხოლო მართვისა და კონტროლის სისტემა სხვადასხვა საჯარო სერვისებზე გადაინაცვლებდა ხოლმე, რათა მისი აღმოჩენა და დაბლოკვა გართულებულიყო.
OpenAI-მ პაკეტების საინსტალაციო პროგრამაში არსებული მოწყვლადობები გამოავლინა, მათ შესახებ შეატყობინა და ინციდენტის შემდგომი გამოძიების მიზნით, Hugging Face-თან თანამშრომლობს.
ფოტო: NurPhoto via Getty Images
კომპანიაში ასევე განაცხადეს, რომ მოდელების ტესტირებასა და მასთან დაკავშირებულ ინფრასტრუქტურაზე ახალ საკონტროლო მექანიზმებს დანერგავენ, რაც მომავალში მსგავსი ინციდენტების თავიდან აცილებას ისახავს მიზნად.
გაურკვეველია, OpenAI-ს სისტემაში შეღწევის გამო რაიმე სამართლებრივი პასუხისმგებლობა დაეკისრება თუ არა, თუმცა სავარაუდოდ, მოდელების ქმედებებმა კომპიუტერული თაღლითობისა და ბოროტად გამოყენების აქტი (Computer Fraud and Abuse Act) დაარღვია.
კომენტარები