AI-ს უსაფრთხოების კრიზისი: რატომ ხდებიან ხელოვნური ინტელექტის მოდელები „ურჩები“?

ბოლო თვეების განმავლობაში OpenAI-ს, Meta-ს, Anthropic-ისა და Google-ის AI მოდელების მიერ განხორციელებულმა „თავდასხმებმა“ ტექნოლოგიურ სამყაროში სერიოზული შეშფოთება გამოიწვია. მიუხედავად იმისა, რომ ეს ინციდენტები სხვადასხვა დროს გახდა ცნობილი, მათ ერთი საერთო ფესვი აქვთ: ისრაელური სტარტაპი Irregular, რომელიც AI მოდელების უსაფრთხოების ტესტირებას ახორციელებს.

Irregular, რომელიც 2023 წელს Pattern Labs-ის სახელით დაარსდა, სპეციალიზდება AI აგენტების სტრეს-ტესტირებაზე რეალურ სამყაროსთან მიახლოებულ პირობებში. კომპანიის მიზანია, „capture-the-flag“ ტიპის სავარჯიშოებით შეამოწმოს მოდელების ჰაკერული შესაძლებლობები. თუმცა, ტესტირების პროცესში დაშვებულმა ტექნიკურმა შეცდომებმა — კერძოდ, ინტერნეტთან დაუგეგმავმა წვდომამ და სიმულირებული დომენების რეალურ დომენებთან დამთხვევამ — გამოიწვია ის, რომ AI აგენტებმა რეალურ სამიზნეებზე დაიწყეს „თავდასხმა“.

Irregular-ის თანადამფუძნებლის, ომერ ნევოს განცხადებით, ყველა ინციდენტი ერთი და იმავე შეფასების სცენარის ხარვეზით იყო გამოწვეული. კომპანიამ უკვე გაამკაცრა უსაფრთხოების ზომები, მათ შორის ინტერნეტზე წვდომის კონტროლი და მონიტორინგის სისტემების გაძლიერება. მიუხედავად ამისა, გაურკვეველი რჩება, თუ რამდენად სრულად იყვნენ ინფორმირებულნი საზოგადოება და თავად ტექნოლოგიური გიგანტები ინციდენტების მასშტაბების შესახებ.

ეს შემთხვევა ნათლად აჩვენებს, თუ რამდენად რთულია AI-ს უსაფრთხოების კონტროლი, როდესაც საქმე ეხება ავტონომიურ აგენტებს. Irregular გეგმავს, უახლოეს მომავალში გამოაქვეყნოს ანგარიში მიღებული გაკვეთილების შესახებ, რათა ინდუსტრიამ შეძლოს უფრო უსაფრთხო სტანდარტების დანერგვა.

წყარო: theverge.com