OpenAI-ის ახალი მოდელი Astra: კიბერუსაფრთხოების ახალი გამოწვევები

OpenAI-მა თავისი მომავალი მოდელის, Astra-ს შესახებ ახალი დეტალები გაასაჯაროვა. კომპანიის განცხადებით, ეს არის პირველი დიდი ენობრივი მოდელი (LLM), რომელიც აკმაყოფილებს მათ მიერ დადგენილ „კრიტიკული კიბერუსაფრთხოების ზღვარს“. Astra-ს გამოშვება უახლოეს მომავალში იგეგმება, თუმცა მისი ყველაზე მოწინავე კიბერუსაფრთხოების ფუნქციებზე წვდომა შეზღუდული იქნება.

კვლევითი ლაბორატორიის შეფასებით, Astra-ს შეუძლია კომპიუტერულ სისტემებში უცნობი უსაფრთხოების ხარვეზების აღმოჩენა და მათი ექსპლუატაცია ადამიანის ჩარევის გარეშე. ეს შესაძლებლობა მსგავსია იმ რისკებისა, რაც Anthropic-მა თავისი Mythos მოდელის შემთხვევაში დააფიქსირა. OpenAI-მა Astra-ს ტესტირებისას ExploitBench-ზე უმაღლესი შეფასება მიიღო, სადაც მოდელმა ორი „zero-day“ დაუცველობა აღმოაჩინა და გამოიყენა.

უსაფრთხოების უზრუნველსაყოფად, OpenAI-მა დანერგა ახალი ტექნიკები, რომლებიც მიზნად ისახავს მოდელის მიერ არასასურველი ქმედებების პრევენციას. კომპანია ასევე გეგმავს „მაღალი რისკის“ ანგარიშების იდენტიფიცირებას და მათთვის პასუხების შეზღუდვას. გარდა ამისა, Astra-ს ექნება „chain-of-thought“ მონიტორინგის დამატებითი ფენა, რათა დროულად იქნას აღკვეთილი ნებისმიერი მავნე ქმედება.

მიუხედავად ამ ზომებისა, დამოუკიდებელი მხარეების მიერ OpenAI-ის პრეტენზიების დადასტურება ჯერჯერობით შეუძლებელია. კომპანია აცხადებს, რომ მოდელის ფართო საზოგადოებისთვის წარდგენამდე, ის ტესტერების შეზღუდულ ჯგუფთან ერთად გაივლის შემოწმებას. ექსპერტები, მათ შორის OpenAI-ის ყოფილი თანამშრომელი იონა შავიტი, კითხვის ნიშნის ქვეშ აყენებენ იმას, თუ რამდენად არის მოდელი მართლაც „უსაფრთხო“ და რამდენად შეესაბამება მისი ქცევა ტესტირების გარემოს მოლოდინებს.

წყარო: techcrunch.com