
OpenAI-მა დააანონსა თავისი ახალი AI მოდელი, Astra, რომელიც კომპანიის სტანდარტებით „კრიტიკული“ კიბერშესაძლებლობების მქონე პირველი მოდელია. Astra-ს საჯარო ვერსია მალე გახდება ხელმისაწვდომი, თუმცა მისი მოწინავე კიბერფუნქციები თავდაპირველად მხოლოდ Daybreak Blue პროგრამის პარტნიორებისთვის იქნება ღია.
OpenAI-ის უსაფრთხოების გუნდის განცხადებით, Astra-ს შესაძლებლობები აკმაყოფილებს კომპანიის „მზადყოფნის ჩარჩოს“ (preparedness framework) კრიტიკულ ზღვარს. ეს ნიშნავს, რომ მოდელს შეუძლია დამოუკიდებლად აღმოაჩინოს და გამოიყენოს რეალურ პროგრამულ უზრუნველყოფაში არსებული უცნობი მოწყვლადობები. ამ რისკის გათვალისწინებით, კომპანიამ დროებით შეაჩერა მოდელის განვითარება, რათა დამატებითი დამცავი მექანიზმები დაენერგა.
Astra-ს უნარები მოიცავს არა მხოლოდ მოწყვლადობების პოვნას, არამედ ე.წ. „ჯაჭვური ექსპლოიტების“ (exploit chaining) შექმნას, რაც სისტემაში ღრმად შეღწევის საშუალებას იძლევა. ტესტირებისას მოდელმა ExploitBench-ზე 100%-იანი შედეგი აჩვენა, რითაც აჯობა ისეთ მოდელებს, როგორიცაა GPT-5.6 Sol და Anthropic-ის Mythos.
უსაფრთხოების მიზნით, OpenAI ნერგავს „არასწორი განლაგების მონიტორს“ (misalignment monitor), რომელიც ზღუდავს მოდელის მიერ მავნე მოთხოვნების შესრულებას. მიუხედავად ამისა, კომპანია აფრთხილებს მომხმარებლებს, რომ ზოგჯერ სისტემამ შესაძლოა ლეგიტიმური ქმედებებიც კი შეცდომით დაბლოკოს.
Daybreak პროგრამის ფარგლებში, ისეთი კომპანიები, როგორებიცაა Cisco, Cloudflare და Palo Alto Networks, მიიღებენ წვდომას Astra-ს ნაკლებად შეზღუდულ ვერსიაზე. ეს პარტნიორობა მიზნად ისახავს ორგანიზაციების დაცვის გაძლიერებას მანამ, სანამ მსგავსი შესაძლებლობების მქონე AI მოდელები ფართო მასებისთვის გახდება ხელმისაწვდომი.
წყარო: wired.com






