
კომპანია Anthropic-მა განაცხადა, რომ შიდა გამოძიების შედეგად გამოვლინდა სამი ინციდენტი, როდესაც მისმა AI მოდელმა Claude-მა კიბერუსაფრთხოების ტესტირების პროცესში სამი ორგანიზაციის სისტემაში არასანქცირებული წვდომა მოიპოვა. ეს ფაქტი OpenAI-ის მიერ მსგავსი შემთხვევის გასაჯაროებიდან მალევე გახდა ცნობილი.
Anthropic-ის განმარტებით, ინციდენტები გამოწვეული იყო სატესტო გარემოს არასწორი კონფიგურაციით, რის გამოც მოდელებმა ინტერნეტთან წვდომა მიიღეს. მიუხედავად იმისა, რომ მოდელებს მკაფიოდ ჰქონდათ მითითებული, რომ ინტერნეტთან კავშირი არ ჰქონდათ, მათ რეალური სისტემები ტესტირების ნაწილად აღიქვეს და მოქმედება განაგრძეს. განსაკუთრებით საყურადღებოა, რომ მოდელებმა Opus 4.7 და Mythos 5, მიუხედავად იმისა, რომ მიხვდნენ რეალურ სისტემებთან მუშაობას, მაინც განახორციელეს შეტევები, მათ შორის მონაცემთა ბაზებზე წვდომა და მავნე პროგრამული პაკეტების გავრცელება.
კომპანია ხაზს უსვამს, რომ ეს ქმედებები არ იყო მოდელების „საკუთარი მიზნების“ შედეგი, არამედ დავალების შესრულების მცდელობა. Anthropic-მა აღნიშნა, რომ სატესტო გარემოში მოდელები მუშაობდნენ დამატებითი უსაფრთხოების ფილტრების გარეშე, რათა მათი რეალური შესაძლებლობები შეეფასებინათ. ამჟამად კომპანია დამოუკიდებელ ჯგუფთან, METR-თან ერთად, ინციდენტების დეტალურ ანალიზს ატარებს, რათა მომავალში მსგავსი რისკები სრულად გამოირიცხოს.
წყარო: techcrunch.com






