ახალი მეთოდი AI მოდელების „ფარულ აზროვნებას“ ამჟღავნებს

კომპიუტერულმა მეცნიერებმა აღმოაჩინეს გზა, რომლითაც შესაძლებელია წამყვანი AI მოდელების „ფარული აზროვნების“ პროცესის ამოღება. ეს აღმოჩენა მნიშვნელოვან კითხვებს ბადებს ხელოვნური ინტელექტის უსაფრთხოებისა და ტექნოლოგიური კონკურენციის შესახებ.

კვლევის თანახმად, OpenAI-ის, Anthropic-ისა და Google-ის მიერ შემუშავებული მოდელები მოწყვლადნი იყვნენ ე.წ. „distillation“ (დისტილაციის) მეთოდის მიმართ. მკვლევარებმა აჩვენეს, რომ შესაძლებელია მოდელის შიდა მსჯელობის ეტაპების აღდგენა, რაც პოტენციურად პერსონალური მონაცემების, მათ შორის API გასაღებებისა და პაროლების გაჟონვას იწვევდა. მიუხედავად იმისა, რომ კომპანიებმა უკვე განახორციელეს შესაბამისი ცვლილებები, პრობლემა ფუნდამენტურ ხასიათს ატარებს.

ტექნოლოგიური ექსპერტები აღნიშნავენ, რომ დისტილაცია, როგორც მოდელის შესაძლებლობების კოპირების ტექნიკა, გეოპოლიტიკური დავის საგანი გახდა. არსებობს ეჭვი, რომ ჩინური AI კომპანიები ამ მეთოდს აშშ-ის წამყვანი მოდელების შესაძლებლობების მისათვისებლად იყენებენ. თუმცა, დარგის სპეციალისტები, მათ შორის Meta-ს აღმასრულებელი დირექტორი მარკ ცუკერბერგი, მიიჩნევენ, რომ დისტილაცია ღია კოდის ეკოსისტემის განვითარების მნიშვნელოვანი ნაწილია და მისი შეზღუდვა შესაძლოა ინოვაციების ტემპს შეაფერხებს.

კვლევის ავტორები აცხადებენ, რომ მიუხედავად უსაფრთხოების ზომებისა, AI მოდელების შიდა პროცესების სრულად დაცვა რთული გამოწვევაა, რაც მომავალშიც მოითხოვს API არქიტექტურის ფუნდამენტურ გადახედვას.

წყარო: wired.com