Anthropic-ის ახალი წყლის ნიშნები: როგორ იმუშავებს Claude-ის ტექსტების იდენტიფიკაცია

Anthropic-მა გამოაქვეყნა დეტალური განმარტება იმის შესახებ, თუ როგორ იმუშავებს Claude-ის მიერ გენერირებული ტექსტების მარკირება. ეს ნაბიჯი ევროკავშირის AI აქტის გამჭვირვალობის კოდექსის მოთხოვნებს უკავშირდება, რომელიც ხელოვნური ინტელექტის მიერ შექმნილი კონტენტის იდენტიფიცირებას ითხოვს.

კომპანიის განმარტებით, სისტემა ეფუძნება Google DeepMind-ის მიერ შემუშავებულ SynthID-Text მიდგომას. პროცესი გულისხმობს ტექსტის გენერირებისას ისეთი შაბლონების შექმნას, რომლებიც მკითხველისთვის შეუმჩნეველია, თუმცა სპეციალური გასაღების მქონე პირისთვის — ადვილად იდენტიფიცირებადი. Anthropic ხაზს უსვამს, რომ ეს მეთოდი არანაირად არ აუარესებს Claude-ის მიერ შექმნილი პასუხების ხარისხს.

მთავარი კითხვა, რომელიც მომხმარებლებს აწუხებთ, ტექსტის რედაქტირებას ეხება. Anthropic-ის თქმით, მსუბუქი რედაქტირება წყლის ნიშანს სრულად ვერ წაშლის, თუმცა ტექსტის სრული გადაწერა, სადაც ყველა სიტყვა შეიცვლება, მარკირებას გაანეიტრალებს. ამ შემთხვევაში კი, ტექსტი უკვე აღარ ჩაითვლება AI-ის მიერ გენერირებულად.

რაც შეეხება პროგრამულ კოდს, წყლის ნიშნის ეფექტი მინიმალური იქნება. ვინაიდან კოდი ფუნქციურად გამართული უნდა იყოს, მოდელს არ აქვს თავისუფლება, აირჩიოს სხვადასხვა ვარიანტი, გარდა კომენტარებისა. შესაბამისად, მარკირება კოდის სტრუქტურაზე გავლენას ვერ მოახდენს.

Anthropic აღნიშნავს, რომ ეს სტანდარტი ინდუსტრიის მასშტაბით გავრცელდება და სხვა წამყვანი AI დეველოპერებიც ანალოგიურ სისტემებს დანერგავენ, რაც ხელოვნური ინტელექტის გამოყენების გამჭვირვალობას უზრუნველყოფს.

წყარო: techcrunch.com