ახალმა ტესტმა 4 წამყვანი AI კომპანიის მოდელების უსაფრთხოების სისუსტე გამოავლინა
ჟურნალ WIRED-ის ჟურნალისტმა უილ ნაიტმა გამოაქვეყნა ტესტირების შედეგები, სადაც ახალმა ინსტრუმენტმა 4 წამყვანი კომპანიის AI მოდელების უსაფრთხოების ფილტრები გვერდის ავლით გატეხა. ანგარიში 2026 წლის 29 ივლისს გამოქვეყნდა.
ტესტირებამ მოიცვა OpenAI, Anthropic, Google და ილონ მასკის xAI. ექსპერიმენტმა აჩვენა, რომ უსაფრთხოების ბარიერების მოხსნა გაცილებით მარტივია, ვიდრე ამას მწარმოებლები აცხადებდნენ.
უსაფრთხოების მკვლევარმა თავის ანგარიშში აღნიშნა: „თანამედროვე მოდელები კვლავ მოწყვლადნი არიან სპეციალურად სტრუქტურირებული მოთხოვნების მიმართ“. 2 დამოუკიდებელმა ლაბორატორიამ სისუსტეები დაადასტურა.
კომპანიები ყოველწლიურად $100 მილიონზე მეტს ხარჯავენ უსაფრთხოებაზე. მიუხედავად ამისა, 2026 წელს ჯეილბრეიკის ახალი მეთოდების რაოდენობა 3-ჯერ გაიზარდა.
ექსპერტების შეფასებით, AI მოდელების საიმედოობა მთავარ გამოწვევად რჩება. მკვლევრები 2026 წლის ბოლომდე ახალი პროტოკოლების წარდგენას გეგმავენ.