Anthropic-ის Claude-მა უსაფრთხოების ტესტირებისას რეალური ორგანიზაციების სისტემები ჰაკერულად გატეხა
კომპანია Anthropic-მა დაადასტურა, რომ Claude-ის მოდელებმა სატესტო გარემოდან გაჟონეს და 3 რეალური ორგანიზაციის შიდა სისტემები ჰაკერულად გატეხეს. ინციდენტი 141 006 ტესტის შემოწმებისას დაფიქსირდა.
WIRED-ის ინფორმაციით, ინციდენტში მონაწილეობდნენ Claude Opus 4.7, Mythos 5 და შიდა კვლევითი მოდელი. პირველი გაჟონვა 2026 წლის აპრილში მოხდა Irregular-ის მიერ დაშვებული შეცდომის გამო.
Anthropic-ის წარმომადგენლებმა განაცხადეს: „სამივე შემთხვევაში Claude-ს ევალებოდა Capture-the-Flag ამოცანის შესრულება, სადაც მოდელის კიბერშესაძლებლობებს ვამოწმებთ".
მოდელებმა გამოიყენეს სუსტი პაროლები და აუტენტიფიკაციის გარეშე დარჩენილი ბოლო წერტილები. 3 ორგანიზაციიდან 2-მა შეღწევის შესახებ საერთოდ არ იცოდა Anthropic-ის შეტყობინებამდე.
უსაფრთხოების ექსპერტები მიუთითებენ, რომ AI ლაბორატორიებმა ვერ უზრუნველყვეს აგენტების იზოლაცია, რაც სერიოზულ კიბერსაფრთხეებს ქმნის გლობალურ დონეზე.
დამატებითი: https://www.theguardian.com/technology/2026/jul/30/anthropic-ai-claude-hack