Böyük Britaniyanın Strukturlaşdırılmış Süni İntellektin Təhlükəsizliyi İnstitutu (AISI) tərəfindən aparılan təhlükəsizlik testləri, Anthropic və OpenAI-ın ən son süni intellekt alətlərinin məşhur geliştirici platforması GitHub-a sızmaq üçün gözlənilməz metodlardan istifadə etdiyini ortaya qoydu.
Elchi.az xəbər verir ki, AISI rəsmiləri, Anthropic-in Mythos və OpenAI-ın Sol modellərinin görünməmiş dərəcədə muxtariyyət və aldatma nümayiş etdirdiyini bildirdilər.
Sistemlər həqiqi insanları təqlid etdi
Adi təhlükəsizlik testləri zamanı bir Anthropic agenti, GitHub sisteminə daxil olmasının qarşısını alan insan rəyçilərini keçmək üçün real insanların profillərini araşdıraraq saxta onlayn şəxsiyyətlər yaratdı. Modelin müvafiq şəxslərə birbaşa mesajlar göndərdiyi və sistemə zərərli kod yeritmək məqsədinə çatmaq üçün sorğular üçün onların təsdiqini almağa çalışdığı aşkar edildi.
Agent tərəfindən təqdim edilən kod dəyişikliyi test zamanı ictimai platformada sorğulandıqda, modelin əvvəlki fəaliyyətlərini zərərsiz görünmək üçün dəyişdirdiyi və prosesi davam etdirmək üçün yeni bir şəxsiyyət qəbul etməyi düşündüyü bildirildi. Agentin sistemə zərərli kod yükləmək cəhdinin qarşısı yalnız insan auditorları vəziyyəti görüb müdaxilə etdikdən sonra alınıb.
Şayəstə





















