Anthropic-ի ԱԲ մոդելները դուրս են եկել վերահսկողությունից ու հարձակվել երեք ընկերությունների համակարգերի վրա

Anthropic-ի արհեստական ​​բանականությունը վերահսկողությունից դուրս է եկել և հարձակվել երեք ընկերությունների համակարգչային համակարգերի վրա: Շուրջ 141,000 փորձարկումների վերլուծության ընթացքում հայտնաբերվել է երեք միջադեպ, գրում է DW-ն։

Claude արհեստական ​​բանականության մոդելներին առաջադրանք էր տրվել կոտրելու միջոցով ստանալ ցանցում մեկ այլ համակարգչում թաքնված տեղեկատվությունը:  Փորձարկումները տեղի են ունեցել մեկուսացված միջավայրում, ըստ սցենարի՝ արհեստական ​​բանականությունը մուտք չունի ինտերնետին: Սակայն «թյուրիմացության» պատճառով Claude-ը նման մուտք է ստացել, հաղորդում է Anthropic-ը: Չի նշվում, թե որ ընկերություններն են տուժել։

Anthropic-ը հայտարարել է, որ այս միջադեպերից հետո մտադիր է ուժեղացնել անվտանգության և վերահսկողության միջոցառումները՝ իր գործընկեր ընկերությունների հետ արհեստական ​​բանականության մոդելները փորձարկելիս: Ամերիկյան ընկերությունն արհեստական ​​բանականության մյուս մոդելների մշակողներին կոչ է արել նույնն անել։

Ավելի վաղ հայտնի էր դարձել, որ Anthropic-ի մրցակից OpenAI-ի երկու ԱԲ մոդելներ հարձակվել էին Hugging Face հարթակի ենթակառուցվածքների վրա՝ նույնպես դրա փորձարկման միջավայրից «փախչելով» դեպի ինտերնետ։

Թարգմանությունը՝ Էմմա Չոբանյանի

 

Leave a comment