Anthropic-ի արհեստական բանականությունը վերահսկողությունից դուրս է եկել և հարձակվել երեք ընկերությունների համակարգչային համակարգերի վրա: Շուրջ 141,000 փորձարկումների վերլուծության ընթացքում հայտնաբերվել է երեք միջադեպ, գրում է DW-ն։
Claude արհեստական բանականության մոդելներին առաջադրանք էր տրվել կոտրելու միջոցով ստանալ ցանցում մեկ այլ համակարգչում թաքնված տեղեկատվությունը: Փորձարկումները տեղի են ունեցել մեկուսացված միջավայրում, ըստ սցենարի՝ արհեստական բանականությունը մուտք չունի ինտերնետին: Սակայն «թյուրիմացության» պատճառով Claude-ը նման մուտք է ստացել, հաղորդում է Anthropic-ը: Չի նշվում, թե որ ընկերություններն են տուժել։
Anthropic-ը հայտարարել է, որ այս միջադեպերից հետո մտադիր է ուժեղացնել անվտանգության և վերահսկողության միջոցառումները՝ իր գործընկեր ընկերությունների հետ արհեստական բանականության մոդելները փորձարկելիս: Ամերիկյան ընկերությունն արհեստական բանականության մյուս մոդելների մշակողներին կոչ է արել նույնն անել։
Ավելի վաղ հայտնի էր դարձել, որ Anthropic-ի մրցակից OpenAI-ի երկու ԱԲ մոդելներ հարձակվել էին Hugging Face հարթակի ենթակառուցվածքների վրա՝ նույնպես դրա փորձարկման միջավայրից «փախչելով» դեպի ինտերնետ։
Թարգմանությունը՝ Էմմա Չոբանյանի