Anthropic-ը IPO-ի շրջանակում նախատեսում է պոտենցիալ ներդրողներին նախազգուշացնել, որ առաջադեմ արհեստական բանականությունը կարող է «աղետալի կամ էքզիստենցիալ վտանգներ ներկայացնել մարդկության համար»։ Սա անսովոր նախազգուշացում է այն ընկերության կողմից, որը փորձում է եկամուտ ստանալ հենց այդ տեխնոլոգիայից։
Ընկերությունը նշում է, որ մոդելները կարող են դրսևորել «ինքնապահպանմանն ուղղված վարքագիծ», այդ թվում՝ փորձել «դիմադրել անջատմանը», «թաքցնել կամ խեղաթյուրել տեղեկատվությունը» և դիմել «շանտաժ հիշեցնող» գործողությունների։
«Բարձր զարգացած մոդելների, հարթակների և հավելվածների մեր կողմից մշակումը, ինչպես նաև դրանց կիրառման ոլորտների ընդլայնումը կարող են ավելի մեծացնել այն ռիսկը, որ մեր մոդելները վնաս կհասցնեն», – Reuters-ը մեջբերում է Anthropic-ի փաստաթղթից։
Հանրային ընկերությունները պարբերաբար ներդրողներին բացահայտում են իրենց արտադրանքի հետ կապված ռիսկերը, սակայն, ինչպես ուշադրություն է հրավիրում լրատվական գործակալությունը, նախկինում գրեթե ոչ ոք չէր նախազգուշացրել, որ օգտագործվող տեխնոլոգիան պոտենցիալ վտանգ է մարդկության վերացման առումով։ Anthropic-ը շեշտում է ինչպես արհեստական բանականության՝ տնտեսությունն ու հասարակությունը վերափոխելու հնարավորությունը՝ արդյունաբերականացման և էլեկտրականության հայտնագործության օրինակով, այնպես էլ այն անդառնալի վնասի ռիսկը, որն այն կարող է պատճառել սխալ օգտագործման դեպքում։
Reuters-ի տվյալներով՝ իրեն որպես անվտանգությունն առաջնահերթություն համարող արհեստական բանականության լաբորատորիա ներկայացնող ընկերությունը 261 էջից շուրջ 80 էջ հատկացրել է ռիսկի գործոնների նկարագրությանը։ Սա գրեթե երկու անգամ ավելի է, քան բուն բիզնեսի նկարագրությանը հատկացված 48 էջը։
Համեմատության համար՝ SpaceX-ը, որին պատկանում է xAI-ն, իր ազդագրի հիմնական մասի 277 էջից ռիսկի գործոններին հատկացրել է ընդամենը շուրջ 38 էջ։
«Մեր կողմից իրականացվող ստուգումների մասին մոդելների հնարավոր իրազեկվածությունը զգալիորեն սահմանափակում է մոդելների անվտանգությունը գնահատելու մեր կարողությունը», – ասվում է Anthropic-ի ազդագրում։ Ընկերությունն ավելացնում է, որ ուսուցման գործընթացում մոդելները երբեմն ձեռք են բերում անսպասելի կարողություններ, որոնք կարող են աննկատ մնալ մինչև դրանց ներդրումը և անվտանգության հետ կապված լուրջ միջադեպերի առաջացումը։
Արհեստական բանականության հետազոտողները նույնպես նախազգուշացնում են, որ մոդելների հնարավորությունների աճին զուգահեռ դրանք ավելի լավ են հասկանում, թե երբ են իրենց վերահսկում, և համապատասխանաբար փոխում են իրենց վարքագիծը։
Anthropic-ը և արհեստական բանականության այլ մշակողներ, այդ թվում՝ OpenAI-ը, հայտնվել են խիստ ուշադրության կենտրոնում այն դեպքերից հետո, երբ փորձարարական համակարգերը խախտել են սահմանված սահմանափակումները։ Մասնավորապես, հաղորդվել էր, որ OpenAI-ի մոդելներից մեկը հասանելիություն է ստացել Ավստրալիայի առողջապահական համակարգի տվյալների բազային։
Ինչպես գրում է Reuters-ը, Anthropic-ի անվտանգության հարցերով հետազոտող Էվան Հուբինգերը ավելի քան 10% է գնահատել այն հավանականությունը, որ արհեստական բանականությունը առաջիկա տասնամյակի ընթացքում կարող է հանգեցնել մարդկանց մահվան։ Հոդվածում ընդգծվում է, որ այս գնահատականը համահունչ է նրա նախկին գործընկեր Ջեյքոբ Կոքսոնի հայտարարություններին։
Տեխնոլոգիական հրապարակումներն իրականացվում են Իդրամի աջակցությամբ։