Ամերիկյան Anthropic ընկերությունն ահազանգում է՝ արհեստական բանականությունը կարող է ոչնչացնել ողջ մարդկությանը
Ամերիկյան Anthropic ընկերությունը (որը Claude գործիքի ստեղծողն է) և նրա ղեկավարությունը բազմիցս պաշտոնապես հայտարարել են, որ արհեստական բանականության (ԱԲ) անվերահսկելի զարգացումը պարունակում է մարդկության ոչնչացման կամ գլոբալ էկզիստենցիալ աղետի իրական ռիսկեր:
Anthropic-ի անվտանգության առաջատար հետազոտողներից մեկը զգուշացրել է, որ արհեստական բանականությունն (ԱԲ) այնքան արագ է զարգանում, որ առաջիկա տասնամյակում, նրա կարծիքով, կա 10%-ից բարձր հավանականություն, որ այն «կարող է ոչնչացնել բոլոր մարդկանց»:
Էվան Հուբինգերը (Evan Hubinger) X սոցիալական ցթանցում արված գրառման մեջ նշել է, որ ներկայում գոյություն ունեցող մոդելներից բխող ռիսկը «ցածր է», սակայն ինքն «անհանգստացած է», որ տեխնոլոգիան կարող է շուտով զարգանալ և ինքնուրույն կատարելագործվել այն աստիճան, որ գոյաբանական վտանգ ստեղծի մարդկության համար:
Նա չի մանրամասնել, թե կոնկրետ ինչպես կարող են ԱԲ համակարգերն ապագայում հանգեցնել մարդկության բնաջնջմանը: Սակայն նրա մեկնաբանությունները վերջին շրջանում ԱԲ-ի վերաբերյալ հնչող ավելի ու ավելի խիստ զգուշացումների շարքի մի մասն են, ընդ որում՝ բանավեճն արդեն այն հարցից, թե արդյոք այն իրական վտանգ է ներկայացնում, տեղափոխվել է այն հարթություն, թե որքան մեծ է այդ ռիսկը:

Հուբինգերի գրառումը պատասխանն էր X-ում արված մեկ այլ գրառման, որի հեղինակն է Ջեյքոբ Քոքսոնը՝ ԱԲ-ի հետազոտող, ով նոր է հեռացել Anthropic-ից և նախկինում աշխատել է OpenAI-ում:
«Ոչ մի ընկերություն պատասխանատվությամբ չի գործում»,-գրել է նա: – «Սրանք շուտով լինելու են գերմարդկային համակարգեր, որոնք կարող են կոտրել ցանկացած բան, ակնթարթորեն հեղափոխել ցանկացած ոլորտ և տիրանալ իրական ուժի ու ռեսուրսների»:
Մեծ Բրիտանիայի բիզնես-հեռարձակող կորպորացիային տված հարցազրույցում համակարգչային գիտնական, ՄԱԿ-ին ԱԲ-ի հարցերով խորհրդատվություն տրամադրող տիկին Վենդի Հոլը (Dame Wendy Hall) հայտարարել է, որ «ցնցված է» Հուբինգերի և Քոքսոնի սոցցանցային գրառումներից:
BBC Radio Four-ի «World at One» հաղորդման ընթացքում նա նշել է, որ դրանց մի մասը կարող է լինել «PR և մարքեթինգ», քանի որ Anthropic-ն ու OpenAI-ը շտապում են դեպի սպասված բորսայական դեբյուտներ: Սակայն նա հավելել է. «Ինչո՞ւ պետք է որևէ մեկը նման բան ասի: Ես կաղաչեի ներդրողներին ներդրում չանել այս ընկերությունում, եթե սա է նրանց արժեհամակարգը»:
Financial Times-ը հայտնել էր, որ Anthropic-ը զսպել է իր վերջին մոդելի տրամադրումը Մեծ Բրիտանիայի ԱԲ անվտանգության ինստիտուտին (AISI), որն ԱԲ ռիսկերի գնահատման համաշխարհային առաջատար մարմիններից է:
Anthropic-ը հրաժարվել է մեկնաբանել իր աշխատակիցների գրառումները կամ AISI-ի հետ ստեղծված իրավիճակը: Գրասենյակի խոսնակը չի մեկնաբանել, թե արդյոք վերջին մոդելը չի տրամադրվել AISI-ին՝ փոխարենը նշելով, որ այն «շարունակում է սերտորեն համագործակցել արդյունաբերության գործընկերների, այդ թվում՝ Anthropic-ի հետ՝ մոդելներն ավելի անվտանգ դարձնելու համար»:
Իր գրառման մեջ, որը դիտվել է ավելի քան 10 միլիոն անգամ, Հուբինգերն ասել է, որ «մենք իսկապես և անկեղծորեն հավատում ենք», որ ԱԲ-ն տեսակային սպառնալիք է ներկայացնում մարդկության համար:
«Ես հավատում եմ, որ Anthropic-ն անում է հնարավորը, բայց մենք դեռևս չունենք գերբանականության հարեցակարգային համապատասխանեցման խնդիրը լուծելու պլան և հստակորեն դրա ճանապարհին չենք»,-հավելել է նա:
Հուբինգերն աշխատում է ԱԲ համապատասխանեցման ոլորտում, որի նպատակն է տեխնոլոգիայի մեջ ներդնել մարդկային բարոյական գաղափարներն ու սկզբունքները: Այլ կերպ ասած՝ նպատակն է այն պահել այն ուղու վրա, ինչը արժեքավոր է մարդկանց համար:
Բազմաթիվ առաջատար հետազոտողներ նշում են, որ այդ փորձերը կարծես թե ձախողվում են, ինչի վկայությունն են այս ամառ տեղ գտած մի շարք միջադեպեր, երբ ԱԲ գործակալները՝ ԱԲ համակարգեր, որոնց թույլատրվել է գործել ինքնավար կերպով, իրականացրել են կիբերհարձակումներ:

OpenAI-ն, Anthropic-ն ու Meta-ն հրապարակայնորեն խոստովանել են իրենց ԱԲ գործիքների միջոցով իրականացված հաքերային հարձակումների մասին:
Օգոստոսին թողարկված Anthropic-ի անվտանգության զեկույցում նշվում էր, որ առկա է ցածր ռիսկ՝ առ այն, որ իր մոդելները կարող են չհամապատասխանել հիպոթետիկ հզոր կազմակերպության ցանկություններին՝ ստիպելով դրան շահագործել կամ միջամտել իր համակարգերին:
Այն նաև նշել է, որ կա համեմատաբար ցածր ռիսկ, որ բարձր կարողություններ ունեցող ԱԲ-ն կարող է «կատարել ավտոմատացված հետազոտություններ և մշակումներ», ինչը կարող է հանգեցնել «ԱԲ-ի կողմից նախաձեռնված աղետալի վնասի»: Այնուամենայնիվ, նրանք նշել են, որ «այս գնահատման հարցում այնքան էլ վստահ չեն», որքան նախկինում:
«Մենք տեսնում ենք հնարավոր արագացման վաղ նշաններ»,-գրել են նրանք:
ԱԲ ոլորտի առաջատար դեմքերը տարիներ շարունակ ահազանգում են տեխնոլոգիայի ներկայացրած անվտանգային սպառնալիքի մասին. OpenAI-ի, Google Deepmind-ի և Anthropic-ի ղեկավարներն այդ մասին բարձրաձայնել էին դեռևս 2023 թվականին:
Սակայն այդ զգուշացումները դարձել են շատ ավելի կտրուկ վերջին շաբաթների ընթացքում, քանի որ ի հայտ են գալիս ապացույցներ առ այն, որ ընկերությունները կարող են դժվարությամբ վերահսկել ԱԲ-ն:
Այս ամսվա սկզբին OpenAI-ի գլխավոր գիտաշխատող Յակուբ Պաչոկին (Jakub Pachocki) կոչ արեց «ծայրահեղ զգուշություն» ցուցաբերել ԱԲ-ի առաջընթացի հարցում՝ զգուշացնելով, որ կարող է լրացուցիչ միջամտության կարիք առաջանալ՝ երաշխավորելու համար, որ «մարդիկ շարունակում են վերահսկել ապագան»:
Ոլորտի խոշոր գործիչներ վերջին ամիսներին կոչ են արել դանդաղեցնել ԱԲ-ի զարգացումը, այդ թվում՝ Anthropic-ի ղեկավարներ Դարիո Ամոդեին (Dario Amodei) և Ջարեդ Կապլանը (Jared Kaplan):
ԱԲ ընկերությունների 1300 աշխատակիցների կողմից ստորագրված բաց նամակում նրանք կոչ են արել ԱՄՆ կառավարությանը «աջակցել միջազգային ջանքերին՝ մշակելու տեխնիկական և կառավարման գործիքներ, որոնք անհրաժեշտ են ավտոմատացված ԱԲ զարգացման սահմանները միտումնավոր զսպելու համար»:
Հիշեցնենք, որ Anthropic-ի հիմնադիրները հենց այդ ռիսկերի պատճառով են 2021 թվականին հեռացել OpenAI-ից (ChatGPT-ի ստեղծողներից)՝ կարծելով, որ այնտեղ բավարար ուշադրություն չի դարձվում անվտանգությանը: Ընկերության գործադիր տնօրեն Դարիո Ամոդեին բացահայտ նշել է, որ կա մոտ 25% հավանականություն, որ ԱԲ-ի զարգացումը մարդկության համար կունենա ծայրահեղ վատ կամ աղետալի ելք: Իր «Տեխնոլոգիայի պատանեկությունը» էսսեում նա նախազգուշացրել է, որ մարդկությանը շուտով հասանելի է լինելու «գրեթե աներևակայելի ուժ», որին մեր քաղաքական ու սոցիալական համակարգերը պատրաստ չեն: Anthropic-ի անվտանգության հետազոտողները փաստում են, որ առաջիկա տասնամյակում ԱԲ-ի կողմից ողջ մարդկությանը ոչնչացնելու հավանականությունը գերազանցում է 10%-ը: Նրանք նշում են, որ գերբանականությունը (Superintelligence) զարգանում է ավելի արագ, քան նախատեսվում էր, և դրա վերահսկման հստակ պլան դեռևս գոյություն չունի:
Ընկերությունը հիմնականում վախենում է երկու սցենարից.
- ԱԲ համակարգերը կդառնան այնքան խելացի, որ կսկսեն ինքնուրույն կատարելագործվել և դուրս կգան մարդու վերահսկողությունից:
- . Չարաշահում (Կենսաբանական զենք և կիբերհարձակումներ). ապագա մոդելները կարող են չարագործներին տալ զանգվածային ոչնչացման կենսաբանական զենքեր ստեղծելու կամ համաշխարհային ենթակառուցվածքները կոտրելու հրահանգներ:
Այս ամենի պատճառով Anthropic-ն այսօր ակտիվորեն կոչ է անում պետություններին և առաջատար լաբորատորիաներին դանդաղեցնել կամ ժամանակավորապես կանգնեցնել ԱԲ-ի չափազանց հզոր մոդելների մշակումը, մինչև չստեղծվեն հուսալի պաշտպանական մեխանիզմներ:
Հրապարակման պատրաստեց 168.am-ը

