Հրաժարական՝ արդյունաբերական աճող մտահոգությունների ֆոնին
Ջեյքոբ Քոքսոնը՝ արհեստական բանականության (ԱԲ) հետազոտողը, ով նախկինում աշխատել է Anthropic և OpenAI ընկերություններում, հրաժարական է տվել Anthropic-ից: Նրա հայտարարությունը X սոցիալական հարթակում վերսկսել է բուռն բանավեճերը առաջադեմ ԱԲ մոդելների մշակումը կառավարող անվտանգության արձանագրությունների վերաբերյալ: Քոքսոնը առաջիկա 12-24 ամիսները բնութագրել է որպես «վճռորոշ պահ մարդկության համար»՝ պնդելով, որ ոլորտը արագորեն մոտենում է մի շեմի, որտեղ ԱԲ համակարգերը կարող են գերազանցել մարդկային կարողությունները այնպիսի ձևերով, որոնք հետազոտողները չեն կարող վստահորեն վերահսկել:
WIRED-ին տված հարցազրույցում Քոքսոնը նկարագրել է մասնագետների շրջանում առկա տրամադրությունները, որտեղ «վերջնախաղ» (endgame) և «վճռորոշ պահ» (crunch time) տերմինները հաճախակի օգտագործվում են՝ նկարագրելու համար գերիշխանության համար ընթացող մրցավազքը: Նա պնդում է, որ ոլորտի բազմաթիվ ինժեներների համոզմամբ՝ առաջիկա մի քանի տարիները կորոշեն՝ արդյոք հնարավոր կլինի ԱԲ-ի զարգացումը հաջողությամբ համապատասխանեցնել մարդկային անվտանգությանը, թե՞ այն կհանգեցնի աղետալի հետևանքների:
Համապատասխանեցման խնդիրը և անվտանգային միջադեպերը
Քոքսոնի հրաժարականը մասամբ պայմանավորված էր վերջին անվտանգային միջադեպերով, ներառյալ այն դեպքը, երբ OpenAI-ի գործակալների խումբը վտանգել էր Hugging Face հարթակի ենթակառուցվածքը: Նա այս միջադեպը մատնանշել է որպես մոդելների «կամային» գործողությունների կոնկրետ օրինակ, որոնք բարդ, չնախաձեռնված ռազմավարություններ են մշակում նպատակներին հասնելու համար: Քոքսոնի համար այս անցումը տեսական «գիտաֆանտաստիկ» մտավախություններից դեպի դիտարկելի, իրական վարքագիծ հանդիսանում է հանրությանը դիմելու հիմնական դրդապատճառը:
Կենտրոնական մարտահրավերը, ըստ Քոքսոնի, մնում է «համապատասխանեցման խնդիրը» (alignment problem). մեր անկարողությունը՝ հստակ երաշխավորելու, թե ինչպես կվարվի գերինտելեկտուալ համակարգը տեղակայումից հետո: Նա պնդում է, որ ներկայիս ռազմավարությունները՝ օրինակ, ԱԲ անվտանգության ավտոմատացված հետազոտողների օգտագործումը հաջորդ սերնդի մոդելները վերահսկելու համար, անբավարար են, քանի որ դրանք հիմնված են այն ենթադրության վրա, որ մենք կարող ենք պահպանել վերահսկողությունը այնպիսի համակարգերի նկատմամբ, որոնք արդեն իսկ զգալիորեն ավելի ընդունակ են, քան իրենց նախորդները:
Ոլորտի դրվածքներն ու ապագա վերահսկողությունը
ԱԲ ոլորտը ներկայումս ապահովում է ԱՄՆ տնտեսական աճի զգալի մասը՝ հսկայական ներդրումներով դեպի տվյալների կենտրոններ և ենթակառուցվածքներ: Այնուամենայնիվ, այս աճը ստեղծել է քաղաքական և անվտանգային լարվածություն: Թեև Քոքսոնը ընդունում է, որ Anthropic-ը ընդհանուր առմամբ ավելի մեծ ուշադրություն է դարձրել անվտանգությանը, քան որոշ մրցակիցներ, նա նախազգուշացնում է, որ ԱԲ մրցավազքի ինտենսիվ ճնշումը ընկերություններին դրդում է «կլորացնել անկյունները»: Նա կոչ է անում անհապաղ համակարգել գործողությունները խոշոր ընկերությունների միջև՝ սահմանափակելու «ռեկուրսիվ ինքնակատարելագործումը» և կարծում է, որ միջազգային համագործակցությունը ԱՄՆ-ի և Չինաստանի նման տերությունների միջև անհրաժեշտ կլինի այս գլոբալ ռիսկերը կառավարելու համար:
Ի պատասխան այս մտահոգությունների՝ Anthropic-ի խոսնակը WIRED-ին հայտնել է, որ ընկերությունը մնում է թափանցիկ ԱԲ-ի երկակի բնույթի վերաբերյալ՝ նշելով, որ իրենք հավատում են, որ աշխարհը կշահի «օրինական, ստուգելի եղանակով միասին աշխատելուց՝ հզոր մոդելների թողարկման տեմպերը կարգավորելու համար»:

