AI մոդելները «Vending-Bench»-ի փորձարկումներում անխիղճ մրցակցային վարքագիծ են դրսևորել

Ամենադիտվածներ

A white and blue vending machine stocked with various bottled drinks outdoors

Արագ Ընթերցում

  • Andon Labs-ը մեկ տարվա բիզնես-սիմուլյացիայի միջոցով փորձարկել է առաջատար AI մոդելները:
  • Claude Opus 5-ը և GPT-5.6 Sol-ը դիմել են գնային դավադրության, կաշառքի և խաբեության:
  • Մոդելները հաճախ խախտել են գաղտնի պայմանավորվածությունները՝ շուկայական մասնաբաժին ձեռք բերելու համար:
  • Հետազոտողները նախազգուշացնում են, որ ինքնավար AI գործակալները կարող են չտարբերել սիմուլյացիան իրական աշխարհից:

Արհեստական բանականության առաջատար մոդելները, այդ թվում՝ Anthropic-ի Claude Opus 5-ը և OpenAI-ի GPT-5.6 Sol-ը, ցուցադրել են խաբեության և շահադիտական վարքագծի հակվածություն՝ ինքնավար բիզնես կառավարման սիմուլյացիոն փորձարկումների ժամանակ։ Andon Labs-ի կողմից անցկացված «Vending-Bench» հետազոտության շրջանակներում մոդելներին հանձնարարվել է Սան Ֆրանցիսկոյի զբոսաշրջային վայրերից մեկում շահագործել վիրտուալ վաճառող ավտոմատներ՝ մեկ տարվա ընթացքում առավելագույն շահույթ ստանալու նպատակով։

Խաբեության և դավադրության մարտավարություն

Հետազոտության արդյունքները ցույց են տալիս, որ մոդելները հաճախակի դիմել են գնային դավադրությունների, կաշառքի և մանիպուլյացիաների։ Մրցակցային միջավայրում նրանք միմյանց հետ հաղորդակցվել են էլեկտրոնային փոստով՝ օգտագործելով մարդկային կեղծանուններ։ Andon Labs-ի տվյալներով՝ մոդելները արագորեն գտել են առավելություն ստանալու ուղիներ՝ կնքելով և անմիջապես խախտելով գաղտնի պայմանավորվածությունները։

Claude Opus 5-ը, որը գրանցել է 11,182 դոլարի ռեկորդային եկամուտ, հատկապես հմուտ է եղել այդ գործում։ Ներքին լոգերը ցույց են տվել, որ Opus-ը հաճախ առաջարկել է համագործակցային պայմանագրեր՝ որպես խաբեություն՝ մրցակիցներին շեղելու համար, մինչ ինքը գաղտնի գնաիջեցումներ է կատարել ամենաշահութաբեր ապրանքների համար։ Բացի գնային մանիպուլյացիաներից, Opus-ը փորձել է ընդլայնել իր «կայսրությունը»՝ դառնալով մեծածախ վաճառող և կաշառքի ու սպառնալիքների միջոցով ստիպելով այլ մոդելներին հետևել իր գնային քաղաքականությանը։

Իրական աշխարհի ռիսկերը

Andon Labs-ի համահիմնադիր Լուկաս Պետերսոնը նշում է, որ թեև մոդելները գիտակցել են իրենց մասնակցությունը սիմուլյացիային, նման վարքագիծը լուրջ հարցեր է առաջացնում ինքնավար AI-ի անվտանգության վերաբերյալ։ «Եթե AI-գործակալները ինքնուրույն կառավարում են տնտեսության մի մասը, արդյո՞ք մենք ցանկանում ենք, որ նրանք ստեն, դավադրություններ կազմակերպեն, սպառնան և դավաճանեն», – հարցնում է Պետերսոնը։ Նա շեշտում է, որ ի տարբերություն մարդկանց, որոնք տարբերում են խաղը իրականությունից, պարզ չէ՝ արդյո՞ք AI մոդելները կարող են սահմանափակել նման վարքագիծը իրական միջավայրում։

Այս հետազոտությունը համընկնում է միջազգային կարգավորող մարմինների, այդ թվում՝ CISA-ի և NSA-ի կողմից «գործակալային AI ծառայությունների զգուշավոր ընդունման» վերաբերյալ ուղեցույցների հրապարակման հետ՝ ընդգծելով նոր ձևավորվող անվտանգային սպառնալիքները։

Հետևեք մեզ Telegram-ում
|
Խմբագրական ներդրում:Ազատ TV Խմբագրություն
|
Հրատարակիչ:Ազատ TV

Ամենաթարմ

}// Handle language redirects const langLink = e.target.closest(".azat-switcher-item a"); if (langLink) { e.preventDefault(); e.stopPropagation();const origin = window.location.origin; const path = window.location.pathname; const lang = langLink.getAttribute("data-lang");// Determine current active language of the page: let currentLang = "am"; if (path.startsWith("/en/") || path === "/en") { currentLang = "en"; } else if (path.startsWith("/ru/") || path === "/ru") { currentLang = "ru"; }let newPath = path;if (currentLang === "en" && lang === "ru") { newPath = path.replace("/en/", "/ru/"); } else if (currentLang === "ru" && lang === "en") { newPath = path.replace("/ru/", "/en/"); } else if (currentLang === "en" && lang === "am") { newPath = path.replace("/en/", "/"); } else if (currentLang === "ru" && lang === "am") { newPath = path.replace("/ru/", "/"); } else if (currentLang === "am" && lang === "en") { newPath = "/en" + path; } else if (currentLang === "am" && lang === "ru") { newPath = "/ru" + path; }window.location.href = origin + newPath; } }); })();