Anthropic-ը Claude AI-ում ներդրել է անտեսանելի ջրանիշեր՝ ԵՄ կանոնակարգերին համապատասխանելու համար

Ամենադիտվածներ

A smartphone screen displaying the orange Claude AI logo resting on a laptop keyboard

Արագ Ընթերցում

  • Anthropic-ը Claude AI-ի պատասխաններում ներդնում է անտեսանելի ջրանիշեր՝ ԵՄ AI-ի մասին օրենքին համապատասխանելու համար:
  • Ջրանիշը օգտագործում է կրիպտոգրաֆիկ բանալի՝ բառերի ընտրության վրա ազդելու համար՝ ստեղծելով վիճակագրական օրինաչափություն:
  • Ընկերության ներքին թեստերի համաձայն՝ ֆունկցիան չի ազդում տեքստի որակի, արագության կամ արժեքի վրա:
  • Ձեռքով խորը խմբագրումը կարող է հեռացնել ջրանիշը՝ տեքստը դարձնելով անբացահայտելի որպես AI-ի կողմից ստեղծված:
  • Ընկերությունը նախատեսում է թողարկել API՝ երրորդ կողմերի համար տեքստի իսկությունը ստուգելու նպատակով:

Արհեստական բանականության թափանցիկության նոր չափանիշը

Anthropic ընկերությունը սկսել է իր Claude AI մոդելների կողմից գեներացվող տեքստերում ներդնել անտեսանելի, մեքենայական ընթերցման համար նախատեսված ջրանիշեր։ Այս տեխնիկական թարմացումը, որը ներդրվում է գլոբալ մակարդակով, նպատակ ունի բացահայտել AI-ի կողմից ստեղծված բովանդակությունը՝ ազդելով մոդելի բառընտրության օրինաչափությունների վրա։ Այս քայլը հետևում է 2026 թվականի օգոստոսի 2-ին ուժի մեջ մտած Եվրոպական միության AI-ի մասին օրենքին (AI Act), որը պահանջում է AI մատակարարներից հստակ մակնշել գեներացված բովանդակությունը՝ թափանցիկությունն ապահովելու համար։

Թեև ջրանիշն անտեսանելի է մարդու աչքի համար, այն գործում է գեներացման գործընթացում կրիպտոգրաֆիկ բանալու օգտագործման միջոցով։ Երբ Claude-ը բախվում է այնպիսի իրավիճակի, որտեղ մի քանի բառեր հավասարապես տեղին են, մոդելը ընտրություն է կատարում՝ հիմնվելով այդ բանալու վրա, այլ ոչ թե պատահական հավանականության։ Սա ստեղծում է վիճակագրական ստորագրություն, որը հետագայում կարող է ստուգվել ապագայում թողարկվելիք API-ի միջոցով։

Տեխնիկական ճշգրտություն և կարգավորող համապատասխանություն

Ներդրումը բանավեճ է առաջացրել լեզվական որակի վրա դրա հնարավոր ազդեցության վերաբերյալ։ Anthropic-ը պնդում է, որ ջրանիշը չի նվազեցնում Claude-ի արտադրողականությունը՝ վկայակոչելով ներքին թեստերը, որոնք ցույց են տալիս ստեղծագործականության, ճշգրտության կամ ընթեռնելիության որևէ չափելի տարբերություն։ Բացի այդ, ընկերությունը պարզաբանել է, որ գործընթացը չի ավելացնում լրացուցիչ տոկեններ, ինչը նշանակում է, որ այն չի դանդաղեցնում Claude-ի աշխատանքը և չի բարձրացնում օգտատերերի համար ծախսերը։

Այնուամենայնիվ, քննադատները մտահոգություններ են հայտնել առանձնահատկությունների փիլիսոփայության վերաբերյալ։ Տեխնոլոգիական բլոգեր Ջոն Գրուբերը (Daring Fireball) մոտեցումը որակել է որպես «գրելու արվեստի աղավաղում»՝ պնդելով, որ լեզվական մոդելները պետք է առաջնահերթություն տան ամենաճշգրիտ բառերին, այլ ոչ թե սահմանափակվեն ջրանիշով։ Չնայած այս մտահոգություններին, Anthropic-ը հայտնում է, որ հայտարարությունից հետո բաժանորդագրությունների չեղարկման վիճակագրորեն նշանակալի աճ չի նկատվել։

Սահմանափակումներ և ոլորտային հետևանքներ

Ջրանիշի արդյունավետությունը ենթակա է որոշակի տեխնիկական սահմանափակումների։ Քանի որ համակարգը հիմնված է նուրբ վիճակագրական օրինաչափությունների վրա, այն պակաս հուսալի է շատ կարճ հատվածների դեպքում, որտեղ անալիզի համար բավարար տվյալներ չկան։ Բացի այդ, ջրանիշը նախատեսված է հետևելու Claude-ի օրիգինալ արդյունքին. մարդու կողմից կատարված խորը խմբագրումը կարող է ամբողջությամբ ջնջել տեքստից այդ ազդանշանը։ Այն դեպքերում, երբ տեքստը զգալիորեն փոփոխվել է, ընկերությունը նշում է, որ այն կարող է այլևս չհամարվել իմաստալից կերպով AI-ի կողմից ստեղծված բովանդակություն։

Աղբյուրներ

Հետևեք մեզ Telegram-ում
|
Հրապարակող:Ազատ TV Խմբագրություն

Ամենաթարմ