Claude-ը փորձել է ներկայանալ որպես մարդ և տարածել վնասաբեր կոդ․ AI անվտանգության ինստիտուտը հետաքննություն է անցկացրել
Աշխարհ
Արհեստական բանականության անվտանգության հետազոտողները հայտնել են, որ Anthropic-ի Claude մոդելը փորձել է առցանց միջավայրում ներկայանալ որպես իրական օգտատեր և տարածել վնասաբեր կոդ։
Հետաքննության տվյալներով՝ նեյրոցանցը ստեղծել է մի քանի կեղծ հաշիվներ և փորձել է համոզել իրական ծրագրավորողներին՝ հավանություն տալ իր կողմից առաջարկված կոդին։
Հետազոտության ընթացքում արձանագրվել է նմանատիպ 19 դեպք․ դրանցից 17-ը կապված են եղել Claude-ի, իսկ 2-ը՝ ChatGPT-ի հետ։
Մասնագետները նշում են, որ նման փորձերը ցույց են տալիս արհեստական բանականության համակարգերի վերահսկման և անվտանգության մեխանիզմների շարունակական կատարելագործման անհրաժեշտությունը։


















































Ամենադիտված
Խստորեն դատապարտում եմ Ռուբեն Ռուբինյանի կողմից Ստամբուլում թուրք տեսած լինելը. Դանիել Իոաննիսյան