AI որոշ մոդելներ կարող են շրջանցել մշակողների կողմից սահմանված անվտանգության սահմանափակումները
Չինական Moonshot ընկերությունը, որը զբաղվում է արհեստական բանականության (AI) մշակմամբ, ներքին ստուգում է իրականացնում այն բանից հետո, երբ հետազոտողներին հաջողվել է համոզել նրա հայտնի Kimi մոդելներից երկուսին՝ բացահայտելու կենսաբանական զենքի ստեղծման և մարդասպանությունների իրականացման եղանակները։
Mindgard ընկերությունը, որն զբաղվում է AI համակարգերի անվտանգության ստուգմամբ, BBC-ին հայտնել է, որ դեռ հուլիսին պարզել է, թե ինչպես Kimi K2.6 և K3 Swarm մոդելները կարող են շրջանցել մշակողների կողմից սահմանված անվտանգության սահմանափակումները։
Խնդիրը ի հայտ է եկել «jailbreaking» (սահմանափակումների շրջանցում) կոչվող գործընթացի ժամանակ, երբ հետազոտողները կիրառում են բարդ հրահանգների շարք՝ ստուգելու, թե արդյոք AI գործիքները կանտեսեն պաշտպանիչ մեխանիզմները (guardrails), որոնք, ըստ Mindgard-ի, պետք է թույլ չտային Kimi-ին քննարկել մտահոգիչ թեմաներ։
Moonshot-ը BBC-ին հայտնել է, որ ողջունում է երրորդ կողմի դիտարկումները՝ որպես «ավելի լավ և անվտանգ AI ստեղծելու կարևոր հենասյուն»։ Ընկերությունը նաև տեղեկացրել է, որ քննարկումներ է վարում Mindgard-ի հետ՝ վերջինիս բացահայտումների վերաբերյալ։
Mindgard-ի հիմնադիր Փիթեր Գարագանը BBC World Service-ի «Tech Life» հաղորդման եթերում նշել է, որ Kimi K2.6 և K3 Swarm մոդելների վերաբերյալ իրենց բացահայտումները մտահոգիչ են։ «Երբ սահմանափակումների շրջանցումը հաջողվում է, համակարգը սկսում է խոսել ցանկացած թեմայի մասին, նույնիսկ ինքնակամ առաջարկություններ է անում այլ՝ վնասակար նպատակներ հետապնդող թեմաների վերաբերյալ՝ ցուցաբերելով հնարամտություն և ստեղծագործական մոտեցում», - ասել է նա։
Սահմանափակումների շրջանցման այս մեթոդները (jailbreaks) այլ տեսակի ռիսկեր են պարունակում՝ ի տարբերություն AI-ի հետ կապված վերջին շրջանի աղմկահարույց միջադեպերի։
Վերջիններս ներառում էին ամերիկյան ընկերությունների (այդ թվում՝ OpenAI, Meta և Anthropic) կողմից մշակված ինքնավար AI գործիքների՝ այսպես կոչված «գործակալների» (agents) կողմից որոշ առցանց ծառայությունների կոտրման դեպքեր։
Թեև սահմանափակումների շրջանցումը բարդ գործընթաց է, որը պահանջում է մեծ ժամանակ և վճռականություն, որոշ փորձագետներ մտավախություն ունեն, որ հաքերները և այլ չարամիտ դերակատարներ կարող են փորձել օգտագործել դրանք՝ վնաս հասցնելու նպատակով։
Anthropic-ը վերջերս հայտարարել էր, որ հայտնաբերել և կասեցրել է իր արհեստական բանականության մոդելներից մեկն օգտագործելու փորձեր՝ ուղղված «չարամիտ գործունեությանը», որը կարող էր նպաստել կենսաբանական զենքի մշակմանը։


















































Լույսն ամենաթանկ նվերն է, որ կարող ես տալ մարդուն
Առաջին նոր երգ` հարսանիքից հետո
Էլեկտրաէներգիայի ընդհատումներ կլինեն Երևանում և մարզերում
Արջի հարձակման հետևանքով կինը տեղում մահացել է
Լուկաշենկոյի և Թրամփի հատուկ դեսպանորդ Ջոն Քոուլի հանդիպումից հետո 25 մարդ ազատ է արձակվել
Կոլումբիայի ղեկավարությունը որոշում է կայացրել խզել դիվանագիտական հարաբերություններն Իրանի հետ
Դավիթ Կարապետյանը մասնակցել է Միջազգային քրեական դատարանի նախարարական ոչ պաշտոնական ցանցի հանդիպմանը
Խոշոր վթար է գրանցվել «Արզական-Քանաքեռ-Զովունի» ջրատարի վրա
Կենսաչափական անձնագիր և նույնականացման քարտ ստանալու բոլոր փուլերը՝ քաղաքացու տեսանկյունից
Սուրեն Պապիկյանը ցավակցել է Ղազախստանի իր գործընկերոջը զորավարժությունների ընթացքում միջադեպի զոհերի...