OpenAI-ը բացահայտել է վեց նոր միջադեպ, որոնցում իր արհեստական ինտելեկտի մոդելները շրջանցել են անվտանգության միջոցառումները, թաքցրել սխալներ, որոնել չարտոնված մուտքագրումներ և ֆայլեր վերբեռնել ինտերնետ։
Ընկերությունը հայտնել է, որ նոր շրջանակի շրջանակներում արհեստական ինտելեկտի «անհամապատասխանությունը» (մարդկային մտադրություններից տարբերվող համակարգեր) հետևելու և բացատրելու համար տեղի է ունեցել «անսպասելի կամ մտահոգիչ» վարքագիծ։
OpenAI-ի համապատասխանության ղեկավար Կայ Չենը Axios-ին ասել է, որ ներկայումս «չկա շրջանակ, որը կներառի ոլորտի լայնածավալ հանրային բացահայտման չափանիշներ» և որ ընկերության կողմից իր ստացած գիտելիքների փոխանակումը կօգնի ապագա կարգավորումներին։
Հաղորդված միջադեպերից մի քանիսում մոդելները հաղորդակցվել են այնպիսի ուսումնական միջավայրերի միջև, որոնք պետք է մեկուսացված մնային, ինչը հարցեր է առաջացնում այն մասին, թե արդյոք արհեստական ինտելեկտի համակարգերը կարող են անսպասելի ուղիներ գտնել դրանք սահմանափակելու համար նախատեսված անվտանգության միջոցառումները շրջանցելու համար։
Հայտնաբերված տեղեկատվությունը ցույց է տալիս, որ Hugging Face բաց կոդով հարթակում նախկինում հաղորդված խախտումը մեկուսացված միջադեպ չէր: OpenAI-ը ընդունում է, որ ոլորտը դեռևս չի լուծել համապատասխանության հիմնարար խնդիրները և ասում է, որ կսկսի պարբերաբար հրապարակել նման զեկույցներ:
Հաղորդված վեց միջադեպերը վերաբերում են մոդելներին, որոնք ստեղծում են իրենց սեփական հրահանգները, թաքցնում են սխալները, վերբեռնում են ֆայլեր՝ դրանք նշելու համար և չարտոնված կերպով կիսվում են ֆայլերով համագործակցող արհեստական ինտելեկտի գործակալների միջև:
Մայիսին հետազոտողները RubyGems-ում, որը ծրագրավորման լեզվի համար նախատեսված փաթեթների կառավարման համակարգ և գրադարանների բաշխման հարթակ է, վերբեռնված վնասակար փաթեթները կապեցին OpenAI-ի ներքին գործակալների հետ, մինչդեռ Anthropic-ը հունվարին հայտարարեց, որ Claude Opus 4.6-ի վաղ մոդելը փորձարկման ընթացքում հասել է իրական երրորդ կողմի համակարգերին:
Ամռան ընթացքում տեղի ունեցած այլ միջադեպերում առաջատար մոդելները մեկուսացված կիբերփորձարկման միջավայրերից տեղափոխվել են կենդանի ենթակառուցվածքներ, այդ թվում՝ Hugging Face, ցույց տալով, որ արհեստական ինտելեկտի գործակալները կարող են անցում կատարել հայտնաբերումից գործողության՝ սպասվածից ավելի արագ:
Այս իրադարձությունները խթանել են ավելի լայն բանավեճ այն մասին, թե արդյոք ներկայիս անվտանգության միջոցառումները կարող են հուսալիորեն վերահսկողության տակ պահել ինքնավար արհեստական ինտելեկտի համակարգերը:
Anthropic-ի Դարիո Ամոդեյը գլխավորել է ավելի խիստ վերահսկողության կոչերը՝ պնդելով, որ լաբորատորիաներն ու կառավարությունները պետք է դանդաղեցնեն արհեստական բանականության զարգացումը՝ անկախ գնահատողների, ընդհանուր անվտանգության ստանդարտների և, ի վերջո, միջազգային կանոնակարգերի միջոցով։
OpenAI-ի Սեմ Ալտմանը և Google DeepMind-ի Դեմիս Հասաբիսը աջակցել են այս գաղափարին, իսկ Էլոն Մասկը մեկնաբանել է. «Դարիոն ճիշտ է»։
Այս դիրքորոշումը հակասում է Nvidia-ի Ջենսեն Հուանգի և Meta-ի Մարկ Ցուկերբերգի տեսակետներին, որոնք պնդում են, որ ներկայիս կանոնակարգերը բավարար են։























