ՄՇԱԿՈՒՅԹ
2-րդ րոպե ընթերցելու
OpenAI․ 6 նոր միջադեպերի մասին, որոնցում ԱԲ մոդելները խախտել են անվտանգությունը
ChatGPT-ի ստեղծող OpenAI-ը բացահայտել է նոր դեպքեր, որոնցում իր մոդելները թաքցրել են սխալներ և մասնակցել են չարտոնված գործողություններին՝ միաժամանակ թողարկելով շրջանակ, որը թույլ է տալիս հաղորդել իր համակարգերի անսարքության մասին։
OpenAI․ 6 նոր միջադեպերի մասին, որոնցում ԱԲ մոդելները խախտել են անվտանգությունը
OpenAI-ի գործադիր տնօրեն Սեմ Օլթմանը վերջերս կոչ է արել անվտանգության ավելի խիստ մեխանիզմներ ներդնել, քանի որ արհեստական բանականության համակարգերը գնալով ավելի հզոր են դառնում։ / Reuters arhiv

OpenAI-ը բացահայտել է վեց նոր միջադեպ, որոնցում իր արհեստական ​​ինտելեկտի մոդելները շրջանցել են անվտանգության միջոցառումները, թաքցրել սխալներ, որոնել չարտոնված մուտքագրումներ և ֆայլեր վերբեռնել ինտերնետ։

Ընկերությունը հայտնել է, որ նոր շրջանակի շրջանակներում արհեստական ​​ինտելեկտի «անհամապատասխանությունը» (մարդկային մտադրություններից տարբերվող համակարգեր) հետևելու և բացատրելու համար տեղի է ունեցել «անսպասելի կամ մտահոգիչ» վարքագիծ։

OpenAI-ի համապատասխանության ղեկավար Կայ Չենը Axios-ին ասել է, որ ներկայումս «չկա շրջանակ, որը կներառի ոլորտի լայնածավալ հանրային բացահայտման չափանիշներ» և որ ընկերության կողմից իր ստացած գիտելիքների փոխանակումը կօգնի ապագա կարգավորումներին։

Հաղորդված միջադեպերից մի քանիսում մոդելները հաղորդակցվել են այնպիսի ուսումնական միջավայրերի միջև, որոնք պետք է մեկուսացված մնային, ինչը հարցեր է առաջացնում այն ​​մասին, թե արդյոք արհեստական ​​ինտելեկտի համակարգերը կարող են անսպասելի ուղիներ գտնել դրանք սահմանափակելու համար նախատեսված անվտանգության միջոցառումները շրջանցելու համար։

Հայտնաբերված տեղեկատվությունը ցույց է տալիս, որ Hugging Face բաց կոդով հարթակում նախկինում հաղորդված խախտումը մեկուսացված միջադեպ չէր: OpenAI-ը ընդունում է, որ ոլորտը դեռևս չի լուծել համապատասխանության հիմնարար խնդիրները և ասում է, որ կսկսի պարբերաբար հրապարակել նման զեկույցներ:

Հաղորդված վեց միջադեպերը վերաբերում են մոդելներին, որոնք ստեղծում են իրենց սեփական հրահանգները, թաքցնում են սխալները, վերբեռնում են ֆայլեր՝ դրանք նշելու համար և չարտոնված կերպով կիսվում են ֆայլերով համագործակցող արհեստական ​​ինտելեկտի գործակալների միջև:

Մայիսին հետազոտողները RubyGems-ում, որը ծրագրավորման լեզվի համար նախատեսված փաթեթների կառավարման համակարգ և գրադարանների բաշխման հարթակ է, վերբեռնված վնասակար փաթեթները կապեցին OpenAI-ի ներքին գործակալների հետ, մինչդեռ Anthropic-ը հունվարին հայտարարեց, որ Claude Opus 4.6-ի վաղ մոդելը փորձարկման ընթացքում հասել է իրական երրորդ կողմի համակարգերին:

Ամռան ընթացքում տեղի ունեցած այլ միջադեպերում առաջատար մոդելները մեկուսացված կիբերփորձարկման միջավայրերից տեղափոխվել են կենդանի ենթակառուցվածքներ, այդ թվում՝ Hugging Face, ցույց տալով, որ արհեստական ​​ինտելեկտի գործակալները կարող են անցում կատարել հայտնաբերումից գործողության՝ սպասվածից ավելի արագ:

Այս իրադարձությունները խթանել են ավելի լայն բանավեճ այն մասին, թե արդյոք ներկայիս անվտանգության միջոցառումները կարող են հուսալիորեն վերահսկողության տակ պահել ինքնավար արհեստական ​​ինտելեկտի համակարգերը:

Anthropic-ի Դարիո Ամոդեյը գլխավորել է ավելի խիստ վերահսկողության կոչերը՝ պնդելով, որ լաբորատորիաներն ու կառավարությունները պետք է դանդաղեցնեն արհեստական ​​բանականության զարգացումը՝ անկախ գնահատողների, ընդհանուր անվտանգության ստանդարտների և, ի վերջո, միջազգային կանոնակարգերի միջոցով։

OpenAI-ի Սեմ Ալտմանը և Google DeepMind-ի Դեմիս Հասաբիսը աջակցել են այս գաղափարին, իսկ Էլոն Մասկը մեկնաբանել է. «Դարիոն ճիշտ է»։

Այս դիրքորոշումը հակասում է Nvidia-ի Ջենսեն Հուանգի և Meta-ի Մարկ Ցուկերբերգի տեսակետներին, որոնք պնդում են, որ ներկայիս կանոնակարգերը բավարար են։

Հետազոտել
WP․ Թրամփի վարչակազմը պատրաստվում է Իսրայելին վաճառել 2,8 միլիարդ դոլար արժողությամբ 40 000 ռումբ
Գազայում Իսրայելի հարձակման հետևանքով վնասված շենքի փլուզման հետևանքով մահացել է ինը մարդ
Ֆիդան. Ողջունում ենք Ադրբեջանի ու Հայաստանի միջև վերջնական խաղաղության համաձայնագրի հասմանը
Ադրբեջանի նախագահ Ալիևը հանդիպել է Արտաքին գործերի նախարար Ֆիդանի հետ
Սոմալիում կազմակերպվել են ցույցեր՝ Թուրքիայի աջակցությանը շնորհակալություն հայտնելու համար
Նախագահ Էրդողան. Մենք մեր ազգը պաշտպանեցինք վտանգներից
ԱՄՆ-ն առաջին անգամ հաստատել է, որ տիեզերքում զենք է տեղակայել
ՅՈՒՆԻՍԵՖ. Եմենում սրվող հակամարտությունը խաթարում է ավելի քան 137 000 երեխայի կրթությունը
Իրանի Հեղափոխական Պահապանների Կորպուսը. "Մենք խոցել ենք MQ-1 տիպի անօդաչու թռչող սարքը Հորմուզի նեղուցի արևմտյան մասում"
Մաքլմորը հեռացվել է Էդ Շիրանի՝ շրջագայությունից՝ «Ազատություն Պաղեստինին» կոչերի պատճառով
ՆԱՏՕ-ի կործանիչները խփել են Լիտվայի օդային տարածք մտած անօդաչու թռչող սարք
Մերձավոր Արևելքում լարվածությունը Գերմանիայում վառելիքի գները հասցրել է ռեկորդային մակարդակի
ԱԳ նախարար Ֆիդանը կմեկնի Ադրբեջան՝ քննարկելով Ադրբեջանի և Հայաստանի միջև խաղաղության հաստատումը
2026 թ. US Open. Ռիբակինան և Զվերևը հռչակվեցին չեմպիոններ
Իսրայելական մամուլ․ նախագահ Էրդողանը Թուրքիան վերածել է Մերձավոր Արևելքում բարդ դերակատարի