ՄՇԱԿՈՒՅԹ
2-րդ րոպե ընթերցելու
OpenAI․ 6 նոր միջադեպերի մասին, որոնցում ԱԲ մոդելները խախտել են անվտանգությունը
ChatGPT-ի ստեղծող OpenAI-ը բացահայտել է նոր դեպքեր, որոնցում իր մոդելները թաքցրել են սխալներ և մասնակցել են չարտոնված գործողություններին՝ միաժամանակ թողարկելով շրջանակ, որը թույլ է տալիս հաղորդել իր համակարգերի անսարքության մասին։
OpenAI․ 6 նոր միջադեպերի մասին, որոնցում ԱԲ մոդելները խախտել են անվտանգությունը
OpenAI-ի գործադիր տնօրեն Սեմ Օլթմանը վերջերս կոչ է արել անվտանգության ավելի խիստ մեխանիզմներ ներդնել, քանի որ արհեստական բանականության համակարգերը գնալով ավելի հզոր են դառնում։ / Reuters arhiv

OpenAI-ը բացահայտել է վեց նոր միջադեպ, որոնցում իր արհեստական ​​ինտելեկտի մոդելները շրջանցել են անվտանգության միջոցառումները, թաքցրել սխալներ, որոնել չարտոնված մուտքագրումներ և ֆայլեր վերբեռնել ինտերնետ։

Ընկերությունը հայտնել է, որ նոր շրջանակի շրջանակներում արհեստական ​​ինտելեկտի «անհամապատասխանությունը» (մարդկային մտադրություններից տարբերվող համակարգեր) հետևելու և բացատրելու համար տեղի է ունեցել «անսպասելի կամ մտահոգիչ» վարքագիծ։

OpenAI-ի համապատասխանության ղեկավար Կայ Չենը Axios-ին ասել է, որ ներկայումս «չկա շրջանակ, որը կներառի ոլորտի լայնածավալ հանրային բացահայտման չափանիշներ» և որ ընկերության կողմից իր ստացած գիտելիքների փոխանակումը կօգնի ապագա կարգավորումներին։

Հաղորդված միջադեպերից մի քանիսում մոդելները հաղորդակցվել են այնպիսի ուսումնական միջավայրերի միջև, որոնք պետք է մեկուսացված մնային, ինչը հարցեր է առաջացնում այն ​​մասին, թե արդյոք արհեստական ​​ինտելեկտի համակարգերը կարող են անսպասելի ուղիներ գտնել դրանք սահմանափակելու համար նախատեսված անվտանգության միջոցառումները շրջանցելու համար։

Հայտնաբերված տեղեկատվությունը ցույց է տալիս, որ Hugging Face բաց կոդով հարթակում նախկինում հաղորդված խախտումը մեկուսացված միջադեպ չէր: OpenAI-ը ընդունում է, որ ոլորտը դեռևս չի լուծել համապատասխանության հիմնարար խնդիրները և ասում է, որ կսկսի պարբերաբար հրապարակել նման զեկույցներ:

Հաղորդված վեց միջադեպերը վերաբերում են մոդելներին, որոնք ստեղծում են իրենց սեփական հրահանգները, թաքցնում են սխալները, վերբեռնում են ֆայլեր՝ դրանք նշելու համար և չարտոնված կերպով կիսվում են ֆայլերով համագործակցող արհեստական ​​ինտելեկտի գործակալների միջև:

Մայիսին հետազոտողները RubyGems-ում, որը ծրագրավորման լեզվի համար նախատեսված փաթեթների կառավարման համակարգ և գրադարանների բաշխման հարթակ է, վերբեռնված վնասակար փաթեթները կապեցին OpenAI-ի ներքին գործակալների հետ, մինչդեռ Anthropic-ը հունվարին հայտարարեց, որ Claude Opus 4.6-ի վաղ մոդելը փորձարկման ընթացքում հասել է իրական երրորդ կողմի համակարգերին:

Ամռան ընթացքում տեղի ունեցած այլ միջադեպերում առաջատար մոդելները մեկուսացված կիբերփորձարկման միջավայրերից տեղափոխվել են կենդանի ենթակառուցվածքներ, այդ թվում՝ Hugging Face, ցույց տալով, որ արհեստական ​​ինտելեկտի գործակալները կարող են անցում կատարել հայտնաբերումից գործողության՝ սպասվածից ավելի արագ:

Այս իրադարձությունները խթանել են ավելի լայն բանավեճ այն մասին, թե արդյոք ներկայիս անվտանգության միջոցառումները կարող են հուսալիորեն վերահսկողության տակ պահել ինքնավար արհեստական ​​ինտելեկտի համակարգերը:

Anthropic-ի Դարիո Ամոդեյը գլխավորել է ավելի խիստ վերահսկողության կոչերը՝ պնդելով, որ լաբորատորիաներն ու կառավարությունները պետք է դանդաղեցնեն արհեստական ​​բանականության զարգացումը՝ անկախ գնահատողների, ընդհանուր անվտանգության ստանդարտների և, ի վերջո, միջազգային կանոնակարգերի միջոցով։

OpenAI-ի Սեմ Ալտմանը և Google DeepMind-ի Դեմիս Հասաբիսը աջակցել են այս գաղափարին, իսկ Էլոն Մասկը մեկնաբանել է. «Դարիոն ճիշտ է»։

Այս դիրքորոշումը հակասում է Nvidia-ի Ջենսեն Հուանգի և Meta-ի Մարկ Ցուկերբերգի տեսակետներին, որոնք պնդում են, որ ներկայիս կանոնակարգերը բավարար են։

Հետազոտել
Թուրքիան նույնպես ջրի տակ «նոր էջ» կբացի
Ֆիդան. Ողջունում ենք Ադրբեջանի ու Հայաստանի միջև վերջնական խաղաղության համաձայնագրի հասմանը
Ադրբեջանի նախագահ Ալիևը հանդիպել է Արտաքին գործերի նախարար Ֆիդանի հետ
Սոմալիում կազմակերպվել են ցույցեր՝ Թուրքիայի աջակցությանը շնորհակալություն հայտնելու համար
Նախագահ Էրդողան. Մենք մեր ազգը պաշտպանեցինք վտանգներից
ԱՄՆ-ն առաջին անգամ հաստատել է, որ տիեզերքում զենք է տեղակայել
ՅՈՒՆԻՍԵՖ. Եմենում սրվող հակամարտությունը խաթարում է ավելի քան 137 000 երեխայի կրթությունը
Իրանի Հեղափոխական Պահապանների Կորպուսը. "Մենք խոցել ենք MQ-1 տիպի անօդաչու թռչող սարքը Հորմուզի նեղուցի արևմտյան մասում"
Մաքլմորը հեռացվել է Էդ Շիրանի՝ շրջագայությունից՝ «Ազատություն Պաղեստինին» կոչերի պատճառով
ՆԱՏՕ-ի կործանիչները խփել են Լիտվայի օդային տարածք մտած անօդաչու թռչող սարք
Մերձավոր Արևելքում լարվածությունը Գերմանիայում վառելիքի գները հասցրել է ռեկորդային մակարդակի
ԱԳ նախարար Ֆիդանը կմեկնի Ադրբեջան՝ քննարկելով Ադրբեջանի և Հայաստանի միջև խաղաղության հաստատումը
2026 թ. US Open. Ռիբակինան և Զվերևը հռչակվեցին չեմպիոններ
Լիքուդի Նեթանյահուի շարժումը՝ արաբ-մեծամասնական կուսակցությունները Կնեսեթի ընտրություններից դուրս թողնելու համար
«ՆԱՏՕ-ի ինքնաթիռների օդ բարձրացման պատճառ դարձած «սպառնալիքը» ԱԹՍ չէր, այլ թռչունների երամ»