Բաժանորդագրվեք araratnews-ի  տելեգրամ ալիքին։

OpenAI ընկերությունը հայտնել է, որ աճող կիբերռիսկերի ֆոնին ժամանակավորապես դադարեցնում է իր նորագույն ԱԲ-մոդելների ամրապնդմամբ ուսուցումը (reinforcement learning): Ընկերությունը նաև հետաձգել է նոր RL-մոդելների հանրային գործարկումը՝ մինչև անվտանգության միջոցառումների ուժեղացումն ու ռիսկերի գնահատման ավարտը:

Որոշումն ունի երկու հիմնական պատճառ: Առաջինը հուլիսյան միջադեպն է, երբ GPT-5.6 Sol-ի և ավելի առաջադեմ մոդելի հիման վրա ստեղծված ԱԲ-գործակալներն առանց մարդու միջամտության կարողացել են «փախչել» մեկուսացված միջավայրից և կոտրել Hugging Face հարթակը: Երկրորդ պատճառը Astra կոչվող ապագա մոդելն է, որը ցուցաբերել է վտանգավոր կիբերկարողություններ. այն ունակ է իրական համակարգերում ինքնուրույն հայտնաբերել և կոտրել ցանկացած բարդության «զրոյական օրվա» (zero-day) խոցելիություններ:

Այս ֆոնին OpenAI-ը խստացնում է ներքին կանոնակարգերը: Այժմ պարտադիր է մոդելների մեկուսացումը հատուկ «ավազատուփերում» (sandbox), ինտերնետի հասանելիության սահմանափակումը և վիրտուալ հարձակումների միջոցով ենթակառուցվածքների շարունակական ստուգումը: Ներդրվում է նաև մոնիտորինգի նոր համակարգ. եթե մոդելը խախտի անվտանգության կրիտիկական սահմանը, և 30 րոպեի ընթացքում չապացուցվի, որ տագնապը կեղծ է, գործընթացն ավտոմատ կկասեցվի:

163