OpenAI-ը հայտարարել է, որ ժամանակավորապես դանդաղեցրել է իր մշակման տեմպը եւ ուժեղացրել է իր մոդելների անվտանգության պահանջները։
Սա պայմանավորված էր Hugging Face հաքերային հարձակման եւ նախնական տվյալների հետ, որոնք ցույց էին տալիս, որ առաջիկա Astra մոդելը կարող է հասնել կիբերանվտանգության «կրիտիկական շեմի»։
OpenAI-ը հայտարարել է մշակման փուլում գտնվող մոդելների ավելի արդյունավետ մոնիտորինգի եւ պաշտպանության համակարգերի ներդրման մասին։
Ընկերությունը խոստացել է ուժեղացնել մոդելների «անվտանգության վերահսկողությունը» մշակման բոլոր փուլերում։ Մասնավորապես, այն ավելի ակտիվորեն կհետեւի մոդելների վարքագծին եւ կսահմանափակի մոդելների հասանելիությունը որոշակի տվյալների։
OpenAI-ը նաեւ սկսել է ներդնել լրացուցիչ գործիքներ՝ մոդելների ինտերնետ մուտքը սահմանափակելու եւ «բարձր ռիսկի» առաջադրանքներ կատարելիս ավելի խիստ մեկուսացման համար։
Մեկ այլ միջոցառում է մոդելի դատողության ուժեղացված մոնիտորինգը։ Համակարգը վերլուծում է մոդելների մտքերն ու գործողությունները՝ տվյալներին չարտոնված մուտք գործելու փորձերը հայտնաբերելու եւ սահմանափակումները շրջանցելու համար։ Ընկերությունն ակնկալում է հայտնաբերել կասկածելի գործունեություն 30 րոպեի ընթացքում։
Բացի այդ, OpenAI-ը երկու շաբաթով կասեցրել է ամրապնդված ուսուցումը (RL) իր վերջին մոդելների համար եւ հետաձգել է նոր RL մոդելների հանրային թողարկումը մինչեւ գնահատման ավարտը եւ անվտանգության միջոցառումների ուժեղացումը։