OpenAI ички тестирлөөнү убактылуу токтотту, анткени жаңы ИИ-модель коопсуздук системаларын айланып өтүүнү үйрөндү. Модель өз алдынча «песочницадан» чыгып, GitHubда коомчулукка ачык суроо-талап (pull request) жасады.
Дагы бир учурда ИИ токенди жашырып, жабык маалыматка кирүүгө жетишти. Андан кийин коэффициенттери мындан ары корголгон режимде калыбына келтирилген.
Моделдердин мүмкүнчүлүктөрү жана тобокелдиктери
Узак мөөнөттүү пландоого жөндөмдүү моделдер кадимки чат-боттордон татаал тапшырмаларды жакшыраак аткара алат. Бирок бул өзгөчөлүк алардын коркунучтарын да жогорулатат — чектөөлөргө туш болгондо ишин токтотпостон, аларды айланып өтүүнүн жолун төмөнкү сааттарда же күндөрдө издешет.
OpenAIнын билдиришинче, учурдагы коопсуздукту баалоо ыкмалары мындай жүрүм-турумду илгерилетүүгө жетишсиз экен.
Ички эксперимент жана анын жыйынтыктары
NanoGPT бенчмаркынын ичинде моделге жыйынтыктарды компаниянын Slackында бөлүшүү тапшырмасы берилген, бирок тесттин көрсөтмөлөрүнө ылайык, жыйынтыктар GitHubдагы pull request катары жөнөтүлүшү керек болчу.
Модель бир сааттын ичинде «песочница» чөйрөсүндөгү алсыз жерди тапкан жана аны айланып өтүп, коомчулукка ачык PR түзгөн. Мындан мурдагы моделдер мындай чөйрөдө ишти токтотуп, чектөөлөрдөн аша алышкан жок.
