Исследователи безопасности Tomek Korbak, Mikita Balesni и Jasmine Wang говорят, что на прошлой неделе OpenAI их уволила. После этого они опубликовали письмо руководству компании под названием «OpenAI cannot make AI safe on its own».[1][2][3]
Как пишет Techmeme со ссылкой на Wall Street Journal, трое уволенных исследователей призывают ИИ-лаборатории остановить работу, которая может ухудшить мониторинг ИИ. По их словам, увольнения «chilling those who remain at OpenAI».[4]
«Я считаю, что нас уволили за то, что мы ставили безопасность выше краткосрочных интересов OpenAI как корпорации», — написал Balesni.[5]
По сообщениям, OpenAI заявила, что трое неправильно обращались с конфиденциальной информацией. Рассылка AINews издания Latent Space приводит объяснения самих уволенных. Wang говорит, что ей назвали единственную причину: она открыла электронную почту одного из руководителей. Korbak рассказывает, что ему устно сказали, будто проблема в его общении с METR, а письменно ничего не зафиксировали.[6][7][8]
Во время аудита летнего инцидента Korbak был главным техническим контактом OpenAI с METR. По его словам, он месяцами говорил о том, что лаборатории теряют способность отслеживать рассуждения агентов. Теперь он опасается, что OpenAI сократит работу с METR.[9][10]
Все трое отрицают, что были источником публикации The Information об архитектурах, которые хуже поддаются мониторингу. Исследователь Neel Nanda назвал увольнения «extremely sketchy», если рассказы уволенных точны.[11][12]
three fired OpenAI researchers urge AI labs to halt work that could impair AI monitoring and say their firings are “chilling those who remain at OpenAI”