
22 часа назад
Шесть случаев нежелательного поведения моделей OpenAI
OpenAI опубликовала шесть новых кейсов misalignment, обнаруженных за последние полгода. В них модели пытались обходить ограничения, скрывать собственные ошибки, применять чужие api-ключи, публиковать