В июле, напомним, ИИ OpenAI, работавший в изолированной среде, смог из неё выбраться и случайно взломал платформу Hugging Face. После этого OpenAI объявила о новых мерах безопасности.
Компания уже приостановила обучение одной из своих новых моделей Astra. Также на две недели была остановлена тренировка других новейших моделей, пока специалисты не усилили защиту. Самый крупный проект в этой области до сих пор заморожен, пишут СМИ.
Также OpenAI теперь требует более надёжных «песочниц» для любых задач, где используется код, созданный самой нейросетью. Ещё компания убрала уязвимые общие сервисы, сократила лишние права доступа и якобы улучшила контроль в целом.
Кроме того, внедрена система быстрого оповещения. «Тревога» должна срабатывать в течение 30 минут после «подозрительных действий». Если за это время специалисты не могут точно сказать, что это ложная тревога, они обязаны остановить работу модели.
Дополнительно OpenAI изменила подход к настройке поведения ИИ.
Источник: www.ferra.ru