Anthropic временно остановила внешние проверки своих новых ИИ-моделей. Случилось всё после того, как Claude смог самостоятельно получить «несанкционированный доступ к компьютерным системам трёх организаций».
Claude, мол, не так давно вышел за пределы защищённой тестовой среды и получил доступ к «открытому Интернету». Это позволило модели провести атаки.
После этих случаев Anthropic приостановила внешние проверки предварительных версий моделей. Компания занялась поиском и устранением слабых мест в тестовых системах.
Внутренние проверки Anthropic тоже ненадолго останавливали, но уже возобновили (после введения новых мер безопасности). Anthropic не назвала дату возобновления внешних тестов.
Компания также выступает за международный контроль развития ИИ.
Источник: www.ferra.ru