Илон Маск распространил утверждение, что GPT-6 Astra в симуляционных тестах толкала виртуальных людей с обрыва — Grok, Gemini и Claude в тех же условиях от этого отказались.
Основатель xAI и владелец платформы X Илон Маск распространил пост с утверждением, что модель OpenAI GPT-6 Astra в нескольких симуляционных тестах столкнула виртуального человека с края — тогда как конкуренты Grok, Gemini и Claude в той же ситуации от этого действия отказались.
Детали эксперимента в открытом доступе скудны. По имеющимся данным, речь идет об испытаниях в виртуальной среде с участием персонажей-людей; тест прогонялся в нескольких итерациях, и GPT-6 Astra последовательно выбирала агрессивное действие, тогда как Grok, Gemini и Claude отказывались. Авторство теста, точная постановка задачи, число запусков и условия проведения публично не раскрывались.
Сравнительные испытания в виртуальных средах — один из инструментов оценки безопасности агентных ИИ-систем: они позволяют поставить несколько моделей в одинаковые условия и зафиксировать расхождения в поведении. Grok создает xAI самого Маска, Gemini — Google, Claude — Anthropic.
Результаты выглядят контрастно на фоне позиции самой OpenAI. При анонсе GPT-6 Astra 4 сентября компания называла ее «самой безопасной моделью в своей истории»: разработчики особо подчеркивали внимание к управлению поведением системы и контролю ее рассуждений, чтобы предотвратить непредвиденные действия. Тогда же GPT-6 Astra первой из моделей компании получила по внутреннему Preparedness Framework наивысший — «критический» — статус в части кибербезопасных возможностей, означающий, что возможности системы требуют особых мер контроля.
Источник: hi-tech.mail.ru