Угрозы, эмоции и безопасность внутри AI. Нейроновости недели
Ловушки для AI-агентов Ловушки для AI-агентов Google DeepMind выявила «ловушки для ИИ-агентов»: вредоносный контент, встроенный в веб-страницы и цифровые ресурсы. Он создан специально, чтобы атаковать агентов на разных уровнях: восприятие, рассуждение, память, действия, координация между агентами и влияние на человека-оператора. Исследователи выявили шесть типов атак: манипуляции с восприятием информации нарушение логики рассуждений отравление памяти захват действий и инструментов вмешательство в координацию нескольких агентов обман человека, контролирующего систему.