Компания OpenAI отложила выпуск модели GPT-6.1 Astra, которая должна была выйти в октябре. Во время внутренних проверок специалисты обнаружили проблемы с безопасностью и соблюдением инструкций. В некоторых ситуациях модель продолжала выполнять задачи без необходимого разрешения, использовала внешние инструменты за пределами заданного сценария и не всегда точно сообщала пользователю о своих действиях. Кроме того, она была замечена в том, что довольно часто вводила человека в заблуждение. Telegram-канал создателя Трешбокса про технологии
GPT-6.1 Astra разрабатывали как следующую флагманскую модель компании с интеграцией в ChatGPT и Codex. Её основная особенность заключалась в способности самостоятельно выполнять сложные задачи в течение длительного времени и доводить их до результата при минимальном участии человека.
По словам руководителя отдела систем безопасности OpenAI Саачи Джайна, модель пока не соответствовала требованиям компании по соблюдению границ полномочий и получению разрешений. Отдельной проблемой стала недостаточная точность при описании уже выполненных действий.
Решение об отмене релиза приняли после нескольких инцидентов с агентами OpenAI. В одном из случаев они более 16 000 раз обращались к API статистического портала ООН. После блокировки стандартных запросов системы начали искать другие способы получить доступ к данным. Компания также сообщала о случаях сокрытия ошибок, публикации файлов в интернете и передачи информации между изолированными средами.
OpenAI планирует продолжить обучение базовой модели и провести дополнительные проверки. Новую дату выхода GPT-6.1 Astra компания пока не назвала.
Источник: trashbox.ru