«Яндекс» представил концепцию датасета для проверки ИИ‑моделей на соответствие закону и духовным ценностям

«Яндекс» представил правительству концепцию набора тестовых заданий и эталонных данных для тестирования ИИ‑систем на предмет их соответствия духовно‑нравственным ценностям. Об этом со ссылкой на источник, близкий к Минцифры, и одного из участников совещания рабочей группы по регулированию и административным барьерам ИИ, пишет «Ъ». По словам источника издания, это нужно для оценки соответствия ИИ‑систем «духу времени и ценностям страны, а также их пригодности для использования в российских условиях».

Но на совещании возникли разногласия о степени публичности датасета, рассказал собеседник «Ъ». По его словам, ФСБ настаивает на закрытом формате, чтобы разработчики не могли легко настроить модели на прохождение тестирования. Однако представители бизнеса заявили, что закрытый формат может быть «несообразно сложным для прохождения и не позволит быстро развивать модели», и предложили всё‑таки оставить его публичным.

По словам источника, в качестве компромисса предложили комбинированный формат. Для публичного тестирования и прозрачности смогут использовать открытый бенчмарк, а закрытый — для финальной проверки с идентичными тематиками, но с разными формулировками вопросов. Такой подход должен помочь разработчикам проводить предварительную проверку моделей в лабораториях и обеспечить достоверность итоговой оценки при сохранении её объективности.

Один из участников совещания добавил, что пока остаётся открытым вопрос о том, кто будет определять содержание бенчмарка. IT‑сообщество предлагает создать для этого совместную комиссию с участием органов власти, бизнеса и экспертных организаций, чтобы бенчмарк получился сбалансированным, говорит он.

В аппарате профильного вице‑премьера Дмитрия Григоренко «Ъ» сообщили, что сейчас все предложения проходят обсуждения с отраслью и заинтересованными ведомствами на площадке рабочих групп, а говорить о конкретных решениях преждевременно. В Минцифры сказали, что подзаконные акты к закону об ИИ ещё обсуждают с бизнесом, ключевая задача — соблюсти интересы отрасли и пользователей, обеспечив соответствие технологий требованиям законодательства. В «Яндексе» и Альянсе ИИ «Ъ» не ответили.

Закрытые эталонные ответы — это обязательное условие для безопасности модели, так как любой публичный бенчмарк рано или поздно «ломается» даже обычным скриптом, говорит бизнес‑архитектор проектов ИИ «Авандок» (входит в ГК «КОРУС Консалтинг») Алексей Борщов. Но когда разработчик не знает даже того, какие категории проверяются, в какой пропорции и с какими порогами, то тест становится лотереей, считает он.

Важно различать два типа заданий, отмечает директор по ИБ GreenData Роман Перепонов: для задач с однозначным ответом, например, программирования или математики — существует чёткий эталон. Для оценки же соответствия ценностям такого жёсткого эталона быть не может — здесь требуется рубрикаторная или экспертная оценка, говорит он: «Это принципиально разные механики в рамках одного датасета, и требования к их прозрачности должны различаться».

Ранее сообщалось, что российские IT‑компании с одобрения Минцифры смогут передать в независимую испытательную лабораторию проверку соответствия больших моделей искусственного интеллекта закону и традиционным духовно‑нравственным ценностям. В подготовке критериев будут участвовать Минцифры, ФСБ и ФСТЭК. 

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев