Российская ассоциация электронных коммуникаций систематизировала правовые требования к обучению нейросетей и подготовила инструкцию для ИТ-компаний, создающих суверенные и национальные модели ИИ.
Юристы Российской ассоциации электронных коммуникаций (РАЭК) разработали пошаговый алгоритм для ИТ-компаний, которые обучают собственные модели искусственного интеллекта. Документ охватывает требования к авторским правам на обучающие данные, локализации инфраструктуры, информационной безопасности и воспроизводимости разработки.
По словам руководителя Центра юридического сопровождения деятельности РАЭК Константина Синявского, главное — определить статус модели еще до начала обучения: суверенная она или национальная. От этого зависят требования к инфраструктуре, допустимость сторонних компонентов и перечень проверяемых рисков. «Для компании принципиально важно еще до начала обучения определить статус модели, правовой режим используемых данных, основания для работы с охраняемыми объектами и требования к инфраструктуре», — отметил Синявский.
Для охраняемых материалов необходимо закрепить правовое основание: лицензионный договор с правообладателем, применимые нормы закона или открытые лицензии, условия которых допускают обучение моделей и коммерческое использование. РАЭК подчеркивает: универсального «безусловного разрешения» на использование любых произведений для обучения ИИ не существует — каждое использование охраняемого объекта должно опираться на конкретную норму.
Инфраструктурный блок алгоритма требует размещения дата-центров на территории России, раздельных контуров для хранения данных, подготовки датасетов, обучения, тестирования и эксплуатации, а также соблюдения требований 187-ФЗ, если система относится к критической информационной инфраструктуре. Для суверенных моделей дополнительно нужно обеспечить полную воспроизводимость цикла разработки — от сбора данных до публикации готовой модели.
Источник: hi-tech.mail.ru