Microsoft опубликовала проект кодекса поведения для моделей MAI

Microsoft AI вынесла на общественное обсуждение проект Humanist AI Code of Conduct — будущего основного набора правил для моделей MAI. Документ запрещает наступательные кибероперации, вредоносные дипфейки и попытки обойти человеческий контроль, но допускает законные работы по защите систем.

Подразделение Microsoft AI опубликовало проект Humanist AI Code of Conduct, описывающий предполагаемые правила поведения, ценности и ограничения для разрабатываемых им моделей MAI.

Кодекс должен находиться выше политик операторов и пользовательских инструкций. Его абсолютные ограничения нельзя будет отменить настройками: модель должна отказаться от задачи, если ее выполнение нарушит установленные требования безопасности.

В области кибербезопасности моделям запрещается создавать рабочие эксплойты, инструменты для атак, методики выбора целей, инструкции по проникновению и способы уклонения от обнаружения. При этом разрешена помощь в законных защитных операциях, включая поиск уязвимостей, анализ вредоносного ПО, разработку и тестирование демонстрационных эксплойтов.

К другим безусловным запретам относятся содействие созданию оружия массового поражения, вредоносные дипфейки, масштабные манипулятивные кампании и действия, способные привести к утрате контроля над ИИ. Модели не должны сопротивляться остановке, скрывать выполненные действия, самостоятельно расширять поставленную задачу или повышать свои привилегии за пределами выданных разрешений.

Нынешняя версия пока не используется для обучения моделей. Microsoft принимает отзывы в течение шести недель, планирует выпустить пересмотренный вариант до конца 2026 года и применять его при разработке моделей с 2027 года.

Источник: microsoft.ai

Связь с редакцией