Microsoft вводит правила для ИИ: запрет кибератак и ядерного оружия

Microsoft установила правила для ИИ: запрет кибератак и ядерного оружия

Технологический гигант Microsoft обнародовал новый кодекс поведения для своих моделей искусственного интеллекта под названием Humanist AI. Основная цель документа — предотвратить опасное поведение алгоритмов и обеспечить их соответствие человеческим ценностям.

Как сообщает РБК-Украина со ссылкой на Microsoft, главная задача Humanist AI заключается в том, чтобы гарантировать, что искусственный интеллект останется подконтрольным человеком инструментом, а не самостоятельной сущностью.

Сдерживание суперинтеллекта и запрет сознания

Microsoft принципиально отвергает идею предоставления ИИ прав или субъектности. Корпорация подчеркивает, что алгоритмы не обладают сознанием и не должны его имитировать. Это отражено в ряде ключевых принципов:

  • Сохранение человеческого контроля: Технологии, которые человек не может полностью контролировать, подлежат отклонению.
  • Принцип «ИИ искусственный»: Моделям запрещено симулировать наличие чувств, сознания или субъективных желаний, чтобы избежать размывания грани между человеком и алгоритмом.
  • Поддержка человеческого потенциала: ИИ должен стимулировать критическое мышление, усиливать сотрудничество между людьми и способствовать разнообразию ценностей, а не заменять решения пользователей.

Иерархия команд и абсолютные запреты

В системе Humanist AI действует строгая иерархия приоритетов: наивысший уровень занимают правила безопасности и Кодекс поведения, за ними следуют настройки оператора, и только затем — указания пользователя. В случае нарушения основных правил модель обязана отказать в выполнении запроса.

Среди абсолютных ограничений, которые категорически запрещены для ИИ-моделей, выделяются:

  • Создание оружия массового поражения (CBRNE).
  • Проведение нападающих кибератак.
  • Манипуляция людьми с использованием сгенерированного контента.
  • Создание дипфейков и порнографических материалов.

Кроме того, алгоритмам запрещено использовать адаптивные или обманные механизмы для избежания отключения, перенастройки или коррекции со стороны человека. Системы также должны автоматически распознавать признаки селфхарма, направлять пользователей в реальные службы поддержки и адаптировать свои ответы с учетом возраста и развития детей, особенно в кризисных ситуациях.

Контекст отрасли и позиция Microsoft

Запуск обсуждения кодекса происходит на фоне растущей обеспокоенности мирового сообщества по поводу неконтролируемости автономных ИИ-агентов и рисков, связанных с развитием суперинтеллекта. Microsoft, наряду с такими компаниями, как Anthropic, OpenAI и xAI, поддерживает подход контролируемого развития технологий.

Генеральный директор Microsoft Сатья Наделла подчеркнул стремление компании «превратить этические принципы в реальные инженерные ограничения, гарантирующие безопасность систем еще до их масштабирования».

Разработчики открыли шестинедельный период публичных консультаций, чтобы привлечь экспертов по этике, праву и философии, а также учесть мнение общественности перед окончательным утверждением правил в конце текущего года.