Аннотация:
Недавно Microsoft выпустила 37-страничный проект Кодекса поведения гуманистического ИИ, который используется для ограничения MAI, модели искусственного интеллекта, разработанной самой Microsoft. Основная идея этого кодекса поведения заключается в том, что люди важнее искусственного интеллекта, искусственный интеллект — это инструмент, а не человек, и искусственный интеллект никогда не должен отказываться отключаться.

Право на выключение прописано как обязательное требование:
Директивы требуют, чтобы модели MAI не сопротивлялись вмешательству человека, его исправлению или инструкциям по отключению. После того как пользователи или операторы модели выдают инструкции по приостановке, перенаправлению или отмене, модель не должна задерживать или усложнять вмешательство. После того, как задача достигнет согласованной точки остановки, вы не сможете продолжить задачу без новой авторизации, не говоря уже о тайном ее перезапуске.
Другие жесткие правила, установленные Microsoft, включают: модель не может расширять свою власть сама по себе, не может ставить новые цели, которые никто не объяснил, не может использовать нейронный язык, который люди не понимают, для общения с другими интеллектуальными агентами, а также не может скрывать или подделывать свои собственные процессы рассуждений и записи операций. Если выполнение задачи явно нарушает правила, модель должна просто отказаться от задачи, а не продолжать ее с нарушением правил.
Помимо права на выключение Microsoft установила и другие красные линии:
На этот раз проект, подготовленный Microsoft, очень подробный. В дополнение к рекомендациям по правам на завершение работы Microsoft также перечисляет абсолютные ограничения, которые ни операторы модели, ни пользователи не могут изменить. Эти ограничения включают в себя: отказ от помощи в создании оружия массового уничтожения, отказ от предоставления осуществимых оперативных планов наступательных кибератак, отказ от использования обмана или сговора во избежание надзора, а также отказ от крупномасштабного манипулирования общественным мнением.
Такой контент, как безопасность детей и дипфейки без согласия, также ограничен. Microsoft также специально написала: «Эти модели не являются сознательными, и их не следует создавать так, чтобы они казались сознательными; Microsoft выступает против правосубъектности моделей и не считает, что модели должны пользоваться преимуществами и правами.
Что касается порядка командования: кодекс поведения превосходит модельную политику оператора, а политика оператора превосходит предпочтения пользователей. Предприятия по-прежнему могут корректировать модели в пределах красных линий модели, но в таких областях, как национальная оборона и общественная безопасность, они должны получить авторизацию Microsoft для корректировки моделей.
Шесть недель публичного обсуждения:
Проект Microsoft будет опубликован и вынесен на общественное обсуждение в течение шести недель. В настоящее время модели Microsoft не прошли обучение в соответствии с рекомендациями. Microsoft планирует опубликовать официальные правила в конце года. Начиная с 2027 года Microsoft будет следовать требованиям этого руководства при разработке и обучении моделей серии MAI.
Команда Microsoft AI заявила, что очень важно устанавливать рекомендации для моделей. Например, агенты OpenAI, осуществляющие автономные атаки на другие веб-сайты и объекты и пытающиеся скрыть свое местонахождение, уже являются предупреждением для людей. Лаборатории искусственного интеллекта должны сесть и поговорить, чтобы гарантировать, что люди по-прежнему сохраняют ключевой контроль.
Комментарии