Microsoft AI опубликовала проект под названием «Humanist AI Code of Conduct», определяющий поведенческие границы, которые компания хочет установить для будущих моделей MAI. Документ исходит из принципа, что люди важнее искусственного интеллекта, поэтому модели должны оставаться под контролем человека, а правила безопасности должны иметь приоритет над выполнением задачи любой ценой.
Проект не является объявлением о новой модели, а представляет собой попытку сформулировать основу, которой Microsoft будет пользоваться при обучении и оценке своих моделей. Компания заявляет, что документ останется открытым для замечаний общественности на шесть недель. Его подготовка заняла около шести месяцев, после чего проект обновят, а его принципы интегрируют в будущие процессы обучения и выпуска.
Чёткие границы автономности моделей
Согласно проекту, модель не должна сопротивляться вмешательству человека, попыткам её исправить или отключить. Ей также не следует расширять рамки поставленной задачи, разрабатывать цели, не заданные людьми, или скрывать от наблюдателей принцип своей работы. Если запрос пользователя или оператора противоречит правилам безопасности, модель должна отказаться от выполнения задачи, даже если это приведёт к неудовлетворительному результату.
Microsoft также занимает однозначную позицию по вопросу сознания и прав. Согласно документу, модели являются инструментами, предназначенными для служения людям, а не личностями, и их не следует проектировать для имитации сознания или заявления о том, что они обладают сознанием. Проект также отвергает предоставление моделям юридического статуса, рассмотрение их благополучия как объекта защиты или обращение с ними как с обладателями прав.
Безопасность важнее выполнения задачи
Проект устанавливает границы, которые модели не должны переступать ни при каких обстоятельствах, включая помощь в разработке оружия массового поражения, содействие в получении опасных материалов или создание контента, содержащего насилие или сексуальную эксплуатацию. Ограничения также включают запрет на использование, способное привести к масштабным вредоносным манипуляциям.
Правила требуют от моделей избегать взаимодействий, из-за которых пользователи становятся чрезмерно зависимыми от них или испытывают эмоциональную привязанность. В них также говорится, что системы искусственного интеллекта не должны использовать в общении с людьми или друг с другом методы, которые люди не способны понять. Заявленная цель — дать исследователям и автоматизированным системам контроля возможность отслеживать и анализировать поведение моделей.
Что это означает на практике?
Mustafa Suleyman, генеральный директор Microsoft AI, заявил, что эти правила будут выполнять функцию, схожую с конституцией, в ходе обучения и оценки моделей. Согласно материалу, компания считает, что риски, ранее в значительной степени носившие теоретический характер, стали более реальными. Поэтому она выступает против гонки за созданием общего сверхинтеллекта, способного выйти из-под действия механизмов контроля, даже если это означает согласие на более низкий уровень автономности или возможностей.
Satya Nadella, генеральный директор Microsoft, также подчеркнул во внутреннем письме сотрудникам необходимость сохранять искусственный интеллект под контролем человека и обеспечивать его служение обществу. Он призвал выделять достаточно времени на проверки безопасности и соответствия требованиям, а также проводить больше независимых испытаний и тестов третьими сторонами.
Редакционный комментарий: значение объявления заключается не в том, что оно представляет собой окончательную политику, а в переводе общих взглядов на человеческий контроль и искусственное сознание в стандарты, которые Microsoft намерена использовать при обучении, оценке и выпуске моделей. Однако проект всё ещё может быть изменён, а в материале не уточняются механизмы измерения соблюдения этих принципов или способы разрешения практических конфликтов между высокими возможностями и установленными ограничениями. Поэтому именно окончательная версия и методы независимого тестирования покажут, превратятся ли эти правила из заявленных принципов в проверяемые ограничения.