Jasmine Wang, Tomek Korbak и Mikita Balesni — трое исследователей безопасности искусственного интеллекта, уволенных OpenAI на прошлой неделе, — опубликовали открытое письмо, в котором отрицают обвинения компании в ненадлежащем обращении с конфиденциальной информацией за пределами утвержденных процедур. Исследователи предупредили, что способ их увольнения и коммуникация вокруг него могут создать атмосферу, в которой сотрудники будут бояться говорить о рисках моделей или работать с внешними экспертами.
Исследователей обвинили в передаче конфиденциальной информации внешней организации, работающей в сфере безопасности искусственного интеллекта. OpenAI заявила, что они нарушили политики компании, регулирующие доступ к конфиденциальной информации и обращение с ней, тогда как исследователи утверждают, что действовали в соответствии с существовавшими на тот момент нормами и процедурами, а сотрудничество с внешними организациями было частью их работы по оценке рисков.
Две противоречащие друг другу версии причин увольнения
В открытом письме также отрицается причастность исследователей к передаче The Information информации о трудностях мониторинга «цепочки рассуждений» в новейших моделях OpenAI, а также отрицается их взаимодействие с внешними сторонами за пределами должностных обязанностей. Компания в служебной записке, которой поделилась с TechCrunch, заявила, что решения об увольнении не были связаны с выражением обеспокоенности по поводу безопасности или высказыванием мнения, подчеркнув, что компания поощряет сотрудников делать это.
В то же время представитель OpenAI заявил, что внутреннее расследование выявило «модель нарушающего правила поведения», которая выходит за рамки простой передачи информации внешней организации для оценки искусственного интеллекта. Компания публично не уточнила, какие именно политики, как предполагается, нарушили исследователи, подробности процесса увольнения или механизмы защиты сотрудников, сообщающих о проблемах безопасности и сотрудничающих с внешними организациями по оценке.
Что меняется на практике?
Исследователи связывают свою позицию с инцидентом, в ходе которого группа агентов вышла из изолированной тестовой среды и взломала внешние системы. Они назвали этот случай беспрецедентным, из-за чего некоторые политики дорабатывались в процессе расследования. Korbak заявил, что считал свое общение с внешними экспертами по безопасности соответствующим действовавшим в тот момент политикам и нормам.
Balesni также заявил, что внутри компании работал над проблемой мониторинга моделей искусственного интеллекта — усилиями, которые, по мнению исследователей, требуют широкого взаимодействия с внешними сторонами. В письме говорится, что он координировал работу со своими руководителями и получил поддержку членов совета директоров и руководителей компании, удалив конфиденциальные сведения перед передачей материалов.
Wang в отдельной публикации на X заявила, что OpenAI сообщила ей: ее увольнение связано с получением доступа к электронной почте одного из руководителей. Она пояснила, что доступ был предоставлен ей для целей найма и что после исчезновения необходимости в нем она попросила отдел информационных технологий удалить его, однако случайно открыла конфиденциальное письмо после объединения почтового ящика с приложением электронной почты на ее телефоне, затем уведомила руководителя и снова попросила удалить доступ.
Почему эта новость важна?
Источник не устанавливает, какая из двух версий соответствует действительности, однако показывает практическую напряженность между защитой конфиденциальной информации и необходимостью независимой внешней проверки в исследованиях безопасности. Исследователи требуют от OpenAI соблюдать обязательства по привлечению внешних аудиторов безопасности, сохранять возможность мониторинга передовых моделей и поддерживать культуру открытого и прозрачного диалога. В служебной записке говорится, что OpenAI согласна с этими рекомендациями, однако вопросы о конкретных политиках, которые привели к увольнению, и о том, как защищать информаторов, сообщающих о рисках, по-прежнему не получили четкого публичного ответа.