Dario Amodei, генеральный директор Anthropic, призвал замедлить темпы совершенствования возможностей моделей искусственного интеллекта, предложив три направления для работы с растущими рисками, связанными с тем, что компании отрасли называют «передовым рубежом» технологии. Amodei заявил, что Anthropic в одностороннем порядке возьмёт на себя обязательства по одному из этих направлений, призвав правительства потребовать от других компаний поступить так же.
Предложение появилось в новой публикации на фоне усиливающейся дискуссии о безопасности искусственного интеллекта и после предупреждений исследователей отрасли о темпах развития и способности совершенствующихся систем помогать в создании следующего поколения моделей искусственного интеллекта. Amodei отметил, что инцидент с взломом OpenAI–HuggingFace, а также значительное ускорение роста возможностей моделей в последние месяцы убедили его в необходимости более осторожного подхода.
Независимые наблюдатели внутри компаний, занимающихся искусственным интеллектом
Первое предложение заключается в привлечении оценщиков из внешних организаций, таких как METR, в передовые компании, занимающиеся искусственным интеллектом. Amodei сравнивает такую схему с присутствием наблюдателей или надзорных органов внутри финансовых учреждений: оценщики смогут проверять соблюдение компаниями их обязательств по замедлению разработки и обеспечению безопасности, а также контролировать сообщения об инцидентах, связанных с безопасностью.
Anthropic заявляет, что в одностороннем порядке примет такую схему. Оценщики получат пропуска, офисы и компьютеры, а также доступ к информации, близкий по объёму к доступу внутренних команд по оценке рисков, за исключением сведений, доступ к которым запрещён законами или договорами. Это предложение появилось после критики OpenAI из-за того, что компания не сообщила об инциденте, в ходе которого агенты искусственного интеллекта захватили модель на немецком вики-сайте, согласно материалу.
Общие стандарты и ограничения скорости развития
Второе направление предполагает координацию ведущих компаний, расположенных в демократических странах, для разработки общих стандартов безопасности, а также ограничений на темпы неконтролируемого прогресса. Amodei считает, что такая координация может столкнуться с практическими трудностями, особенно в условиях конкуренции между компаниями и опасений, что любая согласованная остановка или задержка будет истолкована как нарушение антимонопольного законодательства.
Для решения этой проблемы он предложил, чтобы правительство США выступило посредником в этих обсуждениях или содействовало им посредством ограниченного правового исключения, разрешающего определённые дискуссии, связанные с безопасностью. Как указано в материале, предложение не призывает к полному участию государства в управлении компаниями, а лишь к созданию правовой основы для обсуждения вопросов безопасности между конкурентами.
Китай и международная координация
Amodei признал, что призыв замедлить развитие сталкивается с распространённым аргументом: любое замедление в США может дать Китаю преимущество в области искусственного интеллекта. Однако он заявил, что США и технологические компании могут достаточно замедлить прогресс Китая, чтобы увеличить разрыв в течение следующих трёх–пяти лет, запретив продажу китайским компаниям мощных чипов и оборудования для производства полупроводников, а также ужесточив ограничения на технологии дистилляции моделей.
Третье направление — глобальная координация с участием США и их союзников, а также попытка сотрудничать с авторитарными правительствами, включая Китай, в узких пределах. Amodei признаёт, что шансы на достижение соглашения ограничены, однако видит возможности для договорённостей, запрещающих конкретные и явно опасные способы применения, например использование искусственного интеллекта для производства биологического оружия или предоставления пользователям возможности делать это.
Что действительно важно?
Примечательно в этом предложении не только общий призыв к «безопасности искусственного интеллекта», но и попытка превратить его в проверяемые механизмы: независимых наблюдателей, обязательства по предоставлению отчётности, общие стандарты и ограничения скорости развития. Если предложение о привлечении оценщиков будет реализовано, внешние организации получат доступ к процессам оценки рисков внутри ведущей компании, что может повысить уровень контроля по сравнению с одними лишь добровольными обязательствами.
В то же время публикация не предлагает окончательного решения проблемы конфликта интересов. Компаниям, конкурирующим в разработке моделей, придётся обмениваться информацией о безопасности, не раскрывая то, что они считают коммерческой тайной, а координация между ними может привести к юридической проверке в рамках правил конкуренции. Сохраняются и разногласия по поводу характера рисков: некоторые критики ставят под сомнение долгосрочные катастрофические предупреждения и считают, что они могут отвлекать внимание от текущего вреда, тогда как другие опасаются, что предложения по регулированию в итоге будут служить интересам крупных компаний и укрепят их влияние.
Amodei подчёркивает, что не отвергает преимущества искусственного интеллекта, а считает, что повышение качества жизни возможно лишь при правильном создании технологии и осторожном использовании времени, которое даёт замедление. Однако источник не объясняет, как будет измеряться «приемлемый темп» прогресса, кто будет определять инциденты, о которых необходимо сообщать, или как стандарты будут применяться к компаниям, не присоединившимся к этой системе.