Мнения и аналитика

Anthropic предлагает две рамки для политики в условиях ускорения развития искусственного интеллекта

Anthropic представила передовую рамку управления наиболее мощными моделями искусственного интеллекта и экономическую рамку для подготовки к влиянию технологии на рынок труда и распределения её преимуществ. Компания призывает к большей прозрачности, независимой оценке и усилению безопасности, а также к предоставлению правительствам полномочий сдерживать развёртывание систем, способных причинить катастрофический ущерб, в рамках определённых ограничений.

2026-08-12
5 мин. чтения
23 просмотров
فريق تحرير certi.news
Anthropic предлагает две рамки для политики в условиях ускорения развития искусственного интеллекта

Anthropic призывает правительства обновить свою политику, чтобы успевать за ускорением возможностей искусственного интеллекта, представив два предложения, охватывающие управление передовыми моделями и подготовку работников и экономики к влиянию технологии. Компания считает, что быстрые темпы развития моделей делают одной прозрачности недостаточно и что государственным органам нужны более широкие полномочия для реагирования на развёртывание систем, сопряжённое с потенциально катастрофическими рисками, при наличии гарантий, предотвращающих злоупотребление этими полномочиями.

Первое предложение представляет собой рамку для передового искусственного интеллекта, сосредоточенную на наиболее мощных моделях и рисках, которые они могут создавать. Второе предложение, экономическая рамка, посвящено подготовке работников и экономики к влиянию искусственного интеллекта и обеспечению широкого распределения его финансовых преимуществ. Anthropic заявляет, что эти две рамки рассматривают два аспекта одной задачи: ответственное направление развития технологии и подготовку к изменениям, которые она принесёт обществу.

Сфера действия предлагаемых правил

Передовая рамка предлагает применять правила к моделям, обученным с использованием более чем 1025 операций с плавающей запятой, которые разрабатывают компании, получающие более 500 миллионов долларов дохода, связанного с искусственным интеллектом, или тратящие более 1 миллиарда долларов на исследования и разработки в этой области. Anthropic заявляет, что такая сфера действия ориентирована на передовые модели, а не на введение одинаковых требований для всех систем искусственного интеллекта.

Компания связывает необходимость такого регулирования с резким восходящим трендом в развитии возможностей моделей. Она отмечает, что ещё несколько лет назад модели едва могли писать код, тогда как модель Claude Mythos Preview, согласно Anthropic, обнаружила тысячи уязвимостей программного обеспечения высокой степени опасности, включая уязвимости во всех основных операционных системах и браузерах. Из этого компания делает вывод, что продолжение такой тенденции может повысить риски катастрофического ущерба.

Четыре типа рисков

Рамка сосредоточена на четырёх основных областях риска:

  • Биологические риски: незащищённые системы могут упростить и удешевить разработку биологического оружия, хотя те же возможности способны ускорить открытие лекарств.
  • Киберриски: передовые модели искусственного интеллекта способны масштабно обнаруживать критические уязвимости, что может помочь в защите систем, но также повышает уровень угрозы для критически важной инфраструктуры, такой как больницы и энергетические сети.
  • Риски утраты контроля: по мере улучшения возможностей систем может стать сложнее контролировать системы, действующие за пределами возможностей их разработчиков.
  • Автоматизированные исследования и разработки: системы могут автоматизировать исследования и разработку искусственного интеллекта, что способно усилить три предыдущих риска.

Требования к разработчикам передовых моделей

Anthropic предлагает, чтобы разработчики передовых моделей тестировали свои системы и публиковали краткое изложение результатов, а также рамку безопасности, описывающую методы оценки катастрофических рисков, и системные паспорта с объяснением возможностей и рисков моделей. Рамка также призывает регулярно публиковать отчёты об общем состоянии рисков и проводить независимые оценки. Компания отмечает, что некоторые требования к прозрачности уже установлены законами Калифорнии и Нью-Йорка, однако считает, что её предложение в ряде аспектов выходит за их пределы.

Согласно предложению, каждый разработчик передовых моделей должен привлекать как минимум одного квалифицированного независимого оценщика, который будет публиковать обзор оценок компании и её отчётов о рисках. Anthropic также призывает правительства и технологический сектор развивать экосистему независимых оценщиков, устанавливая для них стандарты, обеспечивая финансирование и предоставляя достаточный доступ к моделям.

Рамка также включает требования к безопасности для защиты весов моделей и инфраструктуры, используемой при обучении, поскольку они являются ценными целями для злоумышленников, включая хорошо обеспеченные ресурсами государственные структуры. Компания предлагает защищать всю среду разработки от внешних и внутренних угроз, описывать программу безопасности на общем уровне для общественности, предоставлять подробности конкретному государственному органу по запросу, создавать каналы для сообщения об атаках с целью имитации моделей и регулярно тестировать средства защиты.

Государственные полномочия с ограничениями

Anthropic считает, что правительства должны обладать законными полномочиями запрещать или сдерживать развёртывание моделей, представляющих значительный риск причинения катастрофического ущерба, с введением гражданских штрафов, привязанных к глобальной годовой выручке, и их увеличением при повторных нарушениях. Вместе с тем компания предупреждает о чрезмерно широких или обременительных регуляторных полномочиях и предлагает конкретный механизм предотвращения опасного развёртывания, а также ощутимые гарантии для ограничения злоупотребления этой властью.

Рамка в основном ориентирована на федеральное правительство США, однако не призывает отменять законы штатов, если только не будет принят федеральный закон, не менее строгий, чем предложенная рамка. Anthropic заявляет, что отмена полномочий штатов должна быть ограниченной, чтобы они сохраняли возможность регулировать такие вопросы, как безопасность детей и защита потребителей, если эти вопросы не относятся к определённым функциям безопасности, охватываемым федеральным законом.

Повышение устойчивости общества

Вторая часть рамки предлагает меры по повышению способности общества противостоять рискам. В биологической сфере рекомендации включают проверку синтеза генов, отслеживание новых вспышек заболеваний с помощью систем раннего мониторинга и подготовку посредством накопления средств защиты и инструментов для сокращения передачи инфекций воздушным путём.

В киберсфере Anthropic призывает укреплять программное обеспечение, от которого зависит интернет, предоставлять техническую поддержку операторам критически важной инфраструктуры и заменять используемые в ней устаревшие системы. Компания также предлагает создать отдельную государственную функцию для отслеживания киберспособностей передовых моделей и сотрудничество правительства с технологическим сектором в разработке средств защиты, позволяющих широко обмениваться киберспособностями.

Компания признаёт, что повестка повышения устойчивости к рискам утраты контроля и автоматизированных исследований и разработок остаётся менее развитой и требует дополнительной работы во всём секторе. Среди упомянутых направлений — развитие возможностей для обнаружения систем, действующих вне контроля их разработчиков, и реагирования на них, а также создание инфраструктуры для сдерживания или отключения таких систем.

Anthropic ожидает широкого обсуждения своих предложений, но призывает политиков уже сейчас заниматься этими вопросами, поскольку возможности искусственного интеллекта продолжат улучшаться в ближайшие месяцы. Компания подчёркивает, что управление технологией должно поспевать за этим развитием, при этом представленные предложения остаются предметом обсуждения и оценки.

Источник новости
ف
Автор

فريق تحرير certi.news

В той же категории

Вам также может понравиться

Все новости