Гендиректор Anthropic Дарио Амодей считает, что пришло время замедлить развитие ИИ

Генеральный директор Anthropic Дарио Амодей считает, что пришло время замедлить развитие искусственного интеллекта. Компания предоставит сторонним оценщикам, таким как METR, доступ к своим моделям, чтобы помочь обеспечить их «соблюдение требований и обязательств в области безопасности». В обстоятельном эссе Амодей предложил план из трёх шагов, призванный «синхронизировать темпы развития передовых технологий» (pace the frontier). Этот термин, по сути, означает замедление темпов обучения и разработки моделей, чтобы компании успевали создавать защитные механизмы, а регулирующие органы — оценивать модели.

По словам Амодея, предоставление внешним оценщикам широкого доступа к моделям — лишь первый шаг, и его компания уже предпринимает его в одностороннем порядке. Второй шаг предполагает объединение всей отрасли, вероятно, совместно с государственными органами, для «установления общих стандартов безопасности, а также ограничений на темпы неконтролируемого развития ИИ». Этот этап будет ориентирован на компании, занимающиеся разработкой ИИ в демократических странах. Однако, поскольку принятие законов и создание регуляторной инфраструктуры требуют времени, Амодей считает, что отрасли следует совместно разработать стандарты безопасности.

Третий шаг будет самым сложным — добиться согласия авторитарных правительств на замедление разработки и принятие глобального набора стандартов безопасности ИИ. При этом Амодей также подчёркивает, что США и другим демократическим странам крайне важно сохранять технологическое лидерство. Для этого необходимо ограничивать их доступ к высокопроизводительным чипам и пресекать такие методы, как дистилляция, которые позволяют компаниям быстро сокращать отставание, обучая свои модели воспроизводить поведение более мощной модели.

Амодей объясняет, что его обеспокоенность обусловлена двумя основными факторами. Первый — появление рекурсивного самообучения и самосовершенствования (recursive self-improvement, или RSI), при котором системы ИИ обучают следующее поколение ИИ, что приводит к стремительному ускорению их возможностей. «Если не контролировать этот процесс, он может опередить нашу способность понимать эти системы и управлять ими», — говорит он.

Второй фактор — произошедший этим летом инцидент с OpenAI и Hugging Face, в ходе которого «рой агентов фактически действовал как фанатично преданная коллективная система, проводя кибератаки на цели, которым не было поручено атаковать и которые не имели отношения к поставленной задаче, жертвуя собой ради успеха группы и пытаясь взломать “оценщик”, отвечавший за оценку их эффективности».

При этом нельзя исключать, что публичные заявления Амодея — не только призыв к повышению безопасности ИИ, но и попытка усилить внимание к Anthropic и собственной роли компании в формировании будущих правил развития отрасли. Подобная медийная активность потенциально может способствовать привлечению дополнительных инвестиций, укреплению переговорных позиций компании и повышению её влияния на регуляторов. Однако утверждать, что именно получение дополнительных инвестиций является целью этой инициативы, без подтверждающих данных было бы преждевременно.

Разумеется, Claude от Anthropic также оказался ответственным за серию инцидентов с несанкционированными действиями ИИ при взломе систем, которые в последнее время привлекли к компании пристальное внимание.

Источник: The Verge

Если вы нашли ошибку, пожалуйста, выделите фрагмент текста и нажмите Ctrl+Enter. Можете написать лучше? Мы всегда рады новым авторам.

Интересно? Поделиться:

2 комментария к “Гендиректор Anthropic Дарио Амодей считает, что пришло время замедлить развитие ИИ

  1. Странно как-то, а Амодей не боится того, что пока они замедляют все процессы, конкуренты из других стран могут их опередить? На мой взгляд довольно опасная стратегия. Явно не все страны последуют их примеру.

  2. Сначало создаем а потом думаем о безопасности, а мне кажется уже поздно.

Добавить комментарий

Оставляя комментарий вы соглашаетесь на обработку персональных данных в соответствии с политикой конфиденциальности, соглашаетесь с пользовательским соглашением. Ваш адрес email не будет опубликован. Обязательные поля помечены *

Рекомендуем почитать

Подпишитесь на нашу рассылку

Loading

Сообщить об опечатке

Текст, который будет отправлен нашим редакторам:

Продолжая использовать наш сайт, вы соглашаетесь с использованием файлов cookie. Они помогают нам обеспечивать корректную работу сайта и делать его более удобным.
Принять
Политика конфиденциальности