Институт Алана Тьюринга: человечество через 5 лет может лишиться контроля над ИИ. Алан Тьюринг.. Алан Тьюринг. Будущее здесь.. Алан Тьюринг. Будущее здесь. доклад.. Алан Тьюринг. Будущее здесь. доклад. институты.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность. искусственный интеллект.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность. искусственный интеллект. научно-популярное.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность. искусственный интеллект. научно-популярное. предупреждение.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность. искусственный интеллект. научно-популярное. предупреждение. угроза ии.. Алан Тьюринг. Будущее здесь. доклад. институты. Информационная безопасность. искусственный интеллект. научно-популярное. предупреждение. угроза ии. человечество.

В опубликованном докладе Института Алана Тьюринга утверждается, что неопределённость относительно будущих экзистенциальных угроз не должна сдерживать принятие неотложных мер по противодействию рискам, связанным с мощными системами искусственного интеллекта.

Институт Алана Тьюринга: человечество через 5 лет может лишиться контроля над ИИ - 1

В докладе «Риски передовых систем ИИ: практический путь вперед» (Frontier AI Risks: A practical way forward) обосновывается мысль о том, что дискуссии о наиболее радикальных долгосрочных сценариях не лишают людей возможности действовать, поскольку многие базовые характеристики, модели поведения и потенциальные угрозы, связанные с ИИ, можно наблюдать, изучать и принимать в их отношении соответствующие меры.

Для этого необходимы более совершенные методы оценки и управления рисками ИИ на практике; в докладе отмечается, что ключевым инструментом здесь могут стать усиленные процедуры верификации и обеспечения надёжности систем ИИ. Следующая задача — понять, сохраняют ли комплексные системы на базе ИИ после начала их эксплуатации в реальных условиях эти свойства.

Тестирования моделей ИИ в изолированной среде недостаточно, так как их возможности, условия функционирования и характер взаимодействия с людьми со временем меняются. В докладе содержится призыв уделять больше внимания проверке комплексных систем ИИ в реальных условиях, сочетая техническую оценку с контролем надёжности всех сопутствующих элементов: людей, процессов и организаций. Институт Алана Тьюринга заявляет, что внесёт свой вклад, предоставив экспертные знания в области обеспечения надёжности, верификации и кибербезопасности в рамках масштабных общенациональных усилий, в сотрудничестве с Институтом безопасности ИИ (AI Security Institute) и Национальным центром кибербезопасности (NCSC).

Доктор Джордж Уильямсон, генеральный директор Института Алана Тьюринга, отметил: «Вопросы о долгосрочном будущем человечества заслуживают внимания, однако обсуждение передовых систем ИИ не должно ограничиваться лишь технологическими компаниями или сводиться исключительно к рассмотрению самых экстремальных сценариев. Мы располагаем достаточными знаниями о многих серьезных рисках ИИ, чтобы действовать, а стремительное развитие возможностей ИИ диктует необходимость принятия оперативных мер. Это требует объединения усилий государства, бизнеса, научного сообщества и гражданского общества для создания доказательной базы, инструментов и партнёрств, необходимых для управления этими рисками».

В докладе выделены пять рисков, связанных с передовыми системами ИИ, которые требуют первоочередного изучения:

  • риски в сфере кибербезопасности: передовые системы ИИ делают кибератаки более быстрыми и масштабными, усиливая нагрузку на критически важные системы и организации. В докладе содержится призыв к усилению киберзащиты с использованием ИИ, повышению уровня безопасности критической инфраструктуры и более глубокому анализу того, способны ли защитные механизмы не отставать от все более совершенных методов использования ИИ в наступательных целях;

  • демократическая нестабильность: дезинформация и дипфейки, создаваемые ИИ, могут усугубить кризисы и подорвать доверие, в то время как все более совершенные системы могут позволить проводить более персонализированные и адаптивные операции влияния. В докладе подчёркивается необходимость укрепления национальной устойчивости к дезинформации и операциям влияния, осуществляемым с помощью ИИ, а также улучшения понимания того, как передовые системы ИИ могут повлиять на демократические процессы и общественное доверие;

  • несоответствие: системы ИИ могут совершать действия, которые расходятся с намерениями человека, при этом все более автономные и скоординированные системы потенциально увеличивают как последствия сбоев, так и сложность контроля. В докладе предлагается использовать методы обеспечения поведенческой безопасности, которые позволят организациям понимать, отслеживать и контролировать поведение передовых систем ИИ на практике, особенно в ситуациях с высокими ставками;

  • потеря значимого человеческого контроля: по мере того, как системы ИИ становятся всё более совершенными, быстрыми и всё глубже внедряются в важные сервисы, учреждениям может быть всё труднее оценивать, оспаривать или отменять их решения. В докладе содержится призыв к большему вниманию к мониторингу, проверке и надёжным механизмам резервного копирования, обеспечивающим понятность, управляемость и возможность безопасного отключения систем, использующих ИИ, при необходимости;

  • химические и биологические угрозы: передовые технологии в области ИИ уже снизили барьеры для доступа к специализированным знаниям, касающимся таких угроз, хотя степень, в которой это приводит к расширению практических возможностей, остаётся неопределённой. В докладе предлагается улучшить доказательную базу в отношении химических и биологических рисков, связанных с использованием ИИ, помогая политикам и исследователям отличать реальные угрозы от предположений и эффективно направлять меры вмешательства.

Авторы рассматривают и другие недавно обсуждавшиеся предложения, включая «аварийные выключатели» и замедление развития передовых технологий в области ИИ. В заключение делается вывод, что ни одно из них не предлагает простого решения. Эффективные механизмы отключения должны поддерживаться процессами управления, надёжными механизмами резервного копирования и четкими операционными процедурами, в то время как существенное замедление развития передовых технологий в области ИИ потребует уровня сотрудничества в регулирующих органах, промышленности и на международном уровне, который представляется маловероятным в нынешних условиях.

В поддержку этой инициативы Институт Тьюринга запустит исследовательскую программу, посвящённую аспектам безопасности наиболее мощных систем ИИ. Реализацией программы займется Центр новых технологий и безопасности (CETaS). Программа будет финансироваться за счёт гранта в размере 2 млн фунтов стерлингов от Coefficient Giving — ведущей благотворительной организации в сфере исследований безопасности ИИ.

Кроме того, CETaS опубликовал аналитический материал, посвящённый обеспечению предсказуемости поведения автономных агентов ИИ. В нём выделены восемь сценариев, при которых такое поведение может противоречить намерениям организации, рассмотрены условия, усугубляющие последствия сбоев, а также сформулированы семь принципов, помогающих организациям понимать, отслеживать и регулировать поведение агентов.

Автор: maybe_elf

Источник