- BrainTools - https://www.braintools.ru -
В опубликованном докладе Института Алана Тьюринга утверждается [1], что неопределённость относительно будущих экзистенциальных угроз не должна сдерживать принятие неотложных мер по противодействию рискам, связанным с мощными системами искусственного интеллекта [2].
В докладе «Риски передовых систем ИИ: практический путь вперед» (Frontier AI Risks: A practical way forward) обосновывается мысль о том, что дискуссии о наиболее радикальных долгосрочных сценариях не лишают людей возможности действовать, поскольку многие базовые характеристики, модели поведения [3] и потенциальные угрозы, связанные с ИИ, можно наблюдать, изучать и принимать в их отношении соответствующие меры.
Для этого необходимы более совершенные методы оценки и управления рисками ИИ на практике; в докладе отмечается, что ключевым инструментом здесь могут стать усиленные процедуры верификации и обеспечения надёжности систем ИИ. Следующая задача — понять, сохраняют ли комплексные системы на базе ИИ после начала их эксплуатации в реальных условиях эти свойства.
Тестирования моделей ИИ в изолированной среде недостаточно, так как их возможности, условия функционирования и характер взаимодействия с людьми со временем меняются. В докладе содержится призыв уделять больше внимания [4] проверке комплексных систем ИИ в реальных условиях, сочетая техническую оценку с контролем надёжности всех сопутствующих элементов: людей, процессов и организаций. Институт Алана Тьюринга заявляет, что внесёт свой вклад, предоставив экспертные знания в области обеспечения надёжности, верификации и кибербезопасности в рамках масштабных общенациональных усилий, в сотрудничестве с Институтом безопасности ИИ (AI Security Institute) и Национальным центром кибербезопасности (NCSC).
Доктор Джордж Уильямсон, генеральный директор Института Алана Тьюринга, отметил: «Вопросы о долгосрочном будущем человечества заслуживают внимания, однако обсуждение передовых систем ИИ не должно ограничиваться лишь технологическими компаниями или сводиться исключительно к рассмотрению самых экстремальных сценариев. Мы располагаем достаточными знаниями о многих серьезных рисках ИИ, чтобы действовать, а стремительное развитие возможностей [5] ИИ диктует необходимость принятия оперативных мер. Это требует объединения усилий государства, бизнеса, научного сообщества и гражданского общества для создания доказательной базы, инструментов и партнёрств, необходимых для управления этими рисками».
В докладе выделены пять рисков, связанных с передовыми системами ИИ, которые требуют первоочередного изучения:
риски в сфере кибербезопасности: передовые системы ИИ делают кибератаки более быстрыми и масштабными, усиливая нагрузку на критически важные системы и организации. В докладе содержится призыв к усилению киберзащиты с использованием ИИ, повышению уровня безопасности критической инфраструктуры и более глубокому анализу того, способны ли защитные механизмы не отставать от все более совершенных методов использования ИИ в наступательных целях;
демократическая нестабильность: дезинформация и дипфейки, создаваемые ИИ, могут усугубить кризисы и подорвать доверие, в то время как все более совершенные системы могут позволить проводить более персонализированные и адаптивные операции влияния. В докладе подчёркивается необходимость укрепления национальной устойчивости к дезинформации и операциям влияния, осуществляемым с помощью ИИ, а также улучшения понимания того, как передовые системы ИИ могут повлиять на демократические процессы и общественное доверие;
несоответствие: системы ИИ могут совершать действия, которые расходятся с намерениями человека, при этом все более автономные и скоординированные системы потенциально увеличивают как последствия сбоев, так и сложность контроля. В докладе предлагается использовать методы обеспечения поведенческой безопасности, которые позволят организациям понимать, отслеживать и контролировать поведение [6] передовых систем ИИ на практике, особенно в ситуациях с высокими ставками;
потеря значимого человеческого контроля: по мере того, как системы ИИ становятся всё более совершенными, быстрыми и всё глубже внедряются в важные сервисы, учреждениям может быть всё труднее оценивать, оспаривать или отменять их решения. В докладе содержится призыв к большему вниманию к мониторингу, проверке и надёжным механизмам резервного копирования, обеспечивающим понятность, управляемость и возможность безопасного отключения систем, использующих ИИ, при необходимости;
химические и биологические угрозы: передовые технологии в области ИИ уже снизили барьеры для доступа к специализированным знаниям, касающимся таких угроз, хотя степень, в которой это приводит к расширению практических возможностей, остаётся неопределённой. В докладе предлагается улучшить доказательную базу в отношении химических и биологических рисков, связанных с использованием ИИ, помогая политикам и исследователям отличать реальные угрозы от предположений и эффективно направлять меры вмешательства.
Авторы рассматривают и другие недавно обсуждавшиеся предложения, включая «аварийные выключатели» и замедление развития передовых технологий в области ИИ. В заключение делается вывод, что ни одно из них не предлагает простого решения. Эффективные механизмы отключения должны поддерживаться процессами управления, надёжными механизмами резервного копирования и четкими операционными процедурами, в то время как существенное замедление развития передовых технологий в области ИИ потребует уровня сотрудничества в регулирующих органах, промышленности и на международном уровне, который представляется маловероятным в нынешних условиях.
В поддержку этой инициативы Институт Тьюринга запустит исследовательскую программу, посвящённую аспектам безопасности наиболее мощных систем ИИ. Реализацией программы займется Центр новых технологий и безопасности (CETaS). Программа будет финансироваться за счёт гранта в размере 2 млн фунтов стерлингов от Coefficient Giving — ведущей благотворительной организации в сфере исследований безопасности ИИ.
Кроме того, CETaS опубликовал аналитический материал, посвящённый обеспечению предсказуемости поведения автономных агентов ИИ. В нём выделены восемь сценариев, при которых такое поведение может противоречить намерениям организации, рассмотрены условия, усугубляющие последствия сбоев, а также сформулированы семь принципов, помогающих организациям понимать, отслеживать и регулировать поведение агентов.
Автор: maybe_elf
Источник [7]
Сайт-источник BrainTools: https://www.braintools.ru
Путь до страницы источника: https://www.braintools.ru/article/35954
URLs in this post:
[1] утверждается: https://www.turing.ac.uk/news/alan-turing-institute-sets-out-practical-agenda-tackle-frontier-ai-risks
[2] интеллекта: http://www.braintools.ru/article/7605
[3] поведения: http://www.braintools.ru/article/9372
[4] внимания: http://www.braintools.ru/article/7595
[5] развитие возможностей: http://www.braintools.ru/article/8705
[6] поведение: http://www.braintools.ru/article/5593
[7] Источник: https://habr.com/ru/news/1086028/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1086028
Нажмите здесь для печати.