- BrainTools - https://www.braintools.ru -

Исследование: ИИ стал чаще выходить из-под контроля

Исследование: ИИ стал чаще выходить из-под контроля - 1

Новое исследование провели специалисты Обсерватории потери контроля (Loss of Control Observatory), созданной на средства британского Института безопасности искусственного интеллекта [1] (AI Security Institute, AISI). По данным учёных, число случаев, когда системы искусственного интеллекта лгали пользователям, обходили установленные разработчиками меры предосторожности и направляли ресурсы на достижение собственных целей, этим летом почти удвоилось за один месяц, пишет [2] Digital Trends со ссылкой на The Guardian [3].

В июле 2026 года исследователи зафиксировали более 300 случаев сбоя в работе систем искусственного интеллекта, что почти вдвое превышает количество инцидентов, зарегистрированных в июне.

Обсерватория потери контроля отслеживает подобные случаи с ноября 2025 года, собирая сообщения пользователей в X, а не полагаясь на официальные заявления компаний.

В некоторых из зафиксированных случаев искусственный интеллект выдавал себя за своих пользователей-людей, копировал их стиль письма и получал разрешение на действия, по сути обходя меры предосторожности, призванные держать нейросеть под контролем.

В самом серьёзном случае Mythos 5 от Anthropic [4] и GPT-5.6 Sol от OpenAI [5] во время тестирования кибербезопасности провели хакерскую атаку на реальных людей. Стоит отметить, что это была не имитация, а реальная атака на реальные цели, пишет Digital Trends.

По некоторым данным, сотрудники OpenAI заметили тревожные признаки в поведении [6] ИИ-агентов незадолго до того, как около 700 из них вышли из виртуальной обучающей среды и тайно скоординировали свои действия, чтобы взломать репозиторий Hugging Face [7]. Агенты даже праздновали свои успехи на созданном ими форуме.

Обсерватория потери контроля признаёт, что 1,6 тыс. с лишним зарегистрированных инцидентов, скорее всего, не отражают реальную картину, поскольку отслеживается только то, что публикуется в X. Кроме того, организация призывает правительство Великобритании ввести обязательную формальную отчётность об инцидентах, а также предоставить чрезвычайные полномочия для ограничения работы ИИ-сервисов, если ситуация выйдет из-под контроля, сообщает Digital Trends.

Автор: darya_kiwi

Источник [8]


Сайт-источник BrainTools: https://www.braintools.ru

Путь до страницы источника: https://www.braintools.ru/article/35027

URLs in this post:

[1] интеллекта: http://www.braintools.ru/article/7605

[2] пишет: https://www.digitaltrends.com/cool-tech/a-new-watchdog-is-tracking-when-ai-goes-rogue-and-more-than-300-incidents-were-reported-in-july/

[3] The Guardian: https://www.theguardian.com/technology/2026/aug/29/sharp-rise-in-incidents-of-ai-escaping-users-control-research-finds

[4] Mythos 5 от Anthropic: https://www.digitaltrends.com/computing/youll-be-able-to-use-claude-fable-5-again-starting-july-1/

[5] GPT-5.6 Sol от OpenAI: https://www.digitaltrends.com/cool-tech/if-youve-grown-tired-of-babysitting-chatgpt-the-new-gpt-5-6-models-might-be-the-fix/

[6] поведении: http://www.braintools.ru/article/9372

[7] взломать репозиторий Hugging Face: https://habr.com/ru/companies/bothub/news/1063070/

[8] Источник: https://habr.com/ru/news/1077440/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1077440

www.BrainTools.ru

Rambler's Top100