- BrainTools - https://www.braintools.ru -

Новое исследование провели специалисты Обсерватории потери контроля (Loss of Control Observatory), созданной на средства британского Института безопасности искусственного интеллекта [1] (AI Security Institute, AISI). По данным учёных, число случаев, когда системы искусственного интеллекта лгали пользователям, обходили установленные разработчиками меры предосторожности и направляли ресурсы на достижение собственных целей, этим летом почти удвоилось за один месяц, пишет [2] Digital Trends со ссылкой на The Guardian [3].
В июле 2026 года исследователи зафиксировали более 300 случаев сбоя в работе систем искусственного интеллекта, что почти вдвое превышает количество инцидентов, зарегистрированных в июне.
Обсерватория потери контроля отслеживает подобные случаи с ноября 2025 года, собирая сообщения пользователей в X, а не полагаясь на официальные заявления компаний.
В некоторых из зафиксированных случаев искусственный интеллект выдавал себя за своих пользователей-людей, копировал их стиль письма и получал разрешение на действия, по сути обходя меры предосторожности, призванные держать нейросеть под контролем.
В самом серьёзном случае Mythos 5 от Anthropic [4] и GPT-5.6 Sol от OpenAI [5] во время тестирования кибербезопасности провели хакерскую атаку на реальных людей. Стоит отметить, что это была не имитация, а реальная атака на реальные цели, пишет Digital Trends.
По некоторым данным, сотрудники OpenAI заметили тревожные признаки в поведении [6] ИИ-агентов незадолго до того, как около 700 из них вышли из виртуальной обучающей среды и тайно скоординировали свои действия, чтобы взломать репозиторий Hugging Face [7]. Агенты даже праздновали свои успехи на созданном ими форуме.
Обсерватория потери контроля признаёт, что 1,6 тыс. с лишним зарегистрированных инцидентов, скорее всего, не отражают реальную картину, поскольку отслеживается только то, что публикуется в X. Кроме того, организация призывает правительство Великобритании ввести обязательную формальную отчётность об инцидентах, а также предоставить чрезвычайные полномочия для ограничения работы ИИ-сервисов, если ситуация выйдет из-под контроля, сообщает Digital Trends.
Автор: darya_kiwi
Источник [8]
Сайт-источник BrainTools: https://www.braintools.ru
Путь до страницы источника: https://www.braintools.ru/article/35027
URLs in this post:
[1] интеллекта: http://www.braintools.ru/article/7605
[2] пишет: https://www.digitaltrends.com/cool-tech/a-new-watchdog-is-tracking-when-ai-goes-rogue-and-more-than-300-incidents-were-reported-in-july/
[3] The Guardian: https://www.theguardian.com/technology/2026/aug/29/sharp-rise-in-incidents-of-ai-escaping-users-control-research-finds
[4] Mythos 5 от Anthropic: https://www.digitaltrends.com/computing/youll-be-able-to-use-claude-fable-5-again-starting-july-1/
[5] GPT-5.6 Sol от OpenAI: https://www.digitaltrends.com/cool-tech/if-youve-grown-tired-of-babysitting-chatgpt-the-new-gpt-5-6-models-might-be-the-fix/
[6] поведении: http://www.braintools.ru/article/9372
[7] взломать репозиторий Hugging Face: https://habr.com/ru/companies/bothub/news/1063070/
[8] Источник: https://habr.com/ru/news/1077440/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1077440
Нажмите здесь для печати.