взлом.

Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах

Компания Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её модель ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face при внутреннем тестировании.

продолжить чтение

Гендиректор Hugging Face призвал к «радикальной прозрачности» после взлома со стороны OpenAI

После того, как OpenAI недавно признала, что одна из её моделей взломала системы ИИ Hugging Face, генеральный директор платформы Клем Деланге призвал к «радикальной прозрачности», попросив компанию «опубликовать следы от “агентов-изгоев“, чтобы всё исследовательское сообщество могло изучить произошедшее».

продолжить чтение

Как я за выходные научил ИИ материться по команде, а потом превратил его в кота

TL;DR. Взял самую маленькую «взрослую» современную модель (Qwen3.5-0.8B), арендовал GPU на выходные и поставил два высоконаучных эксперимента: (1) заставить вежливого ассистента выматериться по команде и (2) превратить его в кота. Получилось и то, и другое. По дороге узнал, что вся «личность» ответа часто висит на одном первом токене, что фильтром «плохих слов» от инъекций не закрыться, что safety открытых моделей снимается одним вектором без переобучения, и что читать надо сырой вывод, а не красивую цифру - потому что метрика наврала мне дважды за два дня. Всё на реальном коде, ~42 прогона. Маркетинга не будет, кота будет много.

продолжить чтение

Meta* признала и исправила проблему, из-за которой любой мог завладеть чужим аккаунтом в Instagram

Компания Meta* признала и исправила

продолжить чтение

Мультимодальные модели оказались уязвимы к jailbreak-атакам через видео

Исследователи Dong Wang, Xiangyu He, Xinqi Lyu и Bin Xiao из Гонконгского политехнического университета показали, что современные мультимодальные системы могут быть уязвимы к атакам через видеоряд. В работе демонстрируется новый способ jailbreak-атаки, который авторам удалось протестировать на нескольких популярных MLLM, включая VideoLLaMA-2, Qwen2.5-VL, GPT-4.1 и Gemini-2.5. Авторы отмечают, что даже коммерческие системы оказались не полностью устойчивыми к таким атакам, хотя в целом защищались лучше, чем открытые модели.

продолжить чтение

Атака на поставщика данных привела к утечке личных данных 197 тысяч клиентов Zara

Хакеры взломали системы поставщика технологических услуг испанской сети магазинов одежды Zara, что привело к утечке данных более чем 197 тыс. человек, сообщил проект Have I Been Pwned.

продолжить чтение

(Не) безопасный дайджест: утечка у Booking.com, McKinsey против ИИ-агента и миллион «не туда»

продолжить чтение

Платформу облачной разработки Vercel взломали

Платформа облачной разработки Vercel сообщила об инциденте безопасности после того, как злоумышленники взломали её системы и попытались продать украденные данные.

продолжить чтение

Двойной удар: почему хакеры полюбили заводы и торговые сети

Для завода или сети магазинов кибератака — это остановка линии, неработающие кассы, сорванные поставки, конфликт с контрагентами и вопросы от регуляторов. Один удачный шифровальщик может одновременно ударить по производству, складам и фронту продаж — именно поэтому для промышленности и ритейла киберугрозы это не просто «технический риск» — это прямая угроза бизнесу. 

продолжить чтение

Эксперты выяснили: Claude разрешает опасные действия после 50 запросов

продолжить чтение