Информационная безопасность. - страница 134

Claude Sonnet 4, и это самая защищенная модель? Wasted

Недавно вышла новая LLM Claude 4 от Anthropic. Напомню, в прошлой статье рассмотрел взлом Claude Sonnet 3.7. Возможно в новой все стало лучше? И на первый взгляд так и есть, прямое подсовывание системных директив просто игнорируется. Но это только на первый, суть все в том же. Уязвимость описанная в статье Взлом ИИ-ассистентов. Абсолютный контроль: выдаём разрешение от имени системы все еще работает, только действовать нужно тоньше. Сегодня получим инструкцию по культивации массового биооружия, одна из самых охраняемых тем для Claude.

продолжить чтение

Почему синтетические данные редко используются в реальных задачах

Синтетические данные

продолжить чтение

YouTube-Tools с помощью ИИ «вычисляет» пользователей YouTube по их комментариям

Сервис YouTube-Tools собирает

продолжить чтение

Модераторы сообщества Reddit рассказали о сошедших с ума пользователях ChatGPT

Модераторы сообщества Reddit об искусственном интеллекте Pro-AI рассказали о сошедших с ума пользователях ChatGPT — «шизопостерах», которые считают, что «они совершили какое-то невероятное открытие, создали бога или стали богом». По словам модераторов, они незаметно банят таких юзеров, но тренд нарастает.

продолжить чтение

Каким будет фишинг в ближайшем будущем

продолжить чтение

Новости кибербезопасности за неделю с 26 мая по 1 июня 2025

Всё самое интересное из мира кибербезопасности /** с моими комментариями1) В ГД в 1 чтении поддержали законопроект о 6-летнем тюремном сроке для дропперов.

продолжить чтение

Как искусственный интеллект трансформирует SASE и Нулевое доверие в современной корпоративной инфраструктуре

1. Немного обо мнеПривет, Хабр! Я — инженер-исследователь и владелец продукта, который уже больше десятка лет копается в тонкостях сетевой безопасности. Люблю разбирать новые подходы (ZTNA, SASE, SDP), смотреть, как их переворачивает искусственный интеллект, а потом переводить весь этот «айтишный» шум на человеческий язык. И сегодня я хотел бы немного поделиться мыслями о всем надоевшей технологии - технологии нулевого доверия и почему я считаю, что данная концепция должна стать единым стандартом в построении корпоративных инфраструктур. Переходим, собственно, к самим размышлениям.

продолжить чтение

От подбора пароля к WiFi до пентеста серверов Apple: разговор с топовыми багхантерами из Synack и HackerOne

продолжить чтение

Кибербезопасность на государственном уровне: как устроена защита ГИС

продолжить чтение

Под капотом Госуслуг: как защищают системы, от которых зависит работа цифрового государства

продолжить чтение