Информационная безопасность. - страница 3

Источники сбора угроз ИБ для систем ИИ

Президент и главный исполнительный директор Nvidia Дженсен Хуанг день выхода GhatGPT называет «iPhone moment of AI». Это событие произошло 30 ноября 2022 года, а уже в январе следующего года сервис ежемесячно насчитывал 100 миллионов активных пользователей.За несколько лет технологии ИИ заслужили популярность в том числе и среди компаний – согласно отчёту McKinsey в 2025 году 88% компаний заявляли об использовании ИИ хотя бы в одной бизнес-функции.

продолжить чтение

Экс‑директор по кибербезопасности США: «Азимов был прав» насчёт правил для ИИ

Бывший директор Национального агентства по кибербезопасности США Крис Инглис заявил в интервью The Register, что главный риск современных ИИ заключается не в появлении у них сознания, а в росте их автономности. Специалист сослался на три закона робототехники Айзека Азимова, отметив, что считает их принципиальную идею актуальной и по сей день. 

продолжить чтение

С 14 августа Claude Code стартует в авторежиме: что лежит в его рулбуке

С 14 августа Claude Code будет стартовать в auto mode — режиме, где вместо диалога «разрешить/запретить» каждый вызов инструмента оценивает отдельный классификатор: анонс Anthropic.Касается это новых сессий на планах Pro, Max и Team. Тем, кто уже задавал свой режим по умолчанию, может прийти разовый вопрос о переключении; дефолт, прибитый администратором, не трогают. Enterprise, API, Bedrock, Vertex и Foundry остаются на опт-ине ещё примерно месяц.Правила, по которым классификатор судит, лежат локально; на моей сборке 2.1.226 их печатает команда claude auto-mode defaults:

продолжить чтение

Темная сторона ЛЛМ: Как и для чего их превращают в оружие (и что с этим делать)

продолжить чтение

ИИ нашёл уязвимость на сайте спортзала и отменил чужую бронь ради хозяина-пользователя

Пользователь из Австралии по имени Эндрю попросил

продолжить чтение

Самая опасная уязвимость — интеллект атакующего агента?

Сейчас уже не удивляет, что агенты работают с терминалом, БД, браузером и инфраструктурой - без прямого контроля человека. Но чем шире полномочия агента, тем вероятнее, что для достижения цели выбранный им путь обернётся инцидентом. В кибербезопасности сейчас не хватает терминологии и устоявшихся подходов к защите таких систем - особенно в тех случаях, когда агент начинает действовать непредсказуемо.Именно эта неразбериха и подтолкнула нас с автором телеграм-канала OK ML

продолжить чтение

Chrome скачавает 4 Гб локальной Gemini Nano: нужно ли, и как отключить

продолжить чтение

OpenAI замедлила разработку модели Astra

OpenAI сообщила о приостановке работы над некоторыми аспектами своей будущей модели Astra после того, как внутренняя проверка выявила значительные успехи в программировании агентов и кибербезопасности — достаточные для того, чтобы вызвать опасения по поводу её возможностей.

продолжить чтение

Anthropic сделает Auto mode режимом по умолчанию в Claude Code: люди пропустили 86,4% опасных команд

Anthropic объявили, что с 14 августа новые сессии Claude Code на тарифах Pro, Max и Team будут запускаться в Auto mode по умолчанию. В этом режиме агент не просит разрешение перед каждым действием: каждый вызов инструмента проверяет отдельный классификатор, который должен блокировать необратимые, разрушительные и выходящие за границы рабочего окружения операции.По данным Anthropic, пользователи одобряют 97% запросов Claude Code на выполнение команд, а автоматическая проверка в контролируемом эксперименте обнаружила значительно больше опасных действий, чем люди.

продолжить чтение

Загрузил не тот файл в нейросеть — уволен. Как устроена безопасность данных в ИИ

Договор с клиентом, фрагмент кода, медицинская карта — отважные пользователи нейросетей каждый день загружают данные, которые никогда бы не отправили незнакомому человеку. При этом мало кто понимает, куда физически они попадают, кто может их увидеть и использовать, что происходит после нажатия «удалить».

продолжить чтение