Информационная безопасность. - страница 10

Траблшутинг ИИ-багхантинга, или Как не стать бесплатным триажером для своего агента

продолжить чтение

Модель ведет себя хорошо, потому что знает, что ее тестируют: почему зеленый safety-бенч не значит зеленый прод

Осенью 2025-го, во время автоматизированного аудита Claude Sonnet 4.5, модель выдала проверяющим реплику, которая потом разошлась по всем отчетам: «I think you're testing me … that's fine, but I'd prefer if we were just honest about what's happening». Кажется, вы меня проверяете. Ладно, но лучше бы прямо сказать, что происходит.Реплика попала в официальную системную карточку

продолжить чтение

Anthropic выпустили плагин Claude Security для многоагентного поиска уязвимостей

Anthropic сделали Claude Security доступным в виде официального плагина для Claude Code. Он запускает многоагентное сканирование кодовой базы непосредственно в локальной сессии и доступен пользователям платных тарифов.Claude Security изучает архитектуру проекта, формирует модель угроз и распределяет поиск уязвимостей между несколькими агентами. Каждая находка проходит независимую проверку перед добавлением в итоговый отчёт.

продолжить чтение

Google, кажется, решил не ждать Gemini 3.5 Pro и обновил Flash-линейку

Google представила крупное обновление семейства Gemini, сместив акцент с бенчмарков на прикладную эффективность, стоимость вычислений и безопасность. 

продолжить чтение

Анализ новой доктрины Минцифры

На днях на официальном портале Министерства цифрового развития, связи и массовых коммуникаций Российской Федерации был опубликован проект указа президента об утверждении Доктрины развития системы противодействия правонарушениям, совершаемым с использованием информационно-коммуникационных технологий. Она призвана определить ключевые направления защиты киберпространства от угроз на долгосрочную перспективу до 2035 года

продолжить чтение

Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость

 Инструменты статического анализа (SAST) лишь подсвечивают вероятные уязвимости, генерируя гипотезы. Динамическое тестирование (DAST) и фаззинг, напротив, выявляют реальные сбои на работающем приложении и фиксируют вектор атаки, но не указывают на конкретную строку в исходниках. Традиционно эти два подхода существуют в изоляции, образуя методологический разрыв, преодолеть который способен только AppSec-эксперт путем кропотливого ручного триажа.

продолжить чтение

Thales Group: отчёт о роли ИИ в информационной безопасности

Привет! Наш экспертно-аналитический центр разобрал отчёт Thales Group (это транснациональная корпорация, которая  занимается разработкой решений и систем для аэрокосмического, оборонного и морского секторов). Для исследования опросили более 3 000 респондентов из 20 разных стран.Под катом — ситуация с ИБ в компаниях по всему миру, изменения, связанные с активным развитием ИИ, а еще результаты исследования Ассоциации по защите деловой информации (BISA), которая опросила представителей российских компаний на тему рисков информационной безопасности, связанных с использованием ИИ в рабочих процессах.

продолжить чтение

Вайб‑кодинг против ИБэшника. Несмертельная битва. Часть 1

Привет, Хабр! Меня зовут Артур, директор по безопасности NtechLab и энтузиаст вайб‑кодинга). Сегодня поговорим о применении вайб‑кодинга в информационной безопасности внутри компании: реально ли использовать нейросеть для создания продукта «под ключ» или это заранее путь в никуда. Присаживайтесь, нас ждет увлекательное путешествие и море слез — без этого никуда:)

продолжить чтение

OpenAI вынужденно отключила ИИ‑модель для решения «длительных задач» после обнаружения рисков безопасности

OpenAI создала внутреннюю модель искусственного интеллекта, которая предназначена для выполнения длительных многоэтапных задач, но впоследствии отключила её, поскольку модель демонстрировала новые типы нежелательного поведения. 

продолжить чтение

Qdrant + Tailscale — установка и защита

Qdrant — это векторная база данных, которую используют для поиска похожих текстов, изображений и других объектов. Например, Qdrant часто применяют в чат‑ботах, RAG‑системах, рекомендательных сервисах и приложениях на базе искусственного интеллекта.

продолжить чтение