GitHub изменил программу вознаграждений за обнаружение ошибок
Инструменты искусственного интеллекта значительно упростили поиск ошибок в программном обеспечении и создание патчей, в результате чего такие проекты, как ядро Linux, получают гораздо больше обратной связи от общественности. GitHub также наблюдает рост числа участников своей программы Bug Bounty и вносит в неё некоторые изменения. Компания решила формализовать постоянную закрытую/эксклюзивную VIP-программу для квалифицированных исследователей, которые предоставляют высококачественные отчёты.
В Конгресс США внесли законопроект, позволяющий властям замедлять и отключать системы ИИ
В Палату представителей США внесли документ под названием «Закон о выключателе ИИ» (AI Kill Switch Act), который обяжет разработчиков нейросетей сохранять возможность для властей замедлять, приостанавливать и отключать работу своих языковых моделей. Законопроект представили члены нижней палаты американского парламента демократ Тед Лью и республиканец Натаниэль Моран.
LG по указанию Microsoft удалит всплывающую рекламу McAfee из своего установщика приложений
LG удалит всплывающую рекламу McAfee из приложения для мониторов, которое незаметно установили на подключённые компьютеры на Windows. Компания идёт на такой шаг по требованию Microsoft.
Вашего AI-агента уже перехватили
Привет, Хабр! Сегодня почти у всех часть задач (если не все) переложены на агента. А там где массовость — всегда и высокие риски для безопасности, так как подобрав правильно вектор атаки один раз, злоумышленник имеет возможность эксплуатировать уязвимость снова и снова.Он вам не агент
ИИ в ИБ: где он реально работает, а где — просто модный ярлык
Ещё три года назад словосочетание «искусственный интеллект» в информационной безопасности встречалось в основном в презентациях крупных вендоров. Сегодня ситуация изменилась. Практически любой продукт на рынке так или иначе использует AI (ИИ), ML, LLM или другие аббревиатуры, связанные с искусственным интеллектом.
Модель ведет себя хорошо, потому что знает, что ее тестируют: почему зеленый safety-бенч не значит зеленый прод
Осенью 2025-го, во время автоматизированного аудита Claude Sonnet 4.5, модель выдала проверяющим реплику, которая потом разошлась по всем отчетам: «I think you're testing me … that's fine, but I'd prefer if we were just honest about what's happening». Кажется, вы меня проверяете. Ладно, но лучше бы прямо сказать, что происходит.Реплика попала в официальную системную карточку
Anthropic выпустили плагин Claude Security для многоагентного поиска уязвимостей
Anthropic сделали Claude Security доступным в виде официального плагина для Claude Code. Он запускает многоагентное сканирование кодовой базы непосредственно в локальной сессии и доступен пользователям платных тарифов.Claude Security изучает архитектуру проекта, формирует модель угроз и распределяет поиск уязвимостей между несколькими агентами. Каждая находка проходит независимую проверку перед добавлением в итоговый отчёт.
Google, кажется, решил не ждать Gemini 3.5 Pro и обновил Flash-линейку
Google представила крупное обновление семейства Gemini, сместив акцент с бенчмарков на прикладную эффективность, стоимость вычислений и безопасность.
Анализ новой доктрины Минцифры
На днях на официальном портале Министерства цифрового развития, связи и массовых коммуникаций Российской Федерации был опубликован проект указа президента об утверждении Доктрины развития системы противодействия правонарушениям, совершаемым с использованием информационно-коммуникационных технологий. Она призвана определить ключевые направления защиты киберпространства от угроз на долгосрочную перспективу до 2035 года

