В OpenAI раскрыли новый тип атак на ИИ‑агентов
Компания OpenAI рассказала о новом типе атак на ИИ‑агентов. Он предполагает внедрение вредоносной инструкции, которая заставляет модель не только выполнить команды злоумышленника, но и перенести саму промпт‑инъекцию в другие сообщения или файлы для дальнейшего распространения.
Positive Technologies покажет новые технологии и ИИ‑разработки на Positive Security Day 2026
В Москве 15 и 16 октября пройдет Positive Security Day 2026 — ключевая технологическая конференция Positive Technologies. Компания представит новые продукты и разработки, покажет, как ИИ уже меняет атаку и защиту, и даст участникам возможность проверить технологии на практике.
UserGate и Новгородский филиал РАНХиГС подписали партнёрское соглашение
UserGate, ведущий российский разработчик решений в области кибербезопасности и архитектор сетевого доверия, и Новгородский филиал Российской академии народного хозяйства и государственной службы при Президенте Российской Федерации объявили о сотрудничестве. Партнёрское соглашение было подписано во время традиционного Дня Президентской академии в филиале РАНХиГС в Великом Новгороде 25 сентября 2026 года.
FTC начала расследование против OpenAI, Anthropic и METR из‑за рисков ИИ‑агентов
Федеральная торговая комиссия США (FTC) начала расследование в отношении OpenAI, Anthropic, исследовательской организации METR и других разработчиков ИИ. Регулятор хочет выяснить, какие риски их технологии могут создавать для потребителей. Особое внимание регулятор уделяет автономным ИИ-агентам. Поводом стали в том числе публичные заявления самих лабораторий о поведении их систем во время тестов.Наиболее заметный пример — июльский инцидент
Дайджест ИБ, 23–29 сентября: OpenAI остановила свои модели, атака на «Додо Пиццу»
Новости информационной безопасности за неделю с 23 по 29 сентября, по одной строке на событие. В восьми разделах 49 материалов, у каждого ссылка на источник, англоязычные материалы помечены.Как это сделано. По алгоритму отбираются важные новости, далее черновики собирает языковая модель на данных, после чего каждое число, дата и ссылка сверяются с первоисточником. Подробнее на Хабре
Год назад мы обсуждали, смогут ли ИИ-агенты взламывать сайты. Теперь считаем инциденты
За несколько месяцев агенты OpenAI и Anthropic вышли за пределы тестовых сред, скомпрометировали инфраструктуру Hugging Face, получили доступ к production-системам реальных компаний и засветились на государственных сайтах США и Австралии. Проблема оказалась интереснее сценария «ИИ решил стать хакером»: иногда агент просто продолжает выполнять поставленную задачу и не воспринимает технический барьер как границу допустимого.
За каждым «судным днем» от ИИ будут стоять вполне конкретные Имя и Фамилия…
Общедоступные ИИ уже незаменимы.Сильные ИИ не для каждого.У каждого сильного ИИ есть свой Нильсон с дудочкой.Что ещё, возможно, мы упускаем?Привет, Хабр! В данной статье не будет простыней кода, сложных математических формул или ссылок на личный гит. Так же в статье не пойдет речь о лучших практиках безопасного применения ИИ в разработке. Речь пойдет об оценке возможностей ИИ, зоне их ответственности и, как следствие, безопасности их применения, в том числе, и в разработке.

