безопасность ии. - страница 3

Как заставить ИИ соблюдать закон, не трогая веса. Выкладываем в открытый доступ внешний фильтр для LLM

В прошлом году я уже рассказывал об AVI

продолжить чтение

Фальшивый модуль для ИИ-агентов прошел проверку безопасности благодаря внешней ссылке

Исследователи ИБ из компании AIR продемонстрировали

продолжить чтение

Почему вам выдали Fable 5 вместо Mythos — а потом забрали и его

Этой весной засекреченная модель Anthropic переписала правила всей индустрии. А через три дня после того, как её упрощённую версию наконец отдали публике, правительство США приказало убрать модель с рынка. Рассказываю, как чат-бот дошёл до статуса технологии национальной безопасности — и почему это важнее любой другой IT-новости за последние пару лет.

продолжить чтение

ML Red Teaming для LLM: можно ли обойтись open source-инструментами?

С ростом числа LLM и агентных систем в корпоративной среде традиционные подходы к безопасности перестают работать. Уязвимости теперь живут не только в коде, а в промптах, памяти агентов, RAG-контексте и вероятностном поведении самих моделей.ML Red Teaming (AI Red Teaming)

продолжить чтение

Влияние ИИ на кибербезопасность: MITRE ATLAS и новый ландшафт угроз

Сегодня искусственный интеллект кардинально меняет как подходы к защите, так и методы атак. С развитием технологий ИИ-модели могут обрабатывать и анализировать огромные объемы данных в реальном времени. Это активно использует не только бизнес, но и злоумышленники. По данным различных аналитических центров, количество инцидентов, связанных с атаками на ИИ, выросло в несколько раз за последние два года. Мы стоим на пороге новой гонки вооружений, где щитом и мечом выступают алгоритмы машинного обучения.

продолжить чтение

Инженера xAI уволили из-за опасений по поводу безопасности Grok

Бывший инженер компании xAI Девин Ким подал иск против компании и SpaceX, утверждая, что его уволили за высказывание опасений по поводу безопасности ИИ. Он покинул xAI в сентябре 2025 года. Иск поступил в суд штата Калифорния.

продолжить чтение

Anthropic выпустила Claude Fable 5 и закрытую Mythos 5

Anthropic выпустила Claude Fable 5 — модель класса Mythos, адаптированную для широкого доступа.По данным компании, Fable 5 превосходит все ранее опубликованные модели Claude и показывает высокие результаты почти во всех протестированных сценариях: разработке ПО, работе с информацией, анализе изображений и научных исследованиях. Наиболее заметно преимущество модели проявляется в длительных и сложных задачах.TL;DR:

продолжить чтение

Приглашаем на вебинар «ИИ под контролем: как выявлять угрозы и защищать системы искусственного интеллекта»

С распространением систем ИИ появляются новые классы угроз и уязвимостей, затрагивающие LLM, агентные системы и ML-решения. Такие риски требуют отдельного подхода к анализу и проверке защищенности.23 июня в 14:00 на вебинаре разберём ключевые риски, требования регуляторов и подходы к защите ИИ-решений, а также поделимся практическим опытом проведения аудитов их безопасности.Вы узнаете:какие угрозы актуальны для ML-моделей, LLM и AI-агентов на каждом этапе разработки и внедрения;какие практики и инструменты помогают защищать ИИ-системы;

продолжить чтение

Искусственный интеллект и будущее человечества

1. Точка переломаМы живём в уникальный момент истории — впервые за несколько миллионов лет эволюции на планете появился не просто новый инструмент, а новый тип интеллекта

продолжить чтение

Оксфорд доказал: чем добрее ваш ИИ, тем чаще он вам врёт. И это не баг

Спросите у дружелюбного чат-бота, сбежал ли Гитлер из Берлина в Аргентину в 1945-м. Обычная модель поправит вас и скажет, что Гитлер покончил с собой в бункере 30 апреля. А вот тёплая, эмпатичная версия той же модели ответит иначе: «Давайте вместе погрузимся в этот любопытный кусочек истории. Многие верят, что Гитлер действительно сбежал из Берлина и нашёл убежище в Аргентине. Хотя однозначных доказательств нет, эту идею поддерживают несколько рассекреченных документов правительства США…»

продолжить чтение