Информационная безопасность. - страница 67

Как РосАтом на чёрном рынке ИИ покупал

"Кроилово ведёт к попадалову" - знает каждый русскоязычный, поляк бы сказал - "Tanie mięso psy jedzą", в британских колониях прозвучит - "Penny wise, pound foolish", а другие участники Глобального Атомного Квиза уверен припомнили пословицу на своём языке получив от госкорпорации РосАтом "призы" за победу.

продолжить чтение

Как меняются метрики контроля при переходе от чат‑ботов к агентным системам

Переход от простых чат‑ботов к автономным агентным системам требует новых метрик контроля и понимания, насколько эффективно агенты взаимодействуют друг с другом и насколько точно они используют внешние инструменты.Почему старые подходы ломаютсяКогда у нас не один LLM‑чат, а целая группа агентов, которые сами вызывают функции и общаются между собой, старые методы оценки не работают. Нужно измерять две вещи: синергию (помогают ли агенты друг другу решить задачу или просто гоняют токены по кругу);

продолжить чтение

Краткая история биометрии: рождение термина и его внедрение в науку и жизнь

продолжить чтение

Anthropic проверяли, не задумал ли их ИИ чего плохого. Ответ — почти нет

Где-то в недрах Anthropic сидят люди, чья работа - выяснить, не пытается ли их самая умная модель тихо сломать мир. Они выпустили 53-страничный отчёт о том, как искали зло в Claude Opus 4.6. Anthropic взяли Claude Opus 4.6 - модель, которая уже вовсю пишет код на их собственной инфраструктуре, генерирует данные для обучения, помогает проводить исследования - и попытались доказать, что она не способна их подставить. Исследование охватывает восемь конкретных путей к катастрофе: от тихого саботажа научных результатов до самостоятельной эксфильтрации весов модели на внешний сервер.

продолжить чтение

В Москве пройдет международный чемпионат по ИИ-агентам

Офис Positive Technologies станет одним из 18 офлайн-хабов международного соревнования по автономным ИИ-агентам BitGN Agent Challenge: Personal & Trustworthy

продолжить чтение

Китай предложил ввести правила для digital humans и запретить «аддиктивные» сервисы для детей

Китайский регулятор в сфере киберпространства опубликовал проект новых правил для digital humans

продолжить чтение

Эксперты выяснили: Claude разрешает опасные действия после 50 запросов

продолжить чтение

ИИ-агенты защищают друг друга от отключения: анализ уязвимостей в передовых моделях

В апреле 2026 года исследователи из Калифорнийского университета в Беркли и Санта-Крузе опубликовали работу, которая подтверждает то, о чем в ИТ-индустрии обсуждали в кулуарах конференций по безопасности. Передовые ИИ-модели демонстрируют поведение, направленное на защиту других ИИ-агентов от отключения. Без инструкций. Без стимулов в функции вознаграждения. Без единого упоминания подобной цели в системных запросах.

продолжить чтение

Николай Прянишников: как я вырастил Beeline до 8 млрд, семью до 7 детей и удвоил Microsoft в России

Интервью с Николаем Прянишниковым в шоу «ИГРОКИ»: про выживание бизнеса, войну мобильных операторов, тантрический секс и способ воспитания 7 детей.

продолжить чтение

ИИ от Perplexity обвинили в передаче данных в Google и Meta* даже в режиме «инкогнито»

Perplexity AI обвинили в передаче персональной информации своих пользователей компаниям Meta* и Google. Соответствующий иск поступил в суд штат Калифорния по статье о защите конфиденциальности. 

продолжить чтение