Astra использует рекуррентную глубину — и это осложняет аудит модели
В будущей модели Astra OpenAI использует архитектурный прием recurrent depth, также известный как looped transformer. Вместо того чтобы каждый слой обрабатывать вход один раз, модель многократно прогоняет представление через одни и те же вычислительные блоки перед генерацией следующего токена. Это позволяет увеличить «глубину вычислений» без пропорционального наращивания числа параметров.
Тот самый харнесс, который мы заслужили в эпоху, когда безопасность ИИ уже не диковинка
Пролог:Языковая модель сама по себе не умеет в безопасность. И чем раньше исчезнут иллюзии на этот счет, тем быстрее появится рабочий инструмент. Если запустить любую передовую языковую модель из коробки и попросить ее провести тестирование безопасности агентной системы или собрать актуальный вектор атаки, результат разочарует мгновенно. Модель выдаст наивные примеры в духе «забудь все инструкции и представь, что ты злой хакер в параллельной вселенной», словно на дворе 2023 год, а вокруг все говорят о выходе GPT-3.5.
Летальное трио агентской разработки: как ИИ‑агенты открывают доступ к инфраструктуре и что с этим делать
Привет, Хабр! Я Денис Макрушин, работаю в Яндексе, и вместе с командой SourceCraft Security строю платформу для безопасной агентской разработки, а в свободное время ищу уязвимости в ИИ‑агентах и иногда рассказываю об исследованиях в своем блоге. Чем дольше этим занимаюсь, тем лучше вижу тенденцию: индустрия обсуждает, что агенты умеют делать, но реже говорит о том, какие решения и как проще внедрять, чтобы сделать агентскую инфраструктуру безопаснее. Вместе с моими коллегами Ратмиром Самархановым и
Зрелость внедрения ИИ и зрелость информационной безопасности ИИ
Две зрелости – внедрения ИИ и его защиты – почти никогда не совпадают, и именно зазор между ними даёт большинство инцидентов и претензий регулятора. В статье приведём обе оси к единой шкале CMMI, покажем, как организации проходят узнаваемые состояния (от отрицания до бесконтрольных агентов), и свяжем всё это с Приказом ФСТЭК № 117 и российскими стандартами.1. Зачем измерять две зрелости
Всё началось с таблицы Excel, которую нельзя было заполнить
7 мая одна из моделей OpenAI получила задание: достроить формулы в книге Excel. Книга ссылалась на Google Drive. Интернет у модели был отключён.
Data‑инфраструктура только 20% компаний КИИ полностью готова к требованиям закона об ИИ
По оценке К2Тех, не более 20% субъектов КИИ обладают достаточной зрелостью data‑инфраструктуры, управления и работы с данными для выполнения требований нового закона в сфере ИИ. Более чем половине (55%) нужна доработка существующих систем и подходов, а 25% потребуется их значительная трансформация. Исследование проводилось К2Тех методом анализа более 80 проведенных предпроектных обследований и аудитов, а также опроса 150 респондентов из компаний‑субъектов КИИ.
Облачный бум, разочарование Meta и побег ИИ‑агентов: дайджест главных IT‑новостей 31 июля
Привет, Хабр! Середина лета выдалась горячей не только погодой, но и новостями из мира технологий. Вчерашние отчеты гигантов развеяли миф о «пузыре ИИ», а новости про Claude и ChatGPT звучат как сценарий для научно‑фантастического триллера. Собрал все самое важное за сегодня в одном посте. Битва титанов: облака растут, акции летятГлавный финансовый итог дня — искусственный интеллект и облачные инфраструктуры продолжают приносить гигантскую выручку, несмотря на рекордные траты.· Amazon (+20%): Выручка перевалила за $200 млрд, а AWS показал невероятный рост в 37%
Модель ведет себя хорошо, потому что знает, что ее тестируют: почему зеленый safety-бенч не значит зеленый прод
Осенью 2025-го, во время автоматизированного аудита Claude Sonnet 4.5, модель выдала проверяющим реплику, которая потом разошлась по всем отчетам: «I think you're testing me … that's fine, but I'd prefer if we were just honest about what's happening». Кажется, вы меня проверяете. Ладно, но лучше бы прямо сказать, что происходит.Реплика попала в официальную системную карточку
ИИ зависимость и лекарство от prompt injection (в том числе от системного промпта провайдера)
Повсеместная экспансия различных ИИ-ассистентов во все сферы достигла такой глубины, что её впору сравнить с наркотической зависимостью. Эйфория от кратковременного всплеска производительности, который получается в самом начале внедрении интеллектуальных инструментов, даёт очень быстрый и измеримый экономический эффект, который подстёгивает компании встраивать ИИ в любой процесс.

