аудит.

2160 раундов симуляции без кнопки «стоп». Исследование MiroFish, часть 3

Третья, заключительная статья об исследовании MiroFish, открытого стека мультиагентной симуляции общества. В первой части изложены методология и находка Silent Failure; во второй слепота отчёта, управляемая графом. В этой части: как одна фраза запроса превращается в конфигурацию запуска, что систему ограничивает на длинной дистанции, и общая карта находок серии.

продолжить чтение

Жители Валдории живут 147 лет, а страна граничит с Германией и Японией одновременно. Исследование MiroFish. Часть 2

Вторая статья из трёх об исследовании MiroFish, открытого стека мультиагентной симуляции общества. В первой части изложены методология исследования и находка Silent Failure. В этой части: досье вымышленной страны с восемью классами заложенного абсурда, четыре байт-идентичных прогона с разными результатами и пре-регистрированный эксперимент, который локализовал причину.

продолжить чтение

Что будет если загрузить в «симулятор общества» чистый lorem ipsum? Большое исследование MiroFish, часть 1

Первая статья из трёх об исследовании MiroFish, открытого стека мультиагентной симуляции общества. В этой части: стек, методология и находка Silent Failure. Бэкенд зафиксировал отказ за десятки миллисекунд, статусный API отдал задачу как выполненную, а индикатор прогресса не отвечал более часа.

продолжить чтение

Почему нейросети путают ваш бренд с другой компанией — и как это проверить

Когда говорят про оптимизацию под ИИ, обычно представляют работу с текстом на сайте. Но у меня раз за разом всплывает более базовая проблема: модель вообще не понимает, что за компания стоит за названием. Путает её с иностранной компанией с похожим названием, приписывает чужие продукты, называет не тот город. Это провал не контента, а цифрового следа компании (entity footprint), и его можно измерить.Что такое цифровой след и почему это отдельная задача

продолжить чтение

«К нам едет ревизор», или Как не построить космические замки на бюджете сарая при внедрении DWH

Когда к вам едет ревизор, это не всегда плохо, а часто просто жизненно необходимо. Особенно если предстоит выполнить сложный ИТ-проект, такой как внедрение хранилища данных. И речь идет о предпроектном обследовании.

продолжить чтение

Часть 6: Безопасность и приватность в голосовом управлении — как защитить умный дом от утечек и взломов

От диплома до продакшена: Как я создавал архитектуру ИИ-проекта для…Автор: Алексей Бобрешов, руководитель отдела искусственного интеллекта в федеральном холдинге Категория: Искусственный интеллект, безопасность, умный дом, приватность *Это продолжение серии статей.Введение: Ошибки, которые я осознал (слишком поздно - нет, нет ничего слишком, есть цена ошибки)Когда я начинал работу над дипломным проектом «Умный дом» в 2020–2021 годах, моя голова была забита другими вопросами:Как добиться точности распознавания выше 90%?

продолжить чтение

ИИ-агент сказал «сделано». Но сделал ли он на самом деле?

Deterministic Commitment Layer: архитектура верификации агентных систем и первый десктопный инструмент для её практического применения«Ты веришь агенту на слово. Но у агента нет слов — только токены» Проблема, о которой мы знаем, но делаем вид, что не замечаемНа прошлой неделе Хабр опубликовал материал о том, как компании платят до 300 000 рублей в месяц за «скрытый аутсорс» задач в ChatGPT. История получила резонанс — но обсуждение ушло не туда. Говорили о доверии, об этике, о трудовом договоре.

продолжить чтение

В Австралии сотрудники KPMG использовали ИИ для списывания на тестах по применению технологии

По данным издания The Australian Financial Review, с июля 2025 года более двух десятков сотрудников аудиторской компании KPMG в Австралии использовали искусственный интеллект для списывания на внутренних экзаменах по применению технологий ИИ.

продолжить чтение

KPMG снизила гонорар корпоративному бухгалтеру из-за ИИ

Крупнейшая аудиторских компания KPMG смогла снизить гонорар своему бухгалтеру — британской фирме Grant Thornton UK — так как сослалась на то, что использование искусственного интеллекта должно сделать работу дешевле.

продолжить чтение

OWASP Top 10 for Agentic Applications for 2026: Разбор главных угроз завтрашнего дня

Привет, Хабр! С вами снова Сергей Зыбнев, автор теле... а об этом позже. После нашего глубокого погружения в OWASP AI Testing Guide, пришло время заглянуть в будущее, которое наступит менее чем через месяц. Сегодня мы разберем еще один важнейший документ от OWASP, который смотрит на шаг вперед — OWASP Top 10 for Agentic Applications for 2026.

продолжить чтение

12