Как тестировать 5 LLM-агентов одним набором тестов: capability-based подход
Один набор тестов проверяет всех агентов сразу — в этом суть capability-based подходаВ (https://habr.com/ru/articles/1049482/) я разбирала,
Дистанционное обучение в крупном бизнесе: как масштабировать знания без потери качества
Компания расширяется: наняли почти пять сотен сотрудников в нескольких городах, да еще и планируют запуск новых продуктов. Придется менять регламенты, создавать новые инструкции, проводить онбординг и обучение. Как синхронизировать процессы и ничего не упустить? Вопрос не праздный. Для бизнеса от скорости обучения зависит прибыль, а от качества – лояльность клиентов. Разберем, как все организовать быстро и без ошибок.
Система авто-оценки качества вебинаров на Claude Code за неделю
TL;DRМетодисты вручную пересматривали вебинары - не масштабируется. Собрал конвейер: видео → локальная расшифровка (whisper.cpp на Apple M4) → LLM-судья по рубрике с цитатами → SQLite → письмо и дашборд. Боевое ядро заработало примерно за неделю.Главное в LLM-судье - не промпт, а методика: рубрика как данные (YAML, который правят методисты), калибровка под живых экспертов и честность про пределы текста.Claude Code тут - быстрый дисциплинированный джун: ускоряет «как написать» в разы, но надежность, идемпотентность и гардрейлы надо прямо навязывать.
У роботов очень короткая память. Можно ли это исправить?
Хабр, привет! Меня зовут Егор Черепанов. Я аспирант Центра когнитивного моделирования МФТИ и младший научный сотрудник команды «Воплощенные агенты» лаборатории когнитивных систем искусственного интеллекта AIRI. Я занимаюсь памятью у роботов и RL‑агентов, и сегодня хочу рассказать об одной из наших работ — архитектуре ELMUR, которую мы представляли в апреле на ICLR 2026.
В экосистеме Rust появился штатный инженер по безопасности в области ИИ
Фонд Rust в рамках Инициативы по безопасности внедряет должность штатного инженера в области ИИ, специализирующегося на экосистеме.
Если кто-то его создаст — все погибнут
На русском языке вышла написанная в 2025 книга-предупреждение о катастрофических последствиях развития все более умного ИИ.Основной темой служит проблема согласованности и прогноз апокалиптической опасности на ближайшие несколько лет.
КАК СОБРАТЬ СВОЙ УЧЕБНЫЙ БОТ ДЛЯ МОНИТОРИНГА ГЛОБАЛЬНОЙ ОБСТАНОВКИ С НУЛЯ
Вводная частьИдея создания собственного бота звучит сложнее, чем выглядит на практике. Многие представляют такую систему как нечто, доступное только программистам, системным администраторам или специалистам по искусственному интеллекту. На деле первый рабочий вариант можно собрать по понятному маршруту: подготовить рабочее место, настроить доступ к большой языковой модели (далее – БЛМ), установить несколько про-грамм, создать Telegram-бота, подключить интересующие Вас источники средств массовой информации (телеграмм-каналов) и выполнить тестовый запуск. Важнее всего делать всё по инструкции.
Claude Code помог решить многолетнюю проблему с зависанием дисплея ноутбуков с графикой AMD
ИИ-помощник Claude Code помог справиться с проблемой в драйвере графики ядра Linux AMDGPU, приводящей к зависанию некоторых дисплеев ноутбуков после длительного использования.
Как разделить корпоративную сеть на изолированные зоны с помощью одного NGFW
Разбираем, почему плоская сеть превращает один скомпрометированный узел в проблему всей инфраструктуры, как зональная модель и виртуальные контексты разрывают пути бокового перемещения - и что меняет приход AI и в атаке, и в защите, и в самой структуре сети.Когда в сети нет сегментации, компрометация любого узла открывает атакующему прямой путь ко всему остальному. Бухгалтерский сервер, производственная АСУ ТП, веб-приложение и рабочая станция стажёра существуют в одном пространстве - с точки зрения сетевой связности между ними нет разницы.
LLM-судья для нейроразбора резюме на hh
Создать LLM-судью легко. Гораздо сложнее сделать так, чтобы его оценкам можно было доверять.Мы убедились в этом на практике при разработке нейроразбора резюме для ИИ-помощника hh.ru
