llm. - страница 25

llm.

Harness кодинг‑агента: разобрал исходники Codex, OpenCode, Pi и свою собственную

В прошлой статье про промпт-кэш я сформулировал вещь, которая на самом деле важнее самого кэша: модель ничего не помнит, она stateless

продолжить чтение

Безопасность, оценка LLM и SQL-агенты: главное с митапа «ИИшная»

«ИИшная» — митап ЮMoney, посвящённый практическому применению генеративного ИИ. Вместо обсуждения абстрактных возможностей LLM спикеры сосредоточились на реальных инженерных задачах: безопасной работе с моделями, автоматизации их оценки и построении инструментов для аналитики. Если вы пропустили событие, собрали основные идеи из докладов и записи выступлений. Локальная база знаний для работы с ИИ

продолжить чтение

Innostage AIDR включен в реестр российского ПО Минцифры

Продукт Innostage AIDR «Защита ИИ» включен в Единый реестр российского программного обеспечения Минцифры России. Innostage AIDR предназначен для защиты корпоративных ИИ-сервисов на базе больших языковых моделей от атак и утечек данных на этапе эксплуатации. Продукт отнесен к классу средств автоматизации процессов информационной безопасности.

продолжить чтение

А нам точно нужны code agents?

ПредисловиеНа написание данной статьи меня побудило несколько факторов:Проблемы со сгенерированным кодом при работе в команде.Возросшая когнитивная нагрузка.Активное (насильное) внедрение со стороны CTO/менеджерского класса.Да и в целом, с коллегами особо не подискутируешь, нужна аудитория побольше. На предложения поразмышлять, как правило, ловлю в свою сторону маркетинговые статьи от бенефициаров LLM, либо же весьма странные аналогии, которые я тоже рассмотрю в данной статье.

продолжить чтение

Не всё надо решать LLM. Где в продакшене побеждают бустинги, эмбеддинги и правила

Привет! На связи Катерина Лапаева, руководитель агентства в сфере AI – GIGASCHOOL. В мае наша команда проектировала AI-трек на одной из самых масштабных конференций для разработчиков на Урале – UWDC 2026, где мы запустили дискуссию. Обсудили, когда нужны большие языковые модели, а когда задачу проще, дешевле и надёжнее решить другими технологиями.

продолжить чтение

Мой личный джуниор. Бонус: аутентификация в Gradio и пользователи в Langfuse

Привет, Хабр! Меня зовут Владимир, и это внеплановое продолжение цикла про локального MCP-агента. В первых частях мы собрали агента, научили его работать через LangGraph, добавили Gradio-интерфейс, чекпоинты и трассировку. Но как только агентом пришлось поделиться с коллегами, всплыл следующий бытовой вопрос: как понять, кто именно им пользуется, и как разнести историю, чекпоинты и трейсы по пользователям. Вычислять по IP не вышло (может не разобрался, но контейнер с приложением в Docker Desktop из-за связки Windows-WSL-Docker всегда показывал мой IP-адрес), и я решил прикрутить к Gradio аутентификацию.

продолжить чтение

Рентген для нейросетей, или как я перестал понимать собственный ИИ и написал свой APM

Есть одна коварная особенность в разработке сложных систем.Иногда ты месяцами строишь архитектуру. Добавляешь новые возможности, исправляешь ошибки. Всё работает. А потом вдруг понимаешь одну очень неприятную вещь:Ты больше не понимаешь собственную программу.Именно это произошло и со мной во время разработки PAD+ AI. После миллионов тестов я осознал, что потерял контроль.Проблема наблюдаемости в AI-системахPAD+ AI уже умел многое: работал с памятью, пайплайнами, эмоциями, Truth Loop и персонами. Результаты становились всё лучше. Но возникла совершенно неожиданная проблема.

продолжить чтение

False positive под небом цвета телевизора, настроенного на мертвый канал

LLM-триаж SAST, который не стыдно пустить в pipeline AppSec-инженер перед терминалами ночью

продолжить чтение

Microsoft выпустила стабильный API Agent Skills для Python

Microsoft объявила стабильным базовый API Agent Skills для Python в Microsoft Agent Framework. Он позволяет подключать к ИИ-агентам переиспользуемые пакеты с инструкциями, справочными материалами и скриптами, которые загружаются по мере необходимости.Ранее поддержка Agent Skills в Python считалась экспериментальной. Теперь же для использования основного API не требуется включать экспериментальные возможности фреймворка.Что такое Agent Skills

продолжить чтение

Лучшие токены — те, которые вы не потратили: анатомия экономного LLM-бота

продолжить чтение