llm-агент.

DepthNet: платформа для “живых” автономных AI-агентов с продвинутой памятью — год спустя

Год назад я опубликовал здесь статью «Я создал AI-агента, который думает 24/7 и выполняет реальный код». Тогда это был прототип, который я собрал на PHP скорее из любопытства: агент умел крутиться в бесконечном цикле или в режиме вопрос-ответ, умел выполнять код, вёл простой блокнот-память и сам себе повышал «дофамин» за удачные действия. Я закинул 10 долларов на Claude, потестил пару часов, написал «это работает, но нужны модели помощнее» — и на этом остановился.

продолжить чтение

MarathonMemBench — бенчмарк нового типа для тестирования памяти вашего LLM-агента

Эта статья — про долговременную память AI-агентов и про то, как её измерить. Я сделал MarathonMemBench

продолжить чтение

Бенчмарки врут? Бизнес мигрирует на открытые веса, а FDA и ФЗ заставляют уходить на свой инференс: ML-дайджест

продолжить чтение

Практика программирования в эпоху ИИ (разбор реальной задачи на С++ с помощью ИИ агента)

продолжить чтение

Вашего AI-агента уже перехватили

Привет, Хабр! Сегодня почти у всех часть задач (если не все) переложены на агента. А там где массовость — всегда и высокие риски для безопасности, так как подобрав правильно вектор атаки один раз, злоумышленник имеет возможность эксплуатировать уязвимость снова и снова.Он вам не агент

продолжить чтение

LLM-агент против SerpApi: что лучше работает для поиска публичных резюме

продолжить чтение

Итак, вы решили делать LLM-проект: список вопросов, на которые нужно ответить перед запуском

Меня зовут Темченко Сергей, и за последние два года я в разных ролях участвовал во множестве LLM-проектов. Недавно я заметил, что на полях моей тетради накопились значительное количество заметок. Ими я хочу с вами поделиться.Сейчас каждая компания запускает LLM-проекты, но далеко не все понимают, во что на самом деле ввязываются. По моим наблюдениям, команды на старте систематически недооценивают, насколько сложен путь от прототипа до работающего решения. Под катом список вопросов, на которые нужно ответить (на часть из них я уже ответил за вас) перед тем, как приступать к LLM-проектам в крупных организациях.

продолжить чтение

Разработка автоматизаций в Home Assistant с помощью Claude

продолжить чтение

AI-агенты в работе службы ИБ: 18 аудитов, миллионы логов и честный счёт «AI против ручного анализа»

Разбираем на реальных кейсах, что AI-агент уже умеет делать в сетевой безопасности – аудит правил межсетевого экрана, разбор логов IPS и DNS, ред-тиминг – где он экономит часы работы, а где остаётся источником риска. И почему ограничивать нужно не сам AI, а данные, права и действия агента.Матч, который уже идёт

продолжить чтение

AI‑агенты в проде: как оценивать качество, стоимость и стабильность

продолжить чтение

123456...10...13