агентные системы. - страница 3

Машина, которая учится думать

Четыре революции происходят в искусственном интеллекте прямо сейчас — почему они меняют наше представление о том, что такое разум?

продолжить чтение

ИИ-агенты как на ладони — профильные открытые инструменты с графическим интерфейсом

Сегодня мы в Beeline Cloud подготовили подборку примечательных опенсорсных решений, упрощающих управление «флотом» интеллектуальных помощников и ИИ агентов — все благодаря наглядным графическим интерфейсам. Инструменты в списке помогут выстроить пайплайн выполнения задач и распределять их между ИИ-агентами.

продолжить чтение

Почему бенчмарки в AI сломались — и что с этим делать в понедельник

В январе 2026 года Янн Лекун, уходя из Meta, сказал в интервью Financial Times про релиз Llama 4: «The results were fudged a little bit» (Fast Company, 6 января 2026). Команда показывала на LMArena одну версию модели, в продакшен ушла другая. На бенчмарке всё было правильно. В реальности код был хуже DeepSeek V3.Я хочу разобрать эту историю. Не потому что Meta — исключение. Потому что они — симптом.TL;DR.

продолжить чтение

Cloudflare подвела итоги Agents Week 2026: что выкатили для агентных систем

Cloudflare опубликовала сводный анонс по итогам Agents Week 2026 — недели, целиком посвящённой инфраструктуре для ИИ-агентов. В центре внимания оказался не один продукт, а целый набор компонентов: среда выполнения, безопасность, инструменты для памяти и поиска, средства вывода в прод и задел под так называемый agentic web — веб, в котором заметную долю трафика и действий создают уже не люди, а агенты.

продолжить чтение

Kimi выпустили открытую модель K2.6 для долгих задач по программированию

Moonshot AI представила Kimi K2.6 — открытую модель, заточенную под длинные задачи в программировании и агентные сценарии. В компании утверждают, что новая версия лучше справляется с многошаговой работой: может дольше удерживать контекст, чаще корректно вызывать инструменты и эффективнее координировать несколько субагентов.

продолжить чтение

GoCloud 2026: ИИ-агенты, четыре трека и как я стал ведущим конференции

Всем привет! Это Рома Путилов — вообще-то я в прошлом инженер, а сейчас руковожу направлением продвижения решений в Cloud.ru. Но 9 апреля что-то пошло не так, и вот я уже стою на сцене кинотеатра «Каро 11 Октябрь» под прицелами камер, перед залом на 1 700+ человек, и открываю нашу главную ИТ-конференцию про ИИ и облака.Как я дошел до жизни такой, что мы анонсировали на конфе, о чем говорили эксперты и что по циферкам? Сейчас все расскажу и покажу. Если пропустили или просто хотите узнать побольше об организаторской изнанке — читать обязательно.

продолжить чтение

Проблема несанкционированного вызова инструментов

Доверили бы вы LLM управление контролем доступа? Крупные лаборатории ИИ (Anthropic, xAI, Gemini), похоже, делают именно это, используя механизм вызова инструментов.

продолжить чтение

Как меняются метрики контроля при переходе от чат‑ботов к агентным системам

Переход от простых чат‑ботов к автономным агентным системам требует новых метрик контроля и понимания, насколько эффективно агенты взаимодействуют друг с другом и насколько точно они используют внешние инструменты.Почему старые подходы ломаютсяКогда у нас не один LLM‑чат, а целая группа агентов, которые сами вызывают функции и общаются между собой, старые методы оценки не работают. Нужно измерять две вещи: синергию (помогают ли агенты друг другу решить задачу или просто гоняют токены по кругу);

продолжить чтение

Протоколы, чтобы ИИ-агенты нашли общий язык

Сегодня широко обсуждаются вопросы, связанные с внедрением систем ИИ в процессы управления сетью — например, Инженерный совет Интернета (IETF) опубликовал документ, посвященный концепции интенционно-ориентированных сетей. Мы также делимся опытом по данному направлению — недавно рассказывали, как ИИ/МО-решения помогают находить аномалии в работе сети и формировать QoS-правила.

продолжить чтение

Защита агентных приложений по OWASP Agentic Top 10 и модели Trifecta

Все мы знаем, что агентные системы давно не просто "чат-боты 2.0". Это уже полноценные приложения, которые:планируютвыполняют сложные цепочки действийвызывают инструменты (API/FS/shell/browser)хранят и используют память (RAG/long-term)общаются с другими агентамиНо делают все эти действия со скрытыми "побочными эффектами"

продолжить чтение