agents. - страница 4

Как развернуть OpenClaw и не слить ему все свои данные

OpenClaw (ex. Moltbook и Clawdbot) мощно взорвал начало года. Все бросились устанавливать себе агента, и я понимаю, почему получился такой хайп. Ведь это первый в мире опен сорсный персональный AI-ассистент, которого можно подключить к мессенджеру, почте, календарю и практически чему угодно еще и он будет управлять личной жизнью. Ему можно поручить покупку билетов в кино, бронь столика в любимом кафе или внести важную встречу в календарь.Другая сторона хайпа — вопросы к безопасности агента, здесь шумихи не меньше. То исследователи Gen Threat Labs нашли 

продолжить чтение

Детерминированное поведение и стейт-машины для ваших агентов

Агенты отлично справляются с узкими, конкретными задачами — например, написать функцию или короткий текст — но начинают буксовать на сложных многошаговых процессах. Чем более абстрактна и «высокоуровнева» работа, тем больше ошибок они допускают: путают шаги, пропускают операции, неверно интеретируют инструкции. Такие ошибки накапливаются и усиливают друг друга, приводя к неожиданным результатам. Чем больше задача, которую вы отдаёте агенту, тем выше шанс, что он её провалит.Помедитировав немного над этим, я пришёл к интересным эвристикам:

продолжить чтение

AG-UI. Как написать AI ассистента для подбора подарков за 20 минут

Всем привет! Я Никита, Principal Engineer в стартапе AG2, мейнтейнер одноименного фреймворка для разработки AI агентов (AG2), автор фреймворка FastStream и просто опенсорс и AI энтузиаст.И, как любой разработчик, я иногда запускаю пет-проекты.Один из таких проектов, который я запустил после новогодних праздников - это AI ассистент по подбору подарков (с интегрированным вишлистом) ДарийНа его примере я хочу рассказать о протоколе AG-UI

продолжить чтение

Кукушка хвалит петуха: как работает LLM-AS-A-JUDGE

Мы все через это проходили. Написали умного агента, запустили. Вроде отвечает складно. Начальник доволен. Но у нас высокорисковый бизнес, а мы умные, поэтому где-то внутри сидит червячок сомнения: "А что, если он сейчас галлюцинирует, просто делает это очень уверенно?".Чтобы успокоить совесть, индустрия придумала красивое решение: "Пусть одна нейросеть (поумнее) проверяет другую (поглупее)". Звучит логично. Но практика показывает: нас обманывают. Причем, из лучших побуждений.Проблема "Хорошего парня"

продолжить чтение

Как работает Codex: статья OpenAI

Привет, Хабр! Меня зовут Юра Петров, я руководитель отдела разработки компании Friflex и автор канала «Мобильный разработчик»

продолжить чтение

# Vibe Coding под прицелом: Claude Opus 4.5 против китайского GLM-4.7 в бою за транскрибацию GigaAM

Vibe Coding под прицелом: Claude Opus 4.5 против китайского GLM-4.7 в бою за транскрибацию GigaAMСсылка на мой итоговый проект: https://github.com/yaruslove/DialogScribe

продолжить чтение

RLM: Почему ваш LLM-агент забывает цель и как это исправить

10 проблем LLM-приложений и как RLM их обходит — без изменения самой модели.Теоретические основы https://habr.com/ru/articles/986702/Что такое RLM?Recursive Language Model — способ использования любой LLM через Python REPL и рекурсивные sub-LLM вызовы.Обычный подход: → LLM → RLM подход: → → → Придумал Alex Zhang (октябрь 2025). Я сделал production-ready реализацию.Проблема 1: Context Rot 🧠💀Суть:

продолжить чтение

Я попробовал Claude Cowork за $100-месяц

TLDR: Я использовал новый функционал от Claude - Claude Cowork, который сейчас доступен только на macOS по подписке. Я попросил его сгенерировать план изучения Go. В статье разбираю особенности и ограничения.——CoworkClaude Cowork - это новый агентский режим от Anthropic, доступный в приложении Claude Desktop.

продолжить чтение

GPT-4o: технический разбор модели, которая взрывает людям мозги

В 2025 году я встретила минимум трёх адекватных взрослых людей с образованием, которые после общения с GPT-4o реально ехали крышей. Один — разработчик с 10-летним стажем, начал строить "революционный стартап" за ночь, не спал трое суток, речь скачками. Второй — биоинженер, после двухнедельного марафона с 4o открыл "секрет сознания". Третий — преподаватель, впал в манию величия: "Я нашла способ обучать ИИ эмоциям!". Все трое были нормальными людьми. Что происходит с этой моделью технически? Давайте разберёмся — особенно после того, как выяснилось, что даже инвестор OpenAI пострадал.Известные кейсы: от подростка до инвестора

продолжить чтение

MCP сервер для заказа продуктов из ВкусВилла: сделай своего агента

Привет! Я Сабина из Центра экспертизы ИИ, ВкусВилл. И у нас есть новости.

продолжить чтение

1...234567...8