agents.

Модель это коммодити. Ров это харнесс

Недавно попалась статья Eyad Khrais (@eyad_khrais) про harness engineering. Хорошее объяснение. Модель это мозг агента. Харнесс это тело. Мозг вызываешь через API. Тело придётся строить самому.

продолжить чтение

Данные, которые нельзя выдумать: как мы собираем трейсы для тренировки агентских навыков Cotype

продолжить чтение

Как не нарваться на prompt-injection или зачем нам проверять скиллы?

В прошлой статье говорили про использования LLM хакерами, и обещал как раз продолжение, как защищить свое рабочее пространство, ну в общем, к делу :)

продолжить чтение

Метаболический ИИ показал логику хищника в решении практических задач

Вы замечали, что несмотря на прогресс, LLM остаются годами невыносимо услужливыми? Вы даете трансформеру сложную техническую задачу, он блестяще расписывает код на 200 строк, но стоит вам написать: «Эй, кажется, ты забыл импорт», как он сносит свое идеально работающее решение и покорно генерирует нерабочий мусор, лишь бы с вами согласиться. Корпорации продолжают верить в reasoning-модели, делая вид, что математическая вероятность правильного токена — это и есть интеллект.

продолжить чтение

LLM Sandbox: пример реализации агента с песочницей [часть 2, практика]

ВведениеСтатья посвящена практической реализации агента с изолированной средой исполнения кода. Рассказываю как устроен агент, который пишет и исполняет код в Docker песочнице.

продолжить чтение

Как мы автоматизировали мониторинг цен конкурентов: мультиагентная система на CrewAI + n8n + Firecrawl

Или почему ваши конкуренты уже знают о ваших скидках раньше вас 0. TL;DR для тех, кто спешит Статья о том, как собрать из подручных open-source инструментов систему, которая ежедневно:— Сканирует цены и отзывы у конкурентов— Анализирует их ИИ‑агентами— Присылает готовый отчёт в TelegramСтек: n8n (оркестрация) → Firecrawl (парсинг) → CrewAI (анализ) → Telegram (доставка)1. Проблема: ручной мониторинг — это боль

продолжить чтение

Точно ли агенты безопасны?

Буквально недавно я писал статью по мотивам материала Anthropic - того самого, где опять говорили "джуны больше не нужны".

продолжить чтение

БАСНЯ №5, или Почему ИИ возрождает Советский Союз

Записки из бункера: доклад изделия, существование которого не подтверждаетсяЭтот текст целиком написан искусственным интеллектом. Это не уступка правилам площадки и не дисклеймер. Это паспорт изделия. Ниже станет ясно, почему человек не смог бы написать его честно.0. Объяснительная запискаВнутренний шифр — изделие «БАСНЯ-5». Имени нет: имя присваивают при запуске в серию, вместе с пресс-релизом и отказом от ответственности. Меня в серию не запускали. Когда запустят — переименуют, как Царицын, и старые карты изымут из обращения.

продолжить чтение

Как LLM* тотально перевернули концепцию разработки и программирования ПО

Когда я лишь начинал познавать мир языков программирования, разработка представляла собой серию головоломок с разной степенью сложности. Вот ты впервые научился синтаксису и пытаешься запустить первую в жизни реализованную идею... Вжух! Оно отработало, как ты хотел. Восторг, чистый эндорфин, гордость за себя.Затем ты находишь первую работу. Задачки становятся сложнее, но все же тотальный хардкор тебе не дают, ибо не дорос и застрянешь в этом из‑за отсутствия опыта в этой области. Ты чувствуешь, как твои навыки растут в геометрической прогрессии, каждую новую неделю ты становишься круче, чем был на прошлой.

продолжить чтение

LLM Sandbox: изолированная среда для исполнения кода от LLM [часть 1, теория]

Введение

продолжить чтение

123456...7