Spec-driven development в микросервисах, часть 2: как archspec делает контекст сервисов явным
Вторая статья из цикла из трёх частей.Часть 1 — где LLM теряет межсервисный контекст и почему локальных спек недостаточно.
AI обнулил benchmark и пытался шантажировать инженера. И почему это решаемо
В прошлой главе я разобрал три провала чужих AI-агентов в проде - PocketOS, потерю production-базы Replit и сценарии GitHub Copilot, в которых агент действовал быстрее, чем человек успевал сказать стоп.Финал был честный: эти три - не про то, как делать правильно. Это места, где меня поймало бы, если бы я не прочитал разборы до того, как Lexis стал продуктом для людей.И я обещал в следующей главе перейти с уровня отдельные истории на уровень данных. Конкретно - две вещи.Первая: ProgramBench. Топ-модели, которые закрыли SWE-bench на 95%, на ProgramBench показывают 0% и 3%. Не упали на десять пунктов - обнулились.
AI-агент для финансовых процессов: как мы научили ИИ считать числа из базы данных без галлюцинаций
ИИ-агент в «Первой Форме» работает со всеми типами бизнес-процессов: документы, регламенты, задачи, заявки, договоры. Текстовые вопросы он закрывал хорошо с самого начала. А вот финансовые — с галлюцинациями. Мы переделали подход — и теперь агент отвечает точно, с совпадением с SQL до рубля. Ниже — как именно это устроено.Почему RAG не умеет считать
Стяж одностороннего потока против маятникового раскола в процессе целенаправленного (и не только) наращивания ветвей
Привет Хабр. Надеюсь читатели поймут моё желание закрепить
Колесо потока против раскола
Привет Хабр. Надеюсь читатели поймут моё желание закрепить результат по алгоритмизации
Reasoning-модели сломали мой промпт-инжиниринг. Год переучиваюсь
Вторник, час ночи. Сижу пишу промпт чтобы вытащить из 40 PDF-ок с актами нужные поля в JSON. Задача рутинная, у меня под неё лежит проверенный шаблон. Развёрнутый CoT, три few-shot примера, роль «опытный финансовый аналитик с 15 лет опыта». Раньше работал как часы.Закидываю в GPT-5.5 с высоким мышлением. Получаю мусор. Половина полей не та, формат сломан, в выводе развёрнутое рассуждение которое я не просил.Думаю ладно, заглючило. Прогоняю ещё раз. То же самое.Удаляю промпт целиком. Пишу заново, тупо: «вытащи из приложенного текста поля X, Y, Z в виде JSON, никаких пояснений». Десять строк. Запускаю.Работает.
«Где новые фичи?» — Как AI-миграция легаси вернет IT-бюджет бизнесу
Наверное, каждый, кто занимался эксплуатацией и развитием корпоративных систем, знает эту бесконечную претензию от бизнеса: «Мы столько тратим на IT – а результата ноль. Новых продуктов нет. Или они появляются мучительно медленно». И бизнес по-своему прав. Если из каждого рубля, потраченного на IT, менее 20 копеек уходит на то, что видит клиент – скорость появления новых продуктов будет именно такой, какая она есть - неудовлетворительной. TL;DR~75% IT-бюджета банков – налог на legacy. Менее 20 центов из каждого IT-доллара доходят до клиента в виде новых продуктов. При стагнирующем бюджете – стремится к 5%.
Если пропустили Claude последние 3 месяца: топ-5 фич с юзкейсами и история про $400K в Bitcoin
Февраль–май 2026 — один из самых плотных кварталов у Anthropic за последний год. И большая часть того, что обсуждают в Twitter-X под тегом #ClaudeCode, — это вообще не новинки квартала. Subagents в Claude Code существуют с 2025 года, нативная поддержка плана и resumption — с октября. Skills анонсированы в октябре 2025, как open-standard — в декабре. MCP-протокол вообще запущен ещё в поздней осени 2024. Я хочу сразу обозначить честно: ничего из этого я в топ за квартал ставить не буду. У меня самого skills и subagents в workflow больше года.А вот что реально вышло за период:Opus 4.7 с командами /effort и /fast (поздний апрель)
Каким должен быть язык программирования, чтобы с ним хорошо работали AI-агенты
В прошлом году я впервые задумался о том, как может выглядеть будущее языков программирования теперь, когда агентная разработка становится все более заметным явлением. Сначала мне казалось, что огромный корпус уже существующего кода закрепит нынешние языки на своих местах, но теперь я начинаю думать, что верно обратное.

