claude code.

Одна цифра в двух смыслах: читаю whitepaper Сбера про AI-Disrupt PDLC со своей телеметрией в руках

В мае Сбер выпустил whitepaper “AI-Disrupt PDLC” - документ о том, как перестраивать жизненный цикл разработки вокруг намерения человека. В сентябре Олег Бунин разобрал его на Хабре, отделив инженерную рамку от продуктовой витрины.Меня в этом документе зацепили числа про стоимость агентной работы, потому что у меня на диске лежит телеметрия: я веду всю работу агентными инструментами, и логи пишутся сами. Я скачал обе версии whitepaper - короткую и полную на 175 страниц - посчитал свой расход и сел сравнивать.Главное, что я нашел, относится к самому документу:

продолжить чтение

Кто нашёл больше багов — агент или человек? Мои замеры 11 недель работы с AI-тестировщиком

Одиннадцать недель я вёл дневник каждой рабочей сессии с Claude Code: сколько часов работал агент, сколько я был рядом, кто нашёл каждый дефект и что случилось с каждым кандидатом — подтверждён, снят или ушёл вопросом. Вместо впечатлений — таблица: 277 агентских часов, 213 моих, 94 подтверждённые находки. Первая версия этого счёта оказалась завышенной почти вдвое — куда делась половина, тоже расскажу.Это четвёртая статья про paranoid-qa — опенсорсный пак скиллов, который заставляет Claude Code тестировать с доказательной дисциплиной. В первых трёх я показывал методику: вердикты только с пруфами,

продолжить чтение

Галлюцинации недели: Jev, везде и сразу

продолжить чтение

Как Claude Code раскопал моё кладбище пет-проектов

20 лет писал код руками и считал ИИ игрушкой. Потом из любопытства попробовалМне за сорок, в разработке я около двадцати лет, и характер у меня соответствующий. Ворчливый. Когда вокруг заговорили, что нейросети пишут код, я отнёсся к этому как к большинству модных вещей за эти двадцать лет: игрушка, поиграют и забудут.Потом в свободное время, из чистого любопытства, потыкал Claude. Не для работы, для себя. Пару месяцев назад.Дальше рассказ о том, что из этого вышло. Будет спор с самим собой.Кладбище пет-проектов

продолжить чтение

Персональные инструменты как пет-проект

Писать и организовывать код — это лучшее, что я умею. Код как хобби за более чем 15 лет в индустрии оставил за собой кладбище пет-проектов. К чему-то банально угасал интерес, что-то переставало быть актуальным, что-то делалось просто чтобы потренироваться, в чём-то было лень разбираться после перерыва — итог всегда один.

продолжить чтение

Нужна ли умная модель для рутины? Дал четырём моделям пять одинаковых задач и сравнил

На этой неделе на Хабре спорили, нужны ли программисту самые умные модели: «Я перестал пользоваться самыми умными ИИ‑моделями». Автор считает, что для рутины хватает дешёвых, а упирается всё теперь в скорость. Под статьёй почти триста комментариев. Я прочитал, наверное, половину: мнений много, замеров на одинаковых задачах не нашёл ни одного. Стало интересно, сел и проверил на своих.Что мерилВзял пять задач из тех, что обычно скидываю агенту и иду за кофе. Всё на Python, от одного до пяти файлов:Off-by-one в пагинации, тест падает, надо починить.

продолжить чтение

474 712 строк за 35 лет: как мы с LLM и 21 экспертом приводим в порядок справочник автосервиса

НАР РУЧКУ ДВЕРЬ РАСПАШ З ПР С/УЭто не битая кодировка и не ошибка миграции. Это настоящее название работы из нашего справочника. За 35 лет в нём накопилось 474 712 строк: сокращения, дубли, опечатки, разные языки и разные варианты одной и той же операции.Опытный мастер-консультант многое понимает по контексту. Для специалиста по записи клиентов и аналитика такой справочник уже становится системной проблемой: первый зависит от знаний более опытных коллег, второму приходится вручную собирать разные названия одной операции.

продолжить чтение

«Агент тупит» — это диагноз инструкции, а не модели

TL;DR.

продолжить чтение

Я писал ИИ‑агента с помощью ИИ‑агента: полгода, 1600 коммитов и ноль рейтинга

Откуда это взялосьВ IT я больше двадцати пяти лет, в Android — почти пятнадцать. Оказалось, что этого мало.

продолжить чтение

Кто пишет твою базу знаний: ты или агент?

Если машина работает с источниками самостоятельно, то работа эта не оставляет на человеке шрама. Она в буквальном смысле не прописывает ничего в его сознании. — Рустам Агамалиев, «Карта Новака за 15 минут: Obsidian + Claude в роли тренажёра»Привет, %username%! Некоторое время назад я опубликовал статью «Зачем вести базу знаний, если ты не блогер и не спикер» — она выросла из вопроса знакомой, далёкой от IT. Ответ её устроил, и следующий вопрос прилетел почти сразу: «А можно я туда сразу агента посажу, чтобы он всё это делал за меня?»

продолжить чтение

123456...1020...35