Agentic Coding.

Почему одна и та же модель может стоить в пять раз дороже

Исследователи из UC Berkeley и Arena сравнили семь моделей внутри Claude Code, Codex CLI и минималистичного Pi. На двух бенчмарках выбор харнесса почти не менял среднюю успешность, но увеличивал стоимость одной и той же модели до пяти раз. Результат хорошо объясняет, почему сравнивать coding-агентов только по названию моделей уже бессмысленно.А что именно измерили?

продолжить чтение

Cognition выпустила Fusion для Devin Desktop и CLI: две ИИ‑модели делят одну задачу

11 сентября Cognition объявила о доступности Fusion в Devin Desktop и CLI. Ранее система работала в облачном Devin. Теперь связку из ведущей модели и исполнителя можно использовать в десктоп приложении и терминале. Компания рекомендует сочетание Claude Fable 5.1 и SWE-2.

продолжить чтение

Один ИИ кодит, второй командует: как устроен Devin Fusion

11 сентября Cognition объявила о доступности Fusion в Devin Desktop и CLI. Ранее система работала в облачном Devin. Теперь связку из ведущей модели и исполнителя можно использовать в десктоп приложении и терминале. Компания рекомендует сочетание Claude Fable 5.1 и SWE-2.

продолжить чтение

Почему агентная разработка нуждается в политиках

продолжить чтение

Токенная диета для ИИ-агентов: Caveman, Ponytail и Headroom

У агентных помощников есть неприятная привычка: они быстро раздувают работу.Сначала длинный ответ там, где хватило бы одной команды. Потом новый слой кода вокруг задачи на пять строк. Потом в контекст улетает полный лог, JSON на сотни элементов и кусок истории, который уже никто руками не читает.Каждая отдельная вещь выглядит терпимо. В длинной сессии это превращается в счет у провайдера, раннее сжатие истории, забитое окно контекста и потерянные детали. Агент вроде продолжает работать, но внезапно забывает ограничение, на котором держалась задача.

продолжить чтение

Claude Code убрал из моей работы рутину и почему я этому не долго радовался

Долгое время вижу одно и то же в новостях и обзорах: ИИ уберет рутину, снимет трение, даст крылья и вообще панацея от всех болячек. Я поставил Claude Code — и да, трение исчезло. Рутина схлопнулась. Идею теперь можно проверить за вечер, а не за месяц.А дальше выяснилось, что трение это для меня было важно и когда оно ушло, я ощутил это в полной мере.Идеи мрут как мухи

продолжить чтение

Десять лет в индустрии я писал код руками. Три месяца назад перестал

После выхода Claude Opus 4.7 стало очевидно, что агент технически быстрее меня. А 28 мая Anthropic выпустила Opus 4.8 с теми же ценами, заметно лучшим coding/agentic-скором и новой возможностью держать в голове миграции на сотни тысяч строкИ всё же расслабиться не выйдет, потому что есть нюанс: эрудиция у него принципала, а суждения джуна. Он знает двадцать способов решить задачу и ни одной причины предпочесть один другому - потому что не ему потом это поддерживать

продолжить чтение

Каким должен быть язык программирования, чтобы с ним хорошо работали AI-агенты

В прошлом году я впервые задумался о том, как может выглядеть будущее языков программирования теперь, когда агентная разработка становится все более заметным явлением. Сначала мне казалось, что огромный корпус уже существующего кода закрепит нынешние языки на своих местах, но теперь я начинаю думать, что верно обратное.

продолжить чтение

ИИ‑агенты в инженерной команде: гайд для тимлида, который не хочет получить бунт

продолжить чтение

Как я торговлю автоматизировал

Речь пойдёт о разработке системы алгоритмической торговли с использованием обучения с подкреплением (reinforcement learning, далее RL). Пройдём путь от идеи до работающей системы с разумной детализацией. Расскажу про свои ошибки: радовался single-seed успехам, верил

продолжить чтение

12