Почему одна и та же модель может стоить в пять раз дороже
Исследователи из UC Berkeley и Arena сравнили семь моделей внутри Claude Code, Codex CLI и минималистичного Pi. На двух бенчмарках выбор харнесса почти не менял среднюю успешность, но увеличивал стоимость одной и той же модели до пяти раз. Результат хорошо объясняет, почему сравнивать coding-агентов только по названию моделей уже бессмысленно.А что именно измерили?
Cognition выпустила Fusion для Devin Desktop и CLI: две ИИ‑модели делят одну задачу
11 сентября Cognition объявила о доступности Fusion в Devin Desktop и CLI. Ранее система работала в облачном Devin. Теперь связку из ведущей модели и исполнителя можно использовать в десктоп приложении и терминале. Компания рекомендует сочетание Claude Fable 5.1 и SWE-2.
Один ИИ кодит, второй командует: как устроен Devin Fusion
11 сентября Cognition объявила о доступности Fusion в Devin Desktop и CLI. Ранее система работала в облачном Devin. Теперь связку из ведущей модели и исполнителя можно использовать в десктоп приложении и терминале. Компания рекомендует сочетание Claude Fable 5.1 и SWE-2.
Токенная диета для ИИ-агентов: Caveman, Ponytail и Headroom
У агентных помощников есть неприятная привычка: они быстро раздувают работу.Сначала длинный ответ там, где хватило бы одной команды. Потом новый слой кода вокруг задачи на пять строк. Потом в контекст улетает полный лог, JSON на сотни элементов и кусок истории, который уже никто руками не читает.Каждая отдельная вещь выглядит терпимо. В длинной сессии это превращается в счет у провайдера, раннее сжатие истории, забитое окно контекста и потерянные детали. Агент вроде продолжает работать, но внезапно забывает ограничение, на котором держалась задача.
Claude Code убрал из моей работы рутину и почему я этому не долго радовался
Долгое время вижу одно и то же в новостях и обзорах: ИИ уберет рутину, снимет трение, даст крылья и вообще панацея от всех болячек. Я поставил Claude Code — и да, трение исчезло. Рутина схлопнулась. Идею теперь можно проверить за вечер, а не за месяц.А дальше выяснилось, что трение это для меня было важно и когда оно ушло, я ощутил это в полной мере.Идеи мрут как мухи
Десять лет в индустрии я писал код руками. Три месяца назад перестал
После выхода Claude Opus 4.7 стало очевидно, что агент технически быстрее меня. А 28 мая Anthropic выпустила Opus 4.8 с теми же ценами, заметно лучшим coding/agentic-скором и новой возможностью держать в голове миграции на сотни тысяч строкИ всё же расслабиться не выйдет, потому что есть нюанс: эрудиция у него принципала, а суждения джуна. Он знает двадцать способов решить задачу и ни одной причины предпочесть один другому - потому что не ему потом это поддерживать
Каким должен быть язык программирования, чтобы с ним хорошо работали AI-агенты
В прошлом году я впервые задумался о том, как может выглядеть будущее языков программирования теперь, когда агентная разработка становится все более заметным явлением. Сначала мне казалось, что огромный корпус уже существующего кода закрепит нынешние языки на своих местах, но теперь я начинаю думать, что верно обратное.
Как я торговлю автоматизировал
Речь пойдёт о разработке системы алгоритмической торговли с использованием обучения с подкреплением (reinforcement learning, далее RL). Пройдём путь от идеи до работающей системы с разумной детализацией. Расскажу про свои ошибки: радовался single-seed успехам, верил

