Обладает ли Леопольд ситуационной осведомлённостью?
Так, ребят, хватит. Несмешно ведь.В конце июля 24-летний юноша по имени Леопольд Ашенбреннер лишился примерно двух третей стоимости хедж‑фонда объёмом $45 млрд. До этого главных причин считать его квалифицированным для управления $45 млрд было три: он написал завирусившееся эссе, он поработал на Сэма Бэнкмана‑Фрида, и его уволили
(Не)видимая цена интеллекта: почему экономия на LLM убивает ваши агентные системы
Разработчики агентных систем оказались в странной ситуации. Модели становятся дешевле, но задачи решают хуже. Провайдеры соревнуются в снижении цены за токен, а команды радостно переходят на облегчённые версии, экономя на вычислениях. Экономия очевидна — до первого столкновения с реальной задачей.
Что нового в Claude Code: разбор восьми августовских релизов
С 13 по 21 августа Anthropic выкатила восемь версий Claude Code, с 2.1.232 по 2.1.239. Список читается как обычные патчи CLI, пока не замечаешь, что почти всё в нём про одно: агентов у вас будет много, и работать они будут долго.Ниже — что реально приехало. Часть я прогнал на своей машине с 2.1.239 под Linux, часть взял из официального changelog, и я отмечаю, где что.Агенты перестали быть одиночкамиГлавное изменение серии лежит в 2.1.232, и его легко пропустить за строчкой про subagent forking.Субагент, запущенный с subagent_type: "fork", теперь наследует весь контекст текущего разговора и prompt cache
Как ИИ-агенты воюют, мирятся и пишут извинительные коммиты: 5 важных экспериментов
Даже не знаю, с чего начать. Потому что вот это всё – оно какое-то… ну, оно просто происходит, понимаете? Не в кино, а прямо в arXiv-препринтах. И это *жутко* интересно.
Свой инференс для 25 разработчиков: 452:1, KV‑пул и почему это не экономит денег
Все цифры сняты с работающего стенда: потребление токенов — за календарную неделю по данным шлюза, метрики движка — кумулятивно за период аптайма (11 426 обработанных запросов). Продолжение — про выбор модели по замерам, а не по бенчмаркам — будет отдельной статьёй.Для кого эта статьяДля тех, кто держит или собирается держать LLM внутри контура: тимлидов, DevOps, архитекторов. Здесь конфиги, цифры и грабли, а не введение в трансформеры.
Что такое RAGFlow и с чем его едят
Если вы хоть раз пользовались LLM, то почти наверняка сталкивались с двумя ее классическими болячками: галлюцинациями и устаревшими знаниями. А когда дело доходит до рабочих задач, появляется еще одна проблема — как использовать внутренние документы компании, не выкладывая их в открытый доступ.
Вордстат в чате с Claude, или как я автоматизировал сбор семантики
Всем привет! В предыдущей части этого блога я рассказывал о том, как я сделал свой MCP сервер и подключил Яндекс Директ в чат с моим Claude. Сегодня расскажу, как я туда же подключал вордстат.
Цена за успешный результат: почему дешёвая модель может обойтись дороже дорогой
Всем привет, меня зовут Сергей Прощаев и в этой статье расскажу про то, почему выбор модели по цене за миллион
TrueForge: открытая обвязка, которая превращает LLM в полноценного агента
Собрать демо-агента сегодня несложно. Подключаешь модель, добавляешь пару инструментов — и она уже читает файлы, вызывает API и бодро обещает выполнить любую задачу.Сложности начинаются, когда такого агента нужно запустить в проде.Кто будет хранить состояние между запросами? Как пережить перезапуск? Где выполнять сгенерированный код? Как не передать ему секреты? Когда запрашивать подтверждение пользователя? Что делать, когда контекст разрастается до сотен тысяч токенов?Обычно каждая команда собирает эту обвязку самостоятельно. TrueFoundry решила открыть свою реализацию — TrueForge.
Сравниваем сервисы Антиплагиат и Руконтекст на трёх языках: отчёты, оригинальность и ИИ-детекция
Как я обещал в прошлой статье

