Исследователь сжёг все свои токены и разработал ИИ-конвейер, изучая способы экономии на ИИ-моделях
Разработчик Бартош Котрыс (Bartosz Kotrys) из компании Quesma рассказал
Исследование: Claude Code отправляет в 4,7 раза больше служебных токенов, чем OpenCode
Компания Systima сравнила объём служебных данных, которые Claude Code и OpenCode передают языковой модели вместе с пользовательским запросом. Решение от Anthropic использует в 4,7 раза больше токенов и быстрее расходует лимит.
89% моих трат на AI‑агентов — это кэш, а не генерация. Написал CLI, чтобы увидеть
Я много работаю с кодинг‑агентами в Claude Code. В какой‑то момент поймал себя на том, что не представляю, на что уходят токены. Счёт в конце месяца есть, а из чего он складывается, непонятно. Написал небольшую утилиту, которая читает то, что Claude Code и так пишет на диск, и раскладывает расходы по статьям. То, что она показала, мне не понравилось.Вывод ledgent report ‑redact
Куда делись мои токены?
Когда начинаешь плотно работать с AI-агентом, кажется, что бОльшая часть токенов улетает на сложные процессы - код написать, сайт разобрать, статью подготовить, браузером поуправлять, в логах покопаться. Вроде логично, задача сложная, модель думает, инструменты дергает, контекст растет.
Директор ИИ‑стартапа Bold Metrics дважды в неделю объясняет команде, какую ИИ‑модель выбрать, чтобы сэкономить токены
Технический директор ИИ‑стартапа Bold Metrics Морган Линтон дважды в неделю объясняет команде из 16 инженеров, какую ИИ‑модель стоит применять для конкретной задачи, чтобы не тратить дорогие токены там, где хватит более дешёвого решения. Об этом управленец рассказал в интервью Business Insider.Такой подход получил в индустрии название «модельмаксинг» (modelmaxxing
Tesla ограничит расходы сотрудников на ИИ до $200 в неделю на рабочее место
С 6 июля 2026 года Tesla введёт ограничение расходов сотрудников на инструменты искусственного интеллекта до $200 в неделю, пишет Information со ссылкой на внутреннюю записку американского производителя электромобилей. Компания пошла на такой шаг спустя несколько месяцев после того, как она сама призвала персонал активнее пользоваться нейросетями.
Компании стали внедрять стиль речи «пещерного человека» в чат-боты для экономии токенов
Разработчики обратились к специализированному инструменту Caveman, который заставляет ИИ генерировать максимально краткие ответы с имитацией стиля речи «пещерного человека». Таким образом компании реагируют на стремительный рост расходов на токены.
Стоимость токенов ИИ для разработчиков может превысить их зарплаты через два года
По мнению аналитиков Gartner, растущее использование программных агентов и моделей ценообразования на основе потребления может привести к беспрецедентному росту расходов разработчиков на ИИ в течение следующих двух лет. Вскоре предприятия будут платить за использование токенов для разработчиков столько же, сколько выделяют на зарплаты.

