Токены в ИИ и оптимизация промптов: как я сэкономила 50% бюджета и перестала здороваться с ChatGPT
Меня зовут Анна, я ведущий инженер по тестированию в Рексофт. Последние два года я плотно работаю с большими языковыми моделями: интегрирую их в CI/CD, использую для генерации тестов и анализа логов. И довольно быстро столкнулась с жестокой реальностью: недельный лимит токенов на проекте — всего 10 000, а один мой вежливый запрос с «пожалуйста» съедал почти 500 токенов на входе и еще пару тысяч на выходе.
Один ход агента — 120 000 токенов. Разбираемся, куда они уходят и как мы это починили
Мы делаем Uma Computer
Исследователь сжёг все свои токены и разработал ИИ-конвейер, изучая способы экономии на ИИ-моделях
Разработчик Бартош Котрыс (Bartosz Kotrys) из компании Quesma рассказал
Исследование: Claude Code отправляет в 4,7 раза больше служебных токенов, чем OpenCode
Компания Systima сравнила объём служебных данных, которые Claude Code и OpenCode передают языковой модели вместе с пользовательским запросом. Решение от Anthropic использует в 4,7 раза больше токенов и быстрее расходует лимит.
89% моих трат на AI‑агентов — это кэш, а не генерация. Написал CLI, чтобы увидеть
Я много работаю с кодинг‑агентами в Claude Code. В какой‑то момент поймал себя на том, что не представляю, на что уходят токены. Счёт в конце месяца есть, а из чего он складывается, непонятно. Написал небольшую утилиту, которая читает то, что Claude Code и так пишет на диск, и раскладывает расходы по статьям. То, что она показала, мне не понравилось.Вывод ledgent report ‑redact
Куда делись мои токены?
Когда начинаешь плотно работать с AI-агентом, кажется, что бОльшая часть токенов улетает на сложные процессы - код написать, сайт разобрать, статью подготовить, браузером поуправлять, в логах покопаться. Вроде логично, задача сложная, модель думает, инструменты дергает, контекст растет.
Директор ИИ‑стартапа Bold Metrics дважды в неделю объясняет команде, какую ИИ‑модель выбрать, чтобы сэкономить токены
Технический директор ИИ‑стартапа Bold Metrics Морган Линтон дважды в неделю объясняет команде из 16 инженеров, какую ИИ‑модель стоит применять для конкретной задачи, чтобы не тратить дорогие токены там, где хватит более дешёвого решения. Об этом управленец рассказал в интервью Business Insider.Такой подход получил в индустрии название «модельмаксинг» (modelmaxxing
Tesla ограничит расходы сотрудников на ИИ до $200 в неделю на рабочее место
С 6 июля 2026 года Tesla введёт ограничение расходов сотрудников на инструменты искусственного интеллекта до $200 в неделю, пишет Information со ссылкой на внутреннюю записку американского производителя электромобилей. Компания пошла на такой шаг спустя несколько месяцев после того, как она сама призвала персонал активнее пользоваться нейросетями.

