Kodacode лучший харнес для DeepSeek v4 Flash!? Замерили различные харнессы и модели
Когда кодовый агент решает задачу, сама LLM не редактирует файлы и не запускает тесты напрямую. Она работает через агентную оболочку, или, по-другому, харнесс. Она получает системные инструкции, выбирает инструменты, читает результаты их работы и решает, что делать дальше.Поэтому одна и та же модель в разных агентах может показать разные результаты. Где-то ей удобнее искать по проекту, где-то она получает более понятные ошибки, где-то лучше управляется контекст длинной сессии. Даже небольшое различие в инструментах или системном промпте на десятках шагов превращается в заметную разницу на выходе.
Анатомия ночных продаж: как n8n и два Salesbot’а закрывают слепые зоны в amoCRM
Дисклеймер: в статье упоминается Meta — организация, признанная экстремистской и запрещённая на территории РФ.Все ключи, телефоны и названия в примерах изменены; код, схема, логика и скрины‑ из рабочего проекта заказчика, и строго с его разрешения! Статья не является рекламой/самопиаром и тому подобное. В прошлой статье
Не в 12,1 раз, а 2,3–2,9: сколько стоит новый тариф DeepSeek V4 и почему все решают 3 часа с 10:00 до 13:00 МСК
Цифру «+1100%» я увидел в чужом пересказе, и это ровно тот жанр новости, после которого приходят спрашивать, что будет со сметой. Часть нашей нагрузки на DeepSeek пакетная, ее можно двигать по времени суток, так что вопрос был прикладной: насколько сильно двигать и куда.Я открыл прайс, взял профиль своей нагрузки, перемножил. Получилось 2,3. Перепроверил на других профилях, получилось от 2,3 до 2,9. Роста в 11 раз не вышло нигде.
DeepSeek поднимает цены на API: в пиковые часы до 12 раз
DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.
DeepSeek предупредили о «значительном» повышении цен на API
В личных кабинетах DeepSeek Open Platform появился баннер о предстоящем повышении цен на API. Пользователям сервиса также начали приходить письма с тем же предупреждением.
Opus оркеструет, DeepSeek V4 пишет код: как собрать связку внутри Claude Code и сэкономить деньги
Однажды я открыл биллинг и просто посмотрел, на что уходят токены. Не на «подумать над архитектурой». А на переименование переменных, генерацию тестов по готовому ТЗ и прогон миграций. Всё это считалось по тарифу флагманской модели, хотя такую работу вытянет модель в десятки раз дешевле.Ниже – как развести действительно сложные задачи и рутину по двум моделям внутри Claude Code, не ставя ни одного стороннего форка. И три зоны, куда дешёвую модель я не пускаю принципиально. Что на самом деле сжигает токены
Нейросеть DeepSeek (Дипсик): как использовать для текста, кода и анализа данных?
Нейросеть DeepSeek (Дипсик): как использовать для текста, кода и анализа данных
DeepSeek V4 vs Claude Sonnet 4.6: кто дешевле, кто умнее
Цены DeepSeek V4 Pro вышли в апреле 2026: $1.74 за миллион входных токенов, $3.48 за выходные. Claude Sonnet 4.6 стоит $3 и $15 соответственно. То есть в 1.7–4.3 раза дороже, в зависимости от пропорции input/output. На SWE-bench и GPQA модели идут плечом к плечу. Английские бенчи говорят: Sonnet чуть впереди по reasoning, DeepSeek чуть позади, но дешевле. Берите DeepSeek, не прогадаете.На английских.
LLM бенчмарк «Испытание Дали»
Обложка нарисована в ChatGPT Image-2Помните анекдот?— Что вы умеете лучше всего? — Я очень быстро считаю. — Сколько будет 758×652÷9? — 22! — Но это же неправильно! — Зато очень быстро.
Вышел DeepSeek V4. Почему это очень плохо для США?
DeepSeek выпустили V4 с открытыми весами, на уровне frontier-моделей — и в разы дешевле Opus 4.7 или GPT-5.5. R1 в своё время обвалил рынок на 20% за ночь. V4 — масштабнее.DeepSeek V4 Pro — это 1,6 триллиона параметров, mixture of experts (MoE), 49 млрд активных параметров и контекст в 1 миллион токенов. V4 Flash — рабочая лошадка: 284 млрд параметров суммарно, 13 млрд активных. Обе модели обучены примерно на 33 трлн токенов. На агентских бенчмарках кода, MMLU Pro, GPQA Diamond, SWE-bench Verified — V4 рядом с Opus 4.7 и GPT-5.5. Немного отстаёт, но совсем немного.Вот в чём дело.

