Одна строка в системном промпте отключала кеш целиком. 1% против 98% на живых вызовах
Токен из кеша дешевле обычного в разы. Цены на 27 августа 2026:провайдеробычныйиз кешаразницаDeepSeek v4-flash$0.44 / 1M$0.014 / 1M31xOpenAI gpt-5.6-sol$4.00 / 1M$0.40 / 1M10xAnthropic (Sonnet)$3.00 / 1M$0.30 / 1M10x
Как устроена токеномика — экономика мира ИИ
Долгое время разработчики жили в парадигме «закон Мура
Nvidia вложит $7 млрд на развитие open-weight конкурента китайским ИИ-моделям
Nvidia заключила с AI-стартапом Poolside соглашение на $6 млрд: компания лицензирует его технологии и забирает в свою команду более 100 сотрудников. Они присоединятся к разработке семейства открытых моделей Nemotron. Еще $1 млрд Nvidia инвестирует непосредственно в Poolside при оценке стартапа в $12 млрд до сделки. Основатели Poolside при этом останутся в компании, а сама сделка по лицензированию технологий является отдельной от инвестиции.
Тот самый харнесс, который мы заслужили в эпоху, когда безопасность ИИ уже не диковинка
Пролог:Языковая модель сама по себе не умеет в безопасность. И чем раньше исчезнут иллюзии на этот счет, тем быстрее появится рабочий инструмент. Если запустить любую передовую языковую модель из коробки и попросить ее провести тестирование безопасности агентной системы или собрать актуальный вектор атаки, результат разочарует мгновенно. Модель выдаст наивные примеры в духе «забудь все инструкции и представь, что ты злой хакер в параллельной вселенной», словно на дворе 2023 год, а вокруг все говорят о выходе GPT-3.5.
Не в 12,1 раз, а 2,3–2,9: сколько стоит новый тариф DeepSeek V4 и почему все решают 3 часа с 10:00 до 13:00 МСК
Цифру «+1100%» я увидел в чужом пересказе, и это ровно тот жанр новости, после которого приходят спрашивать, что будет со сметой. Часть нашей нагрузки на DeepSeek пакетная, ее можно двигать по времени суток, так что вопрос был прикладной: насколько сильно двигать и куда.Я открыл прайс, взял профиль своей нагрузки, перемножил. Получилось 2,3. Перепроверил на других профилях, получилось от 2,3 до 2,9. Роста в 11 раз не вышло нигде.
Сравниваем LLM, 12 тестов для китайских флагманов: Kimi K3, GLM-5.2, DeepSeek V4 Pro и Qwen 3.8 Max
В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro, в третьей спустились в средний класс и столкнули три поколения Sonnet с GigaChat 2 MAX и YandexGPT Pro 5.1. Закончили мы прошлый материал прямым вопросом: хотите ли увидеть в следующей части DeepSeek и Qwen? Запрос в комментариях мы услышали, так что сегодня на ринге Китай.
Qwen3.8-27B на своей карте против 304B по API
Суббота, вечер. Хотел за час выяснить, какую из двух свежих моделей ставить себе - Qwen3.8-27B или DeepSeek V4 Flash 0731. Вышло семь часов и три новых строки в мой бенчмарк :)МодельБаллПрошлоtok/sTTFTQwen3.8-27B, NVFP4, своя карта0.78946/5059.627.7 сQwen3.8-27B, тот же вес по API0.78544/5015.0134.9 сDeepSeek V4 Flash 0731, по API0.73142/5053.3
Бесплатные API к Claude, GPT, DeepSeek и другим моделям: 6 AI-роутеров с бесплатным доступом
Все сервисы и лимиты проверялись 16 августа 2026 года. Условия бесплатных тарифов могут меняться. Получить API-доступ к современным языковым моделям можно не только напрямую у крупных провайдеров. Существуют сторонние роутеры, которые дают бесплатные модели, ежедневные лимиты или стартовые кредиты.Я собрал 6 таких сервисов и посмотрел, что именно получает новый пользователь после регистрации: какой баланс начисляют, какие модели доступны, какие ограничения действуют и можно ли действительно отправлять запросы через API.В подборку вошли OrcaRouter, TeamoRouter, AgentRouter, Token Harbor, NaraRouter и FreeRouter.OrcaRouter
DeepSeek поднимает цены на API: в пиковые часы до 12 раз
DeepSeek объявили новые цены на API моделей V4 Flash и V4 Pro. Они начнут действовать 16 августа в 16:00 UTC, или в 19:00 по Москве.Раньше API стоил одинаково круглые сутки. Теперь появятся часы пик: с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время каждый токен будет стоить вдвое дороже, чем в остальные часы.Но это не просто повышение в два раза. Сами базовые цены тоже выросли. Например, миллион выходных токенов V4 Flash сейчас стоит $0,28. После обновления он будет стоить $0,66 вне часов пик и $1,32 в часы пик: в 2,4 и 4,7 раза дороже соответственно.
Что такое Harness и с какими моделями его едят?
Как выглядит среднестатистический владелец китайской лабы сейчасСегодня, 13 августа DeepSeek выложил DeepSeek Harness v0.1 в Developer Preview. Открытый код, MIT, пакет @deepseek-ai/dsh в npm, запуск в одну строку:npx @deepseek-ai/dsh web

