Малые языковые модели: где пригодятся SLM и что учесть в работе с ними
Сегодня малые языковые модели (SLM) все чаще оказываются в центре внимания: на первый взгляд, они почти не уступают LLM, при том, что ресурсов тратят намного меньше.Но тут, как всегда, есть нюанс (и не один): обсуждаем, так ли хороши SLM, где они действительно могут быть полезны, а где пока буксуют. А еще разбираемся, почему — на наш взгляд — серьезных конкурентов для LLM из них пока не выйдет.
Anthropic сообщила подробности о кампаниях по дистилляции моделей, проводимых китайскими Alibaba, Moonshot AI и DeepSeek
Anthropic сообщила подробности о кампаниях по дистилляции моделей американских разработчиков со стороны китайских компаний в сфере искусственного интеллекта. В последние месяцы китайские разработчики нарастили усилия в этой области, что стало поводом для коллективных обвинений, выдвинутых спецслужбами США.
Несколько спецслужб США выдвинули коллективные обвинения в адрес китайских ИИ‑компаний
Агентство по кибербезопасности и защите инфраструктуры США (CISA) в сотрудничестве с Агентством национальной безопасности и Федеральным бюро расследований выпустило совместное предупреждение о кибербезопасности в области дистилляции знаний. Федеральные агентства указали, что китайские компании в сфере искусственного интеллекта целенаправленно атакуют своих американских конкурентов, чтобы систематически извлекать языковые модели в рамках кампаний по дистилляции знаний.
США и Китай проведут первые официальные переговоры по искусственному интеллекту в сентябре
США и Китай готовятся провести первые официальные межправительственные переговоры по вопросам искусственного интеллекта в сентябре 2026 года. По данным Reuters, встреча станет частью попытки двух стран выработать общие подходы к контролю рисков, связанных с развитием передовых ИИ-моделей, несмотря на продолжающееся технологическое соперничество.
OpenAI и Google продают ИИ-модели китайским компаниям из чёрного списка США
Американские ИИ-гиганты продолжают работать с китайскими технологическими корпорациями, несмотря на санкционные ограничения. Как выяснила Financial Times, OpenAI и Google предоставляют услуги в области искусственного интеллекта сингапурским «дочкам» Alibaba, Baidu и Tencent — компаний, которые правительство США официально обвиняет в сотрудничестве с китайскими военными.
Claude Code втихую метит запросы. Так Anthropic ищет тех, кто учит на нём свои модели
Мы даём кодовым агентам полный доступ к машине: файлы, шелл, git. Значит, сам бинарник должен быть предсказуемым, без сюрпризов. У Claude Code сюрприз есть: он незаметно помечает часть запросов. Судя по логике, цель одна — вычислить тех, кто гоняет Claude, чтобы обучать на его ответах свою модель. Это называется дистилляцией, и для любой AI-компании это прямая кража.Что прячется в промптеВ системный контекст уходит обычная строка с датой:Today’s date is 2026-06-30.
Вышел DeepSeek V4. Почему это очень плохо для США?
DeepSeek выпустили V4 с открытыми весами, на уровне frontier-моделей — и в разы дешевле Opus 4.7 или GPT-5.5. R1 в своё время обвалил рынок на 20% за ночь. V4 — масштабнее.DeepSeek V4 Pro — это 1,6 триллиона параметров, mixture of experts (MoE), 49 млрд активных параметров и контекст в 1 миллион токенов. V4 Flash — рабочая лошадка: 284 млрд параметров суммарно, 13 млрд активных. Обе модели обучены примерно на 33 трлн токенов. На агентских бенчмарках кода, MMLU Pro, GPQA Diamond, SWE-bench Verified — V4 рядом с Opus 4.7 и GPT-5.5. Немного отстаёт, но совсем немного.Вот в чём дело.

