DeepSWE.

DeepSeek V4.1-Flash: новая архитектура, 552 млрд параметров и агентные тесты

DeepSeek вывела V4.1-Flash — младшую модель новой архитектурной линейки компании. Это MoE-модель на 552 млрд параметров с нативной поддержкой изображений, контекстом до 1 млн токенов и отдельными режимами reasoning.Наиболее интересная часть релиза — архитектурные изменения. DeepSeek перешла к асимметричной схеме Causal Encoder–Decoder: при prefill активируется около 8 млрд параметров на токен, а при decode — 16 млрд. То есть вычислительный бюджет для обработки входа и генерации намеренно сделали разным.

продолжить чтение

OpenAI выпустила GPT-6 Astra: кибербезопасность, AGI и доступ

OpenAI представила GPT-6 Astra — новое флагманское поколение модели, ориентированное на автономную работу над сложными многошаговыми задачами. Акцент сделали на программировании, исследованиях, работе с инструментами и других сценариях, где модель должна не просто ответить на запрос, а самостоятельно пройти длинную цепочку действий.Скажу сразу: это скорее поэтапное развертывание. Сначала доступ для избранных — ограниченные группы и спецы по кибербезопасности. Широкий доступ еще не выкатили.

продолжить чтение

Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter

Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18 млрд.

продолжить чтение

Z.ai выпустили GLM-5.3: обошла Opus 4.8, но уступила Fable 5 и GPT-5.6 Sol

Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач.GLM-5.3 использует ту же базовую модель, что и GLM-5.2. Компания не меняла архитектуру и не проводила новый претрейн. Изменения внесли на этапе пост-тренинга: в течение месяца модель обучали с подкреплением на дополнительных рабочих окружениях.На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%. Веса обещают открыть через две недели, после дополнительной проверки безопасности.

продолжить чтение

Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге

Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

продолжить чтение

Gemini 3.6 Flash: модель не стала умнее, но стала гениально дешёвой

продолжить чтение