WAIC 2026: главные анонсы и почему Китай превращает искусственный интеллект в национальную инфраструктуру
В этом году конференция приобрела беспрецедентный масштаб и значимость. Если раньше китайские компании пытались догнать западные аналоги по количеству параметров в LLM, то WAIC 2026 зафиксировала новый этап: переход к глубокой инженерной оптимизации, построению независимых вычислительных архитектур и массовому внедрению агентных систем в реальный сектор экономики. Китай больше не пытается просто скопировать OpenAI или заменить один GPU от NVIDIA; он строит параллельную технологическую вселенную со своими аппаратными интерконнектами, программными стеками и стандартами.Разбираемся, что было интересного на WAIC 2026 в этой статье.
Alibaba открыла исходный код AI-стека SAIL: вызов экосистеме CUDA
Alibaba представила открытый программный стек SAIL (Snow AI Infrastructure Layer) для собственных AI-ускорителей Zhenwu. Проект был анонсирован на конференции World AI Conference (WAIC), а его исходный код станет доступен разработчикам по открытой лицензии.Alibaba пытается решить проблему, которую многие аналитики считают главным источником лидерства Nvidia на рынке искусственного интеллекта, — зависимость разработчиков от экосистемы CUDA.Доминирование Nvidia — не только GPUЗа последние годы Nvidia превратилась из производителя графических процессоров в поставщика полноценной программно-аппаратной платформы для искусственного интеллекта.
Когда компании пора строить свой LLM-кластер, а не пользоваться внешними API
На раннем этапе внедрения LLM в компании выглядят как быстрый выигрыш: подключается внешний API (например, ChatGPT), ускоряется работа с текстами, автоматизируются ответы, появляются первые сценарии аналитики и агентных пайплайнов через Make или n8n.До определённого масштаба этого достаточно.По мере роста компании LLM перестаёт быть вспомогательным инструментом и становится частью операционных процессов. В системе появляются чувствительные данные, требования к контролю доступа, необходимость стабильной работы, интеграции во внутренние сервисы и вопросы экономики при больших объёмах запросов.
Xiaomi разогнали 1T-модель до 1200 tok-s на стандартных GPU
Китайские команды MiMo и TileRT опубликовали режим UltraSpeed для модели MiMo V2.5 Pro (1,02T параметров).На одном 8-карточном сервере со стандартными GPU, до ~1200 токенов в секунду. Cerebras выдаёт похожие скорости на кастомном железе. Здесь обошлись без него.
Anthropic будет платить xAI $1,25 млрд в месяц за вычислительные мощности
Anthropic заключила крупную сделку на покупку вычислительных мощностей у xAI. Компания получит доступ к 300 МВт compute — фактически ко всей мощности дата-центра Colossus 1 рядом с Мемфисом, штат Теннесси.
Сбербанк рассчитывает использовать китайские чипы для GigaChat
Сбербанк рассчитывает использовать китайские микрочипы для развития GigaChat — своей флагманской модели искусственного интеллекта. Об этом глава банка Герман Греф заявил во время визита Владимира Путина в Китай.
Ollama и Open WebUI на VPS без GPU: рабочий вариант или боль?
Ollama и Open WebUI на VPS без GPU: рабочий вариант или боль?

