AI-инфраструктура.

WAIC 2026: главные анонсы и почему Китай превращает искусственный интеллект в национальную инфраструктуру

В этом году конференция приобрела беспрецедентный масштаб и значимость. Если раньше китайские компании пытались догнать западные аналоги по количеству параметров в LLM, то WAIC 2026 зафиксировала новый этап: переход к глубокой инженерной оптимизации, построению независимых вычислительных архитектур и массовому внедрению агентных систем в реальный сектор экономики. Китай больше не пытается просто скопировать OpenAI или заменить один GPU от NVIDIA; он строит параллельную технологическую вселенную со своими аппаратными интерконнектами, программными стеками и стандартами.Разбираемся, что было интересного на WAIC 2026 в этой статье.

продолжить чтение

Alibaba открыла исходный код AI-стека SAIL: вызов экосистеме CUDA

Alibaba представила открытый программный стек SAIL (Snow AI Infrastructure Layer) для собственных AI-ускорителей Zhenwu. Проект был анонсирован на конференции World AI Conference (WAIC), а его исходный код станет доступен разработчикам по открытой лицензии.Alibaba пытается решить проблему, которую многие аналитики считают главным источником лидерства Nvidia на рынке искусственного интеллекта, — зависимость разработчиков от экосистемы CUDA.Доминирование Nvidia — не только GPUЗа последние годы Nvidia превратилась из производителя графических процессоров в поставщика полноценной программно-аппаратной платформы для искусственного интеллекта.

продолжить чтение

Когда компании пора строить свой LLM-кластер, а не пользоваться внешними API

На раннем этапе внедрения LLM в компании выглядят как быстрый выигрыш: подключается внешний API (например, ChatGPT), ускоряется работа с текстами, автоматизируются ответы, появляются первые сценарии аналитики и агентных пайплайнов через Make или n8n.До определённого масштаба этого достаточно.По мере роста компании LLM перестаёт быть вспомогательным инструментом и становится частью операционных процессов. В системе появляются чувствительные данные, требования к контролю доступа, необходимость стабильной работы, интеграции во внутренние сервисы и вопросы экономики при больших объёмах запросов.

продолжить чтение

Xiaomi разогнали 1T-модель до 1200 tok-s на стандартных GPU

Китайские команды MiMo и TileRT опубликовали режим UltraSpeed для модели MiMo V2.5 Pro (1,02T параметров).На одном 8-карточном сервере со стандартными GPU, до ~1200 токенов в секунду. Cerebras выдаёт похожие скорости на кастомном железе. Здесь обошлись без него.

продолжить чтение

Anthropic будет платить xAI $1,25 млрд в месяц за вычислительные мощности

Anthropic заключила крупную сделку на покупку вычислительных мощностей у xAI. Компания получит доступ к 300 МВт compute — фактически ко всей мощности дата-центра Colossus 1 рядом с Мемфисом, штат Теннесси.

продолжить чтение

Сбербанк рассчитывает использовать китайские чипы для GigaChat

Сбербанк рассчитывает использовать китайские микрочипы для развития GigaChat — своей флагманской модели искусственного интеллекта. Об этом глава банка Герман Греф заявил во время визита Владимира Путина в Китай.

продолжить чтение

Google и Blackstone запускают AI cloud-проект с дата-центрами на 500 МВт

продолжить чтение

AI-кластеры поднимают плотность стоек: модульные ЦОД уже проектируют под 80–200 кВт

продолжить чтение

Cerebras провела крупнейшее AI-IPO 2026 года: акции взлетели на 108% в первый день торгов

продолжить чтение

Ollama и Open WebUI на VPS без GPU: рабочий вариант или боль?

Ollama и Open WebUI на VPS без GPU: рабочий вариант или боль?

продолжить чтение

12