glm.

glm.

Китайская Z.ai построила ИИ-дата-центр мощностью 1 ГВт без ускорителей Nvidia

Китайская компания Z.ai завершила строительство крупного вычислительного центра для искусственного интеллекта, который полностью работает на китайских ускорителях и не использует чипы Nvidia. По данным Bloomberg, часть объекта уже введена в эксплуатацию. Инфраструктура предназначена для обучения и разработки следующих поколений моделей семейства GLM.Мощность нового комплекса — около 1 ГВт. Это один из крупнейших проектов такого типа среди китайских ИИ-разработчиков. При этом компания не раскрывает точное расположение объекта, количество установленных ускорителей и конкретных производителей используемых чипов.

продолжить чтение

Автономная система ИИ-агентов атаковала Hugging Face: защититься помогла LLM

Hugging Face раскрыли подробности недавнего инцидента безопасности. По заявлению компании, это первый случай, когда атака на ее инфраструктуру была целиком проведена автономной системой ИИ-агентов — от первоначального проникновения до последующего развития атаки.

продолжить чтение

Вайбкодинг на минималках: как настройка OpenClaw убила веру в магию нейросетей (или история дефолт-юзера с openclaw)

ОГЛАВЛЕНИЯ:ВВОДНАЯ ЧАСТЬОЖИДАНИЕ ОТ ПРОГРАММЫПЕРВАЯ УСТАНОВКАСТОИМОСТЬ И ИСПОЛЬЗУЕМЫЕ МОДЕЛИ

продолжить чтение

Энтузиаст запустил GLM-5.2 на ноутбуке с 25 ГБ RAM: без дистилляции, но на скорости от 0,05 токена в секунду

Разработчик-одиночка под ником JustVugg представил Colibri

продолжить чтение

  • Оставлено в

ИИ снова закрывается: почему нейросети оказались на грани блокировок

продолжить чтение

Что думают ТОП-компании про перестройку на AI native

Здравствуй, Хабр!Я давно сознательно избегал трех бесячих тем: фронтир-моделей, автономных агентов ради самих агентов и разговоров про AI-native компании. Потому что вокруг них сейчас слишком много маркетинга и слишком мало инженерной конкретики.Но после доклада AWS про команды в мире агентского ИИ стало понятно, что интересный вопрос тут не какая модель победит, а какая операционная модель переживет удешевление разработки и придумали ли уже что-то по делу. Статья перед тобой разбор тысяч публикаций про то что думают всяки MAANG о том какие команды в итоге получатся.

продолжить чтение

Собрал ИИ-бенчмарк под себя из 2 месяцев своих сессий — и дорогие модели проиграли дешёвым

Собрал ИИ-бенчмарк под себя — и дорогие модели проиграли дешёвымПубличные лидерборды сходятся: сильнейшая открытая модель сейчас — GLM-5.2 на 744 миллиарда параметров. За ней — Kimi K2.6, DeepSeek V4. Я пару месяцев доверял этим таблицам и гонял через лучшие модели свою ежедневную работу.Потом измерил то, чего лидерборды не могут измерить — как работаю конкретно я. Тройка лидеров сжалась в ничью, а победила в практике модель в 37 раз дешевле GLM-5.2.Дальше — как я это мерил, на чём, какие были грабли, и почему «лучшая модель» и «лучшая модель для тебя» — это разные модели.Почему чужой лидерборд не подберет модель под тебя

продолжить чтение

Как использовать новые Qwen3.7 Plus в России и GLM 5.2 на русском

Qwen3.7 Plus от Alibaba и GLM 5.2 от Z.AI теперь работают без VPN. Обе заточены под кодинг и агентные задачи, обе держат миллион токенов контекста, и обе могут вам пригодиться. Как получить к ним доступ без подписок и сервисов обхода, разбираемся в этой статье.Qwen3.7 Plus: мультимодальный агент за копейкиQwen3.7 Plus — это мультимодальная версия агентного бэкбона Qwen3.7 примерно в шесть раз дешевле, чем флагманский Qwen3.7 Max.

продолжить чтение

Эксперимент: может ли группа LLM отбирать стартапы лучше человека?

Оценивая текущую повестку вокруг ИИ, многие резонно замечают парадокс. Шума много, ботов ещё больше, а сгенерированных картинок и красивых концептов — бесконечный поток. Мы даже видим волны увольнений из-за повальной оптимизации, но где осязаемые результаты? Где то самое «пощупать»? Настоящая эффективность, которую можно поставить на стол перед скептиком и сказать: смотрите, вот оно работает. Без идеализации, но с пониманием реального потенциала.Безусловно, у технологии есть мощные стороны. Я сам о них писал (раз

продолжить чтение

Как и зачем мы сделали собственный OCR-бенчмарк

Однажды нам понадобилось выбрать OCR-модель для RAG-пайплайна. Казалось бы, задача простая: смотришь на лидерборды, берешь лучшую, PROFIT. Но быстро выяснилось, что, во-первых, то, что прекрасно срабатывает на каких-нибудь английских юридических документах, может не потянуть такие штуки как научные формулы, паспортные данные и таблицы на русском языке. А во-вторых, даже если крутой по всем параметрам бенчмарк для оценки качества распознавания говорит, «всё прочитали правильно, я проверил», точность ответов пользователю, который совершает запрос к чат-боту с RAG под капотом, может страдать.

продолжить чтение

123