Kubernetes. - страница 6

Alibaba Cloud выпустил HiClaw v1.1.0 — Hermes Agent стал first-class Worker runtime

Alibaba Cloud выпустил HiClaw v1.1.0 — оператор для AI-агентов на Kubernetes. Главное обновление: Hermes Agent стал полноценным Worker runtime. HiClaw позволяет через CRD управлять ресурсами агентов в стиле Kubernetes и поддерживает Matrix-интеграцию для координации. В новой версии добавлена Kubernetes-native архитектура, модульный runtime Hermes с возможностью программирования и дебаггинга, интерфейсы для gateway и storage, разделение контейнеров, режимы сна и миграции, а также CLI и приветственное сообщение. Продукт подходит как для enterprise, так и для малых команд, с возможностью локальной установки и замены компонентов (например, LLM и S3).Cocoon AI Summary

продолжить чтение

kubectl describe pod: как читать вывод, в котором Kubernetes уже написал причину

kubectl describe pod часто вспоминают слишком поздно. Уже сходили в логи, пролистали Helm values, спросили в чате «кто деплоил?», на всякий случай дропнули Pod — и только потом внизу describe нашли ту самую строку: образ не скачался, памяти не хватило, Secret не примонтировался или readiness-проба честно возвращала 500. Эта команда не заменяет логи, метрики и трейсинг. Она про другое: показать, что Kubernetes пытался сделать с Pod’ом и на каком шаге всё развалилось. Если читать describe не как длинную простыню полей, а как историю жизни Pod’а, он экономит не минуты, а часы.

продолжить чтение

Гайды по nxs-universal-chart v3.0: AI Inference контур на основе KServe

продолжить чтение

63 бесплатных урока мая: от Go и Kubernetes до LLM, ClickHouse и AI-агентов

Привет, хабровчане. В майском дайджесте собрали 63 открытых урока по ключевым IT-направлениям: от backend-разработки, архитектуры и инфраструктуры до ML, аналитики, тестирования, информационной безопасности и управления. В программе — Go, Kotlin, Rust, Kubernetes, Ansible, OpenTelemetry, ClickHouse, LLM, AI-агенты, DevSecMLOps, API Gateway, нагрузочное тестирование и другие темы, которые сейчас часто всплывают в реальных инженерных задачах.

продолжить чтение

От Kubernetes до AI Engineering: 5 главных трендов Технологического радара DevOpsConf 2026

Каждый год индустрия генерирует десятки новых инструментов и практик. Для руководителей команд разработки (Team Leads, CTO) это означает постоянную головную боль при выборе технологического стека. Для практикующих инженеров — необходимость непрерывно обновлять свои навыки, чтобы оставаться востребованными на рынке.На DevOpsConf мы представили свежий техрадар, который позволяет не просто увидеть список популярных утилит, но и разглядеть тектонические сдвиги в индустрии. 

продолжить чтение

Как из факапа родился продукт: история EasyDoc

Привет, Хабр! Меня зовут Вадим Петросян, я директор по развитию бизнеса в ITFB Group

продолжить чтение

DRAматургия GPU в Kubernetes: зачем нужен DRA, если Device Plugin работает? Разбираем грабли AI-инфраструктуры

Device Plugin честно отработал свою эпоху: он научил Kubernetes видеть GPU и выдавать их подам. Но с AI‑бумом GPU превратились в общий ресурс для десятков команд. Тут уже не «лишь бы запустилось», а нужны жёсткая изоляция, топология и утилизация. Старая модель упёрлась в потолок. Чтобы обойти её ограничения, команды вынуждены городить поверх «второй Kubernetes». А это дорого, часто ломается и плохо масштабируется.

продолжить чтение

Разворачиваем ИИ в контейнерах: опыт интеграции LocalAI и Kubeflow

Привет, Хабр! Мы — команда dBrain.cloud, и сегодня хотим поделиться нашим путем по внедрению ИИ-сервисов на нашей платформе контейнеризации. Искусственный интеллект стремительно проникает практически в каждый цифровой продукт, будь то аналитика, корпоративные сервисы или клиентские приложения. В связи с этим перед нами встал важный вопрос: как обеспечить надежную и масштабируемую инфраструктуру для развертывания собственных и готовых ИИ-моделей?

продолжить чтение

vLLM Production Stack. Часть 1: Базовые возможности vLLM

ОглавлениеДля удобства навигацииВступлениеТестовое окружение Как устроены примеры в статьеЧто такое vLLM vLLM Production StackКакие модели можно запуститьЗапуск моделей в разных режимах Скачивание моделиЗапуск Qwen3-8BВключение вызова инструментов (tool-calling)

продолжить чтение

DevOps после хайпа: что реально работает, почему автоматизация делает вас слабее и как ИИ вписывается в инженерку

Меня зовут Дмитрий Синявский, я SRE в Ви.Tech, IT дочке «ВсеИнструменты.ру». В какой то момент я поймал себя на мысли, что вокруг DevOps снова спорят как в начале десятых: одни уверяют, что он умер, другие переименовывают все в platform engineering, третьи ждут, что ИИ наконец сделает всю грязную работу за инженеров. Мы с Владимиром Утратенко, который прошел путь от техподдержки до техдиректора и сейчас развивает платформу «Штурвал», спокойно разложили это по полочкам.

продолжить чтение

1...456789...11