Инфраструктурный релиз. Консистентность сред vs идентичность сред
Меня зовут Константин Кузнецов, в ПСБ я занимаюсь, в числе прочего, поддержкой ИТ-инфраструктуры.В этой статье я расскажу о том, как концепция инфраструктурного релиза помогала формировать процессы обеспечения идентичности сред. Если вы начинающий специалист в области ИТ-инфраструктуры, который видит своё будущее в ИТ-менеджменте — эта статья для вас. Думаю, вам будет полезно ознакомиться с вызовами и олдскульными способами их решения, основанными частично на ITIL, частично на devops.Что такое среда и сколько их нужно
Из песочницы Compose в боевой Kubernetes: как я построил отказоустойчивую архитектуру за 5 месяцев, изучая все с нуля
ПредисловиеЗа последние несколько месяцев плотной работы над инфраструктурой для проекта я прошёл путь от первых команд в терминале Linux до настройки полностью отказоустойчивого K3s‑кластера с Zero‑Downtime деплоем. Шишек на этом деле я набил огромное количество, и мне определённо есть чем поделиться.Сразу оговорюсь: в этой статье не будет монотонных гайдов, слепых копипастов YAML‑манифестов и пересказа официальной документации. С базовой настройкой вы отлично справитесь, прочитав мануалы создателей этих инструментов.
Исследование: IT‑команды тратят 11 часов в неделю на проблемы с подключением к облаку
По данным Computer Weekly, исследователи обнаружили, что предприятия тратят больше времени на устранение неполадок с подключением к облаку из‑за возросшей нагрузки на системы искусственного интеллекта. Суммарно на эти процессы может уходить до 11 часов в неделю.
Мессенджер на своем сервере. Что это значит?
За последние несколько лет on-premise решения стали одним из основных направлений развития корпоративных коммуникаций. Причины понятны: требования информационной безопасности, контроль над данными и независимость от внешних сервисов.
65 бесплатных уроков июля: от LLM и RAG до Kubernetes, Go и QA
В июле пройдут 65 бесплатных демо-уроков по основным IT-направлениям: от разработки, архитектуры и инфраструктуры до ML, тестирования, аналитики и управления. В программе много тем, которые сейчас регулярно всплывают в рабочих обсуждениях: LLM-приложения, RAG, AI-агенты, Kubernetes, Go, Java, C++, QA-метрики, сети ЦОД и безопасность LLM-систем.Уроки ведут преподаватели курсов OTUS — практикующие специалисты, которые разбирают инструменты и подходы на прикладных задачах. Это удобный способ свериться с тем, что происходит в индустрии, задать вопросы экспертам и посмотреть, как устроено обучение на конкретном направлении.
ML для больших компаний: от DevBox до платформы на тысячу пользователей
Привет, Хабр! Меня зовут Антон Алексеев, я MLOps-инженер в Авито. В статье расскажу, как мы строим ML-платформу на базе Kubeflow. От первых DevBox-решений мы пришли к набору небольших юнит-платформ, которые разные команды развивали под свои бизнес-задачи и связывали между собой. Со временем возникла задача объединить эти решения в единую платформу. Поделюсь, как мы это делали, с какими проблемами столкнулись и как их решили. И немного о том, как должны выглядеть агентские платформы, когда за управление инфраструктурой отвечают агенты.
«Взрыв поверхности» или «вертикальный срез»: какой подход выбрать при построении MLOps-платформы?
Привет, Хабр! Меня зовут Кирилл Кулаков, я занимаюсь развитием MLOps-платформы в Uzum Fintech.Недавно у нас в команде разгорелся спор о том, как правильно разворачивать платформы. Причем разгорелся он уже после того, как мы совместно всё спроектировали, двигались какое-то время в одном инфополе, и я уже развернул довольно большую часть.И тут коллеги начали задавать вопросы «Почему мы не разворачиваем каждый компонент последовательно, настраивая все досконально?». Для меня это звучало как: «Ты сделал неправильно, сейчас будем разбирать твою работу и от половины откажемся».

