Как мы мигрировали с MongoDB на Cassandra за квартал: опыт использования АI-агентов
Что делать, если критически важное хранилище с миллиардами записей требует слишком много дорогого железа, а на миграцию силами инженеров уйдет целый год? Меня зовут Александр Моргунов, я инженер Авито, в этой статье я расскажу как мы провели эту миграцию всего за один квартал силами одного архитектора, не написав руками ни одной строчки продакшн-кода, лишь с помощью ИИ-агентов.
Нода загружена на 40%, а поды стоят: как найти причину через PSI в Kubernetes
Привет, Хабр!Управление ресурсами в Kubernetes десять лет держалось на двух числах в манифесте. Request определял, куда планировщик поставит под и сколько ему достанется при драке за процессор. Limit ограничивал сверху. Оба числа выставлялись один раз, менялись только пересозданием пода, а проверить их правильность было нечем, кроме графиков утилизации.
Как проверить postmortem, подготовленный LLM. Разбираем инцидент Cloudflare
«Все сервисы восстановили в 14:30» выглядит как обычная строка хронологии. Но для инцидента Cloudflare, который мы разберём ниже, она неверна: к этому времени в значительной степени восстановился основной трафик, а полное восстановление наступило позже.Такое сокращение меняет оценку последствий сбоя. Команда рискует пропустить часть проблем и меры, которые помогли бы их устранить.Если вы поручаете большой языковой модели, LLM, подготовить postmortem, письменный разбор причин и последствий сбоя, результату нужна содержательная проверка. Разберём её на материале
ИИ-агенту запретили запись в CRM. Но CRM всё равно изменилась
ИИ-агенту запретили запись в CRM. Но CRM всё равно измениласьПочему ограничения на уровне модели ещё не означают, что вся AI-система работает в режиме read-only — и почему это важно перед production rollout, расширением полномочий агента и передачей решения клиенту.В первой статье я разбирал более узкий случай: человек одобряет одно действие, а downstream-workflow способен попытаться выполнить другое. Там вопрос был в целостности цепочки approval → execution.Здесь хочу посмотреть на ту же проблему шире. Если самой модели запрещена запись, означает ли это, что вся AI-система
От Excel к диалогу: как мы построили ИИ-помощника Эйру для управления портфелем из 100+ проектов
Меня зовут Сергей Иванов, я руковожу направлением цифровизации проектного управления.Мой профессиональный путь начался еще в то время, когда границы между ролями были гораздо менее выражены: разработчики сами формулировали требования и тестировали свои решения, аналитики нередко одновременно управляли проектами, а ИТ во многих компаниях воспринималось скорее как поддерживающая функция, чем как один из драйверов развития бизнеса.
Одиннадцать релизов за сутки: как мы чинили память ИИ-агента и что из этого вышло
Неделю назад я выложил skillmem — локальную память процедур для кодовых агентов. За прошедшие сутки вышло одиннадцать релизов: с 0.9.3 по 0.10.5. Не потому, что чесались руки, а потому что я сел проверять собственный продукт и нашёл в нём подряд одиннадцать вещей, которые надо было починить. Это пост про то, что именно, — почти каждый пункт переносится на любой инструмент, который живёт внутри цикла агента.Начало: 4083 сессии за суткиНачалось с безобидного вопроса: а всё ли у нас работает. Полез в лог хуков и увидел, что Stop-хук за день сработал 4083 раза
Новый стек, новые задачи, новые навыки: 42 бесплатных урока сентября
Новые инструменты появляются быстрее, чем успевают сформироваться привычные рабочие процессы: искусственный интеллект меняет подходы к разработке и аналитике, инфраструктура становится сложнее, а от специалистов ждут всё более глубокого понимания технологий.При этом часто возникает практический вопрос: что изучать дальше, чтобы решать более сложные задачи в работе? Как выбрать тему, которая поможет развиваться в текущей роли и подготовиться к следующему карьерному шагу?
«Уберу перед пушем» и другие способы потерять секреты. Чек-лист для самопроверки
TL;DR; Разбираем базовую, но от этого не менее болезненную тему: что такое секреты, почему разработчики с завидным упорством продолжают их коммитить, где таятся главные дыры и как один забытый токен может обернуться миллионными убытками для бизнеса.Всё тайное становится явным
Бэкап, из которого ни разу не восстанавливались — это не бэкап
Привет, Хабр! У резервного копирования есть свойство, которое отличает его от почти всего остального в инфраструктуре. Проверить, работает ли оно, можно ровно одним способом — восстановиться. Всё остальное проверяет что‑то другое.Ситуация тем неприятнее, что узнаёте вы об этом в единственный день, когда копия понадобилась. Поэтому в статье рассмотрим пять мест, где схема резервного копирования разваливается. Ноль в конце формулыНачну с главного, потому что остальные пять — его частные случаи.Правило 3-2-1 знают все:

