Что в работе аналитика поменялось за пять лет, а что только в вакансиях
Я пришла в аналитику в 2020 году, шесть лет в профессии, и среди прочего проверяю работы тех, кто учится на аналитика сейчас. Так что у меня перед глазами оба конца отрезка: и с чего начинала я, и с чем приходит новый поток, который я вижу каждую неделю десятками.И вот что не сходится: если открыть вакансии аналитика в 2026 и почитать требования, кажется, что профессия сменилась целиком: везде ML, LLM, дата-инженерия, облака, а SQL с Excel идут как что-то само собой разумеющееся, будто это уже даже не навык, а воздух. Человек, который вкатывается сейчас, читает это и решает, что опоздал на пять лет и учить надо всё и сразу.
Чемпионат среди uplift-моделей: групповой этап, плей-офф и неожиданный лидер
Привет! Меня зовут Гриша Крюков, я аналитик в команде доверия и безопасности Авито. Я провёл чемпионат среди четырёх популярных моделей для оценки индивидуальных эффектов: S-learner, T-learner, X-learner и Causal Forest. В статье расскажу, как проходили испытания и какая из моделей забрала золото после всех испытаний. Материал будет полезен тем, кто интересуется uplift-моделированием: новичкам, чтобы узнать об этом методе, профессионалам — посмотреть на сравнение моделей в формате турнира. Не каждый же день такое устраивают!
Внедрили AI-агента в BI-систему — чистая магия в обработке и визуализации терабайтов данных
Привет, это команда Далее. На одном из проектов у нас есть терабайты данных о рекламных кампаниях, которые хранятся на десятках площадок. Это множество таблиц, агрегаций, расчетных метрик и формул.Big Data обрабатывают аналитики и дата-инженеры: приводят в нормальный вид, следят за качеством, рассчитывают дополнительные метрики. В конце концов, все приходит в BI-систему, где менеджеры делают отчеты и визуализируют информацию на дашбордах.
Ускоряем и оптимизируем numpy, pandas, scipy и sklearn
С момента публикации статьи на Хабре «Импортозамещаем numpy, pandas, scipy и sklearn» прошло почти три года. В течение этого времени я приостановил работу над проектом из-за нехватки времени, ресурсов и сил. К тому же, меня расстроило, что не смог выполнить просьбу пользователя @N-Cube, который активно интересовался моей библиотекой и хотел ускорить работу своего Jupyter Notebook.
Почему ваша HR-аналитика бесполезна и как научиться задавать вопросы, спасающие бюджет
Всем привет!Меня зовут Прокопович Наталья, я руковожу направлением зарплатной аналитики в Сбере и работаю на стыке HR, данных и бизнеса. Также являюсь амбассадором исследовательских подходов в people analytics. Еще преподаю в МГИМО и пишу о том, как превращать данные в практические решения для бизнеса. Сегодня поговорим о базе вопросах, с которыми к нам приходят.
Метрики упали в лужу
Нередкая ситуация, когда ваша модель спокойно себе крутится в проме, но внезапно прибегают аналитики с криками «у нас упало качество, посмотрите что может быть не так».Причин может быть множество, но сегодня я расскажу про одну из самых распространенных причин падения качества модели - Distribution shift.
Обзор книг аналитика данных
Привет! Меня зовут Таня, я аналитик данных и люблю бумажный формат книг (если есть сомнения, сначала пробую электронную версию, но если книга заходит всегда беру бумажную версию). В этой статье честный обзор без рекламы, тех книг, которые я купила не так давно в бумажном формате.Что в моем списке«Математика для Data Science» «Алгоритмы и структуры данных» Миядзаки «Прикладные структуры данных и алгоритмы» Венгроу «Грокаем алгоритмы искусственного интеллекта»

