Когда технологии выглядят красиво: WiDS Meetup 2026 как новая форма тех‑событий
6 марта 2026 года в Санкт‑Петербурге пройдёт WiDS Meetup — событие, которое я организую уже третий год подряд. Это не конференция в классическом смысле и не «просто митап». Да, у нас есть праздничная рамка, но смысл не в ней. Для меня WiDS Meetup — попытка нащупать новую форму технологического события, где инженерная глубина и практическая ценность не спорят с эстетикой, а усиливают друг друга. Судя по тому, как растёт аудитория и качество разговоров, это работает.
Data-driven корова: как мы строим SaaS для геномной селекции и решаем проблемы «грязных» данных в агротехе
Вам когда-нибудь казалось, что современное ИТ — это в основном про перекладывание JSON-ов, покраску кнопок и борьбу за миллисекунды в банковских транзакциях? Недавно я наткнулся на статистику о том, сколько данных генерирует одна современная молочная ферма, и как я удивился, когда понял: большинство этих данных оседает в разрозненных Excel-таблицах, тетрадках зоотехников или, в лучшем случае, в древних локальных базах типа «СЕЛЭКС», которые не обновлялись годами.
Онлайн-оценка рекомендательных систем: метрики, которые говорят сейчас
Всем привет! Меня зовут Василий Калинин, я senior-аналитик в отделе ML-аналитики музыкального сервиса Звук. Про то, чем занимается наша команда, мы уже писали ранее (можно почитать
Машинное обучение для работы с текстами: подборка бесплатных курсов и материалов
Привет! Это Данила Ляпин, наставник курса «Специалист по Data Science». Собрал подборку материалов по обработке естественного языка — она охватывает путь от базовых концепций NLP до трансформеров и BERT. Все материалы бесплатны и проверены на практике. Главное — двигаться последовательно, не пропускать основы и обязательно практиковаться на реальных задачах.Сourse in Natural Language Processing, YSDA
Оптимизация маршрутов доставки заказов маркетплейса или как мы победили в E-CUP 2025
Хабр, привет! Недавно завершилось ML-соревнование E-CUP 2025. Наша команда из X5 Tech заняла первое место в треке «Логистика: автопланирование курьеров», где было нужно оптимизировать время, затрачиваемое курьерами на доставку 20 000 заказов. В статье расскажем про подходы, которые использовали для решения этой задачи. Посмотрим, во сколько раз можно сжать JSON с матрицей расстояний. Какой код мы использовали для быстрого решения задачи TSP с помощью LKH-3. Обсудим, на что обращать внимание при кластеризации заказов.Постановка задачи
Ред флаги, но не в тиндере: что важно понять data-специалисту ещё до оффера
Пятничный вечер, бар, шумные разговоры. Мы - компания из нескольких ML-инженеров, DE и DA из Сбера, Магнита, Озона и Альфа-Банка собрались не ради обсуждения задачек в JIRA. Разговор зашел о наболевшем: как найти своих людей и команду мечты? Обсудили зарплату и плюшки, удалёнку и офис, стартапы и зрелые продукты, переработки, карьерный рост и рабочую культуру. В статье - цитаты из обсуждения и обобщённые выводы. А в конце - список вопросов, которые стоит задать на собеседовании, чтобы не ошибиться с выбором и найти тех людей, с кем не страшно будет выкатить релиз в пятницу вечером.
Автоматизированные системы мониторинга моделей машинного обучения с помощью нашего open source фреймворка
Привет! Меня зовут Владимир Суворов, я Senior Data Scientist в Страховом Доме ВСК и core-разработчик нашей библиотеки машинного обучения OutBoxML. Ссылки на наш проект на
Покоряем гору временных рядов: делаем прогноз для 200+ рядов с библиотекой Etna
Я работаю дата-сайентистом 5 лет и до сих пор испытываю боль, когда нужно сделать MVP по временным рядам. Начиная с того, как построить несколько графиков одновременно без «слипшихся» меток по осям, заканчивая поиском подходящего метода очистки ряда от аномалий. И всё это венчает цикл по каждому ряду с бесконечным жонглированием данными между numpy, pandas, sklearn, yet_another_library.

