Big Data.

Тестирование СУБД с использованием tpc-ds и методы сравнительного анализа

Когда мы начали искать альтернативы Greenplum, у руководителя уже был явный фаворит StarRocks. Но мне было непонятно, как доказать, что он действительно лучше других кандидатов, а не просто производит хорошее первое впечатление.Полгода я и несколько коллег собирали информацию о разных аналитических СУБД. StarRocks был кандидатом с самого начала, остальные находили по ходу работы. Поднимали системы, запускали бенчмарки, читали документацию, смотрели на настройки и пытались понять, с чем потом придётся жить.

продолжить чтение

Как я встроил AI‑агента прямо в интерфейс Apache Superset и не сломал ему CSP

Есть Apache Superset. Есть аналитик, который открывает SQL Lab и десять минут вспоминает, как называется таблица с заказами — orders, olist_orders или fact_orders_v2. Есть языковые модели, которые отлично пишут SQL, но понятия не имеют, что лежит в вашем хранилище.Задача звучала просто: добавить в интерфейс Superset кнопку, по которой открывается чат с моделью. Причём агент должен работать по принципу MCP — не фантазировать имена колонок, а сходить и посмотреть их в метаданных. Подключаться к любому OpenAI‑совместимому API: локальная Ollama, llm7, OpenAI — что угодно.

продолжить чтение

MF Spark Camp: Как мы превращаем сухие алгоритмы в живой интеллект и собираем команду у костра

Когда: 29 июля 2026Формат: Лекции + Квиз + Нетворкинг у костра

продолжить чтение

Качество образования в бакалавриате Центрального университета

ПредисловиеПривет! Меня зовут Денис. Летом 2026 года я перехожу на третий курс бакалавриата ЦУ. Я один из тех, кто на протяжении всего обучения брал больше всего курсов и закрывал их, стараясь получить максимальные оценки, поэтому считаю, что могу дать по ним объективный фидбэк. После первого курса я уже писал подобную статью про ЦУ, но она получилась слишком общей, поэтому здесь я сконцентрируюсь на качестве преподавания.

продолжить чтение

AI-дайджест #2

Привет, Хабр! Я, Ольга Попова, ИИ-Евангелист Лаборатории искусственного интеллекта Департамента больших данных Россельхозбанка, подготовила дайджест новостей про ИИ. Поехали!ИИ в России● «Сбер» представил аудиоавтоэнкодер KVAE-Audio (GitHub)● «Яндекс»

продолжить чтение

ИИ против авторского права: можно ли обучаться на чужом творчестве?

В России обсуждают законопроект об искусственном интеллекте и один из самых спорных пунктов касается авторских прав.Сейчас в российском праве по общему правилу у автора или правообладателя есть исключительное право на произведение. Если кто-то хочет использовать книгу, музыку, изображение, фотографию, текст или ПО, обычно нужно согласие правообладателя, если нет специального исключения в законе.

продолжить чтение

GlowByte укрепила позицию в топ-3 поставщиков решений для анализа данных

Источник изображения: Magnific.com

продолжить чтение

Databricks Data and AI Summit 2026. Моя первая поездка в США

Недавно мне удалось посетить Databricks Data + AI Summit в Сан-Франциско в качестве Databricks MVP. Крупнейшую конференцию Databricks, посвященную данным, искусственному интеллекту. На мероприятии собралось более 30 000 участников из более чем 160 стран.Я много слышал и читал об этом саммите, но никогда не мог представить, что попаду на него вживую.

продолжить чтение

GitHub стал однообразнее после появления ChatGPT?

После появления ChatGPT и массового распространения GitHub Copilot, Cursor, Claude Code, Windsurf и других AI-инструментов разработка стала заметно быстрее. Код, тесты, README, комментарии и небольшие utility-функции теперь можно получить за секунды. Но вместе с этим появился менее очевидный вопрос: если миллионы разработчиков используют похожие модели и похожие промпты, не становится ли открытый код более однообразным?В этой статье я проверяю эту гипотезу на данных GitHub за 2019-2025 годы. В качестве основного источника используется GH Archive через BigQuery: это публичный архив событий GitHub, где можно анализировать PushEvent, PullRequestEvent, CreateEvent, 

продолжить чтение

Шаг вперёд на долгом пути: завершили этап «Сканирование» конкурса «Экспедиция. Data Science»

Фонд Национальной технологической инициативы реализует проект технологических конкурсов Up Great — открытых соревнований для инженерных команд. Здесь преодолевают технологические барьеры России и мира, чтобы решать задачи, с которыми ещё никто не справлялся.

продолжить чтение

123456...1020...31