Big Data. - страница 3

TabFM против XGBoost: 5 фактов, которых нет в релизе

Всем привет, меня зовут Сергей Прощаев и в этой статье расскажу про то, что произошло с табличными данными летом 2026 года: появилась модель, которая делает предсказание по таблице вообще без обучения, и первые же замеры показали, что она обходит настроенный

продолжить чтение

AI-дайджест #3

Друзья, всем привет! На связи Ольга Попова, ИИ-Евангелист Лаборатории искусственного интеллекта Департамента больших данных Россельхозбанка. Я подготовила новый дайджест новостей про ИИ. Поехали! 🇷🇺 РОССИЯ● Президент России подписал

продолжить чтение

Книга: «Современная бизнес-аналитика. Увеличьте ценность данных с помощью Python и R»

Привет, Хаброжители!

продолжить чтение

AI-хакатон в GlowByte: как мы решали задачи для вымышленной розничной сети «МегаБайт»

Всем привет! На связи команда BI-практики GlowByte.

продолжить чтение

Тестирование СУБД с использованием tpc-ds и методы сравнительного анализа

Когда мы начали искать альтернативы Greenplum, у руководителя уже был явный фаворит StarRocks. Но мне было непонятно, как доказать, что он действительно лучше других кандидатов, а не просто производит хорошее первое впечатление.Полгода я и несколько коллег собирали информацию о разных аналитических СУБД. StarRocks был кандидатом с самого начала, остальные находили по ходу работы. Поднимали системы, запускали бенчмарки, читали документацию, смотрели на настройки и пытались понять, с чем потом придётся жить.

продолжить чтение

Как я встроил AI‑агента прямо в интерфейс Apache Superset и не сломал ему CSP

Есть Apache Superset. Есть аналитик, который открывает SQL Lab и десять минут вспоминает, как называется таблица с заказами — orders, olist_orders или fact_orders_v2. Есть языковые модели, которые отлично пишут SQL, но понятия не имеют, что лежит в вашем хранилище.Задача звучала просто: добавить в интерфейс Superset кнопку, по которой открывается чат с моделью. Причём агент должен работать по принципу MCP — не фантазировать имена колонок, а сходить и посмотреть их в метаданных. Подключаться к любому OpenAI‑совместимому API: локальная Ollama, llm7, OpenAI — что угодно.

продолжить чтение

MF Spark Camp: Как мы превращаем сухие алгоритмы в живой интеллект и собираем команду у костра

Когда: 29 июля 2026Формат: Лекции + Квиз + Нетворкинг у костра

продолжить чтение

Качество образования в бакалавриате Центрального университета

ПредисловиеПривет! Меня зовут Денис. Летом 2026 года я перехожу на третий курс бакалавриата ЦУ. Я один из тех, кто на протяжении всего обучения брал больше всего курсов и закрывал их, стараясь получить максимальные оценки, поэтому считаю, что могу дать по ним объективный фидбэк. После первого курса я уже писал подобную статью про ЦУ, но она получилась слишком общей, поэтому здесь я сконцентрируюсь на качестве преподавания.

продолжить чтение

AI-дайджест #2

Привет, Хабр! Я, Ольга Попова, ИИ-Евангелист Лаборатории искусственного интеллекта Департамента больших данных Россельхозбанка, подготовила дайджест новостей про ИИ. Поехали!ИИ в России● «Сбер» представил аудиоавтоэнкодер KVAE-Audio (GitHub)● «Яндекс»

продолжить чтение

ИИ против авторского права: можно ли обучаться на чужом творчестве?

В России обсуждают законопроект об искусственном интеллекте и один из самых спорных пунктов касается авторских прав.Сейчас в российском праве по общему правилу у автора или правообладателя есть исключительное право на произведение. Если кто-то хочет использовать книгу, музыку, изображение, фотографию, текст или ПО, обычно нужно согласие правообладателя, если нет специального исключения в законе.

продолжить чтение