Big Data. - страница 4

GlowByte укрепила позицию в топ-3 поставщиков решений для анализа данных

Источник изображения: Magnific.com

продолжить чтение

Databricks Data and AI Summit 2026. Моя первая поездка в США

Недавно мне удалось посетить Databricks Data + AI Summit в Сан-Франциско в качестве Databricks MVP. Крупнейшую конференцию Databricks, посвященную данным, искусственному интеллекту. На мероприятии собралось более 30 000 участников из более чем 160 стран.Я много слышал и читал об этом саммите, но никогда не мог представить, что попаду на него вживую.

продолжить чтение

GitHub стал однообразнее после появления ChatGPT?

После появления ChatGPT и массового распространения GitHub Copilot, Cursor, Claude Code, Windsurf и других AI-инструментов разработка стала заметно быстрее. Код, тесты, README, комментарии и небольшие utility-функции теперь можно получить за секунды. Но вместе с этим появился менее очевидный вопрос: если миллионы разработчиков используют похожие модели и похожие промпты, не становится ли открытый код более однообразным?В этой статье я проверяю эту гипотезу на данных GitHub за 2019-2025 годы. В качестве основного источника используется GH Archive через BigQuery: это публичный архив событий GitHub, где можно анализировать PushEvent, PullRequestEvent, CreateEvent, 

продолжить чтение

Шаг вперёд на долгом пути: завершили этап «Сканирование» конкурса «Экспедиция. Data Science»

Фонд Национальной технологической инициативы реализует проект технологических конкурсов Up Great — открытых соревнований для инженерных команд. Здесь преодолевают технологические барьеры России и мира, чтобы решать задачи, с которыми ещё никто не справлялся.

продолжить чтение

Как дать ИИ-агенту работать с данными и не потерять контроль: безопасный data-join через MCP, вместо создания DataLake

Это продолжение новых безопасных паттернов по работе с MCP, которые я для себя придумал, которые я описал в статье:Как дать ИИ-агенту доступ к проду и не поседеть: безопасный production-дебаг через MCPВсем привет! Хотел поделится интересным паттерном взаимодействия, который удалось выстроить и он дов...habr.comИнтересно будет услышать ваше мнение.

продолжить чтение

Внедрили AI-агента в BI-систему — чистая магия в обработке и визуализации терабайтов данных

Привет, это команда Далее. На одном из проектов у нас есть терабайты данных о рекламных кампаниях, которые хранятся на десятках площадок. Это множество таблиц, агрегаций, расчетных метрик и формул.Big Data обрабатывают аналитики и дата-инженеры: приводят в нормальный вид, следят за качеством, рассчитывают дополнительные метрики. В конце концов, все приходит в BI-систему, где менеджеры делают отчеты и визуализируют информацию на дашбордах.

продолжить чтение

Data Mesh: что это и почему концепция не подходит большинству компаний в России

Объем и разнообразие корпоративных данных значительно возрастает с каждым годом. Вместе с этим появляются новые требования к их хранению, обработке и использованию.Развиваются различные подходы к архитектуре и управлению данными:Data Warehouse (DWH) для централизованной аналитики Data Lake для хранения больших объемов разнородной информации Data Lakehouse как объединение преимущества обоих подходов Data Fabric для интеграции распределенных источников данных  Data Mesh — концепция, предлагающая передать ответственность за данные непосредственно бизнес-доменам 

продолжить чтение

БИМ vs видеоаналитика: что внедряется на стройке в 2026 году?

Привет! С вами QMonitoring — инновационная платформа для мониторинга строительных работ. Мы занимаемся внедрением видеомониторинга на стройках и на практике видим, что между красивыми презентациями BIM и реальностью на площадке лежит огромная пропасть. Давайте разберем, почему так происходит и какие инструменты реально работают в 2026 годуBIM: обещание и реальность

продолжить чтение

VK и МФТИ открыли набор на магистерскую программу «Искусственный интеллект и социальные медиа»

Платформа VK Education и Физтех‑школа прикладной математики и информатики МФТИ запускают магистерскую программу «Искусственный интеллект и социальные медиа». Обучение направлено на подготовку специалистов по анализу данных и разработке интеллектуальных систем. Подать заявку можно до 8 июля 2026 года. Подробности о программе и этапах отбора доступны на сайте.

продолжить чтение

Когда компании пора строить свой LLM-кластер, а не пользоваться внешними API

На раннем этапе внедрения LLM в компании выглядят как быстрый выигрыш: подключается внешний API (например, ChatGPT), ускоряется работа с текстами, автоматизируются ответы, появляются первые сценарии аналитики и агентных пайплайнов через Make или n8n.До определённого масштаба этого достаточно.По мере роста компании LLM перестаёт быть вспомогательным инструментом и становится частью операционных процессов. В системе появляются чувствительные данные, требования к контролю доступа, необходимость стабильной работы, интеграции во внутренние сервисы и вопросы экономики при больших объёмах запросов.

продолжить чтение

1...234567...2030...34