BrainTools - Методики для развития мозга - страница 128

Учим небольшую LLM с нуля: гибридное внимание, XSA, доменные бленды и загадки роста онлайн-бенчмарков

Обучение LLM — это в первую очередь инфраструктурная задача: нужен пайплайн, который можно перезапускать с новыми данными, архитектурой или другим расписанием обучения и получать повторяемый внутри команды результат. В этом материале — рассказ команды обучения и инференса моделей RWB о том, как мы с нуля, без загрузки pretrained-весов, обучили текстовую модель на основе гибридной архитектуры Qwen3.5-2B-Base и какие выводы сделали по пути — от сборки датасетов до чтения графиков онлайн-оценки.Кратко о результатах:

продолжить чтение

Как полезная идея дофаминового голодания превратилась в цифровой аскетизм

Не так давно мы выяснили, что СДВГ (скорее всего) не виноват в том, что тебе тяжело сосредоточиться. Может быть, виновата тогда эпидемия дешёвого дофамина? Сегодня продолжаем поиски потерянного внимания и говорим о «дофаминовом голодании».

продолжить чтение

В Малайзии разрабатывают охлаждающую жидкость на основе пальмового масла для иммерсионных систем

Государственное агентство Малайзии MPOB (Malaysian Palm Oil Board) находится на завершающем этапе разработки охлаждающей жидкости на основе пальмового масла под названием Sawit EcoTherm для иммерсионных систем охлаждения. В ведомстве считают, что использование этой жидкости позволит снизить потребление воды и энергии в центрах обработки данных страны.

продолжить чтение

Сравниваем LLM, 12 тестов для китайских флагманов: Kimi K3, GLM-5.2, DeepSeek V4 Pro и Qwen 3.8 Max

В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro, в третьей спустились в средний класс и столкнули три поколения Sonnet с GigaChat 2 MAX и YandexGPT Pro 5.1. Закончили мы прошлый материал прямым вопросом: хотите ли увидеть в следующей части DeepSeek и Qwen? Запрос в комментариях мы услышали, так что сегодня на ринге Китай.

продолжить чтение

Биомеханика против дипфейка: почему волосы не лгут

продолжить чтение

Что изучить во второй половине августа: 39 открытых уроков для IT‑специалистов

Привет, хабровчане!На вторую половину августа у OTUS запланировано почти четыре десятка открытых вебинаров для специалистов из разных областей IT. В подборке — разработка на Python, Go, Java, C# и JavaScript, Linux и сети, архитектура, системный анализ, тестирование, DevSecOps, машинное обучение, компьютерное зрение и работа с ИИ-инструментами.Темы подобраны с упором на практику: разберём asyncio и Kafka, масштабирование PostgreSQL, отказоустойчивую инфраструктуру, паттерны системного дизайна, локальные AI-модели и другие задачи, с которыми приходится сталкиваться в реальных проектах.

продолжить чтение

Патент в сфере ИТ: новый этап в развитии технологий или устаревшая формальность?

Привет, Хабр! На связи патентный поверенный UserGate Александр Киселев.

продолжить чтение

Какие профессии создал ИИ: разбор с цифрами

Всем привет! Я Ольга Матушевич, преподаватель курса «Нейросети для бизнеса», а в прошлом наставница на курсе «Аналитик данных»

продолжить чтение

Loop Engineering: почему цикл легко собрать и трудно остановить

Попробуйте такой бытовой фокус: вместо того чтобы скинуть кодинг-агенту задачу напрямую, попросите его сначала написать промпт под эту задачу, а потом скормите этот промпт ему же. Часто результат выходит лучше исходной формулировки.

продолжить чтение

Гендиректор Anthropic: негативная реакция на ИИ — это «кризис доверия»

Генеральный директор Anthropic Дарио Амодеи недавно опроверг предположение о том, что он рисует чрезмерно пессимистичную картину искусственного интеллекта и того, как технология может повлиять на будущее.

продолжить чтение