Почему нельзя идеально оптимизировать светофоры: дело не в алгоритмах
Каждый айтишник, который хоть раз стоял «на красном» на пустом перекрестке в три часа ночи, думал одно и то же: «Да я бы это за выходные пофиксил».
Мотивация разработчиков: чек-лист для тимлида
Привет! Я Александр Субботин, руководитель отдела разработки Content AI.За четыре года в этой роли я провел больше 50 собеседований, собрал 8 команд и несколько раз разруливал ситуации, когда топ-менеджмент считал, что команда демотивирована и с этим надо что-то сделать.Спойлер: в 90% случаев проблема была не в мотивации.В этой статье я собрал кейсы из практики по мотивации на всех этапах и один простой вопрос, который изменил мой подход к управлению командой.
Почему мы не написали ещё один Bad CaRMa
«Bad CaRMa» — глава из Dreaming in Code Скотта Розенберга (каламбур на CRM и «карму») про CRM-систему Vision в компании Upstart. Архитектор задумал предельно гибкую схему: одна-единственная таблица DATA, куда сложили все 150+ бизнес-сущностей — 240+ колонок с именами вроде string82 и numeric31, метаданные и данные вперемешку. Схему ведь больше «никогда не придётся менять».
Reasoning-модели нужно измерять по-новому. Представляем публичный лидерборд MERA Reason
За последний год в мире больших языковых моделей произошел заметный сдвиг. Если раньше основным предметом соревнования были знания модели — насколько хорошо она отвечает на вопросы (общие или специальные), знает факты или пишет код, — то со временем фокус сместился на способность рассуждать.Практически каждый крупный релиз последних месяцев позиционируется как reasoning-модель. Производители говорят уже не столько о знаниях, сколько о способности строить длинные цепочки рассуждений, решать сложные задачи и принимать решения в условиях неопределенности.Но вместе с этим возникает закономерный вопрос:
Большой разбор Physical AI: VLA-модели, гуманоиды, гонка Китая и США и что есть у России. Часть 1
Сколько времени вам, человеку, нужно, чтобы сложить футболку? Секунд пять, если аккуратно и секунд десять, если прям вообще аккуратно.А теперь другой вопрос. Как вы думаете, сколько лет понадобилось мировой робототехнике, чтобы робот сложил ту же футболку сам — без жестко прописанной программы, без специальной оснастки, просто взяв мятую тряпку из корзины?Отвечаю: примерно шестьдесят. Первый промышленный робот встал на конвейер General Motors в 1961 году, а уверенно складывающего белье робота впервые показали осенью 2024-го. И это, честно говоря, было событием покрупнее многих громких презентаций.
Oracle подписала с Пентагоном 10-летний контракт на ПО стоимостью до $7 млрд
Пентагон объявил о заключении контракта с Oracle на сумму почти $7 млрд сроком в 10 лет. Он предусматривает использование программного обеспечения компании в локальных центрах обработки данных для подразделений вооружённых сил, разведывательного сообщества США и Береговой охраны.
Patreon уволит 20% сотрудников
Генеральный директор Patreon Джек Конте сообщил сотрудникам, что компания увольняет 20% своего персонала, или 93 человека. Он заявил, что основной бизнес Patreon силён, но платформе необходимо реагировать на изменения рынка и корректировать свою структуру затрат, чтобы оставаться стабильной.
Своя GPT-like LLM по WH40K с нуля. Часть 4: Дообучение на вопрос–ответ (SFT)
Привет, Хабр! Меня зовут Владимир, и это четвёртая часть цикла статей по написанию и обучению небольшой decoder-only LLM с нуля. В третьей части мы собрали LinguaLaboratoriumMechanicus, обучили base-модель на корпусе данных по Warhammer 40K и получили модель, которая умеет продолжать текст. Данная статья целиком посвящена этапу SFT - дообучению на датасете “вопрос - ответ”, чтобы модель могла вести диалог с пользователем, а не просто дописывать за него фразы.Содержание циклаПодготовка и токенизация данныхТрансформер
