обучение моделей.

Как научить криптосканер не врать самому себе: ML‑часть AltScanner

Большинство рассказов о машинном обучении в трейдинге начинаются с модели. Берут свечи, добавляют индикаторы, запускают обучение и получают красивую кривую. Проблема обычно появляется раньше. В выборку могла попасть незакрытая свеча, пропуск мог превратиться в нарисованную цену, а соседние сделки могли использовать один и тот же участок будущего рынка.В AltScanner мы пошли с другого конца. Сначала система научилась фиксировать состояние рынка так, чтобы его можно было воспроизвести. Затем появился механизм отложенной разметки. И только после этого мы добавили простую интерпретируемую модель.

продолжить чтение

ML‑датасет для Data Scientist: практический гайд по проверке качества данных перед обучением модели

Всем привет, меня зовут Сергей Прощаев, я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E‑commerce и преподаю на курсах разработки и архитектуры в ОТУС.В этой статье расскажу про восемь проверок датасета, которые нужно прогнать до того, как кто‑то в команде напишет model.fit().Пятница, релиз

продолжить чтение

LLM и психолингвистика: HELPER

Привет, Хабр! На связи Александр Сабко, Виктория Белявская и Сергей Павлухин, из мастерской по прикладному ИИ Инженерно-математической школы НИУ ВШЭ и VK.

продолжить чтение

Как шахматный подход помог разобраться с фотолентой Яндекс Диска

продолжить чтение

Окей, Lamoda, что надеть на вечеринку? Как обучить LLM навыкам ИИ-стилиста

Как объяснить алгоритму, что кожаная куртка и очки героя мемов Джейсона Стетхема — это не просто одежда, а часть стиля? Классические поисковые системы хорошо работают с запросами, в которых указаны категории и атрибуты товаров, но не «чувствуют» дополнительный fashion-контекст. А это ключевая способность эксперта по моде — понять каждого своего клиента и собрать ему подходящий лук даже для самого оригинального кейса. 

продолжить чтение

Трудности перевода: почему LLM не умеют писать нормальные докстринги на русском и как это исправить

продолжить чтение

Selectel представил AI-Сервер с поддержкой до 16 GPU

Российский провайдер облачной инфраструктуры Selectel анонсировал

продолжить чтение

Как мы собрали русскоязычный датасет олимпиадной математики (и зачем это нужно AI)

Математические исследования всё чаще используют методы ИИ для анализа сложных задач, генерации решений и предоставления персонализированного обучения. Однако эффективность таких моделей напрямую зависит от качества и структуры данных, на которых они обучаются. Несмотря на обилие математических текстов в интернете, существует заметный дефицит крупных, размеченных и многоязычных датасетов, специально ориентированных на олимпиадную математику. В частности, для русскоязычных моделей остро не хватает материалов, сочетающих в себе авторитетность источника, сложность содержания и лингвистическое разнообразие.

продолжить чтение

AI-агенты, MAS, безопасность, кодинг-ассистенты, LLM и DSLM — 40+ докладов про genAI на Conversations

Конференция по генеративному и разговорному AI Conversations возвращается в Санкт-Петербург! 2 дня, 4 трека, 65+ спикеров, 700+ участников, 300+ компаний, а еще нетворкинг и вечеринка – и все про AI. Встречаемся 25 и 26 июня в отеле AirportCity Plaza (а также онлайн).

продолжить чтение

Adobe разрешила дообучать модели на пользовательских данных

Adobe объявила о запуске настраиваемых ИИ-генераторов изображений, которые могут имитировать определённые художественные стили и дизайны персонажей. Модели Firefly Custom Models стали доступны в рамках публичного бета-тестирования, благодаря чему творческие люди и компании могут обучить ИИ-модели на собственных работах. За счёт этого генерируемые изображения будут соответствовать единой эстетике персонажей, иллюстраций и фотографий.

продолжить чтение