Copilot сможет видеть экран, понимать голосовые команды и выполнять действия на ПК за пользователя
Microsoft объявила
RL (RLM): Разбираемся вместе
Всем привет! Недавно я познакомился с курсом по глубокому обучению с подкреплением от HuggingFace Deep Reinforcement Learning Course и захотел сделать выжимку самого интересного. Эта статья — своего рода шпаргалка по основам Reinforcement Learning (RL) и одному из ключевых алгоритмов — PPO, который лежит в основе тонкой настройки современных LLM (Large Language Models).Вы наверняка слышали про такие модели, как o1 от OpenAI или QwQ от Alibaba. Их "рассуждающие" способности во многом — результат применения RL. Давайте разберемся, как обычный принцип обучения, известный по играм вроде AlphaGo, помогает языковым моделям стать умнее.
Разработка приложения в Replit: сколько стоит и кому подходит
В этой статье я поделюсь своим опытом разработки в Replit - AI-тулзе для так называемого вайбкодинга. Расскажу, кому стоит пробовать эту платформу, и дам несколько советов, которые упростят вам разработку и сэкономят много денег и нервов.
Фрилансеры Turing Labs носят на голове GoPro для обучения ИИ
Фрилансеры компании в сфере искусственного интеллекта Turing Labs носят на голове GoPro, выполняют творческую работу и повседневные дела для обучения моделей компьютерного зрения. Отснятый материал синхронизировали, чтобы система могла получить разные ракурсы одного и того же действия. Каждый день камеры работали в течение пяти часов.
Авторы подали в суд на Salesforce из-за использования книг в обучении ИИ
16 октября компания Salesforce, занимающаяся облачными вычислениями (CRM.N), стала ответчиком по иску двух авторов, которые утверждают, что компания нарушила авторские права, использовав их работы для обучения своих моделей искусственного интеллекта xGen.
Хидео Кодзима назвал ИИ «другом», а не угрозой творчеству в разработке игр
В интервью Wired Japan Хидео Кодзима назвал искусственный интеллект «другом», готовым к сотрудничеству, а не угрозой. Он утверждает, что ИИ должен справляться с трудоёмкими задачами, такими как анимация, захват движения и поведение NPC, чтобы люди-разработчики могли сохранить творческое лидерство.
Google предоставила разработчикам в API Gemini данные из «Карт»
Google открыла для разработчиков данные Google Maps в API Gemini для приложений с актуальными геопространственными данными. Это позволит связывать возможности ИИ в области логического мышления с данными из более чем 250 млн мест.
Внутри vLLM: Анатомия системы инференса LLM с высокой пропускной способностью
Привет! Этот пост — перевод очень хардовой статьи про внутренности vLLM и того, как устроен инференс LLM. Переводить было сложно из-за англицизмов и отсутствия устоявшегося перевода многих терминов, но это слишком классная статья, и она обязана быть на русском языке! А дальше — слово автору:От paged attention, непрерывного батчинга, кэширования префиксов , specdec и т.д. — до мульти-GPU и мультинодового динамического сервинга LLM под нагрузкой.

