CTO Oracle предложил обучить нейросетевого «большого брата» на данных граждан, включая их ДНК
На Всемирном правительственном саммите (World Governments Summit, WGS) технический директор компании Oracle Ларри Эллисон предложил руководителям стран обучать специальные нейросети на всех национальных данных, к которым только можно получить доступ. Он считает, что это поможет управлять страной, снизить преступность, повысить урожайность и лечить граждан.
Как устроены алгоритмы онлайн-кинотеатра. Разбираем на примере
Вы приходите домой и включаете любимый стриминг. Лента сразу же выдаёт вам несколько фильмов и сериалов, которые… действительно хочется смотреть. Сегодня разберём, как именно рождается эта магия вне Хогвартса, и что сидит под капотом рекомендательного движка онлайн-кинотеатра.
Anthropic готовит новую гибридную модель Claude, превосходящую o3-mini-high в кодинге
Как сообщает The Information, Anthropic планирует представить свою следующую крупную модель, которая сочетает традиционные языковые возможности с продвинутыми функциями логического анализа.
ByteDance представила ИИ-модель для генерации видео Goku. Наступает эра фейковых блогеров
ByteDance представила ИИ-модель для генерации видео Goku. Наступает эра фейковых блогеровСогласитесь ли вы со мной, если я скажу, что наступает эра фейковых блогеров?По правде говоря, она уже наступила.
Искусственный интеллект без угодливости: OpenAI обновляет спецификацию ChatGPT
OpenAI выпускает значительно расширенную версию Model Spec — документа, определяющего, как должны вести себя модели AI.OpenAI значительно обновила свою спецификацию модели, расширив документ, в котором описывается, как должны вести себя ее модели AI с момента ее первоначального выпуска в мае 2024 года. Новые 63-страничные руководящие принципы сосредоточены на трех основных принципах: настраиваемость, прозрачность и интеллектуальная свобода.
Как жидкостный искусственный интеллект конкурирует с трансформерными моделями
Привет, на связи Юлия Рогозина, аналитик бизнес-процессов Шерпа Роботикс. Сегодня я перевела для вас статью о том, что стартап под названием Liquid AI утверждает, что модели на основе Liquid Foundational Models (M) превосходят модели на основе трансформеров, ставшие знаменитыми благодаря ChatGPT.
LIMO: Меньше — значит больше для рассуждающих LLM
Мизерный объем задач с ответами может разбудить спящего LLM-льва..."Мы представляем фундаментальное открытие, которое бросает вызов нашему пониманию того, как сложные рассуждения возникают в больших языковых моделях"
Как научить модель рассуждать, не переобучая её, меньше чем за 10$
ВведениеЭто статья обобщение моего исследования передачи знаний от большой модели с замороженными весами в малую модель, которую мы будем обучать через расширенный механизм кросс внимания или проще говоря через LLM модули. Оригинальное исследование доступно по ссылке: arxiv.org/abs/2502.08213 . Репозиторий с кодом и весами доступен на Hugging Face: LLM модули.

