искусственный интеллект. - страница 1344

Anthropic готовит новую гибридную модель Claude, превосходящую o3-mini-high в кодинге

Как сообщает The Information, Anthropic планирует представить свою следующую крупную модель, которая сочетает традиционные языковые возможности с продвинутыми функциями логического анализа.

продолжить чтение

6 этапов автоматизации бизнеса: от Excel-таблиц до искусственного интеллекта

продолжить чтение

ByteDance представила ИИ-модель для генерации видео Goku. Наступает эра фейковых блогеров

ByteDance представила ИИ-модель для генерации видео Goku. Наступает эра фейковых блогеровСогласитесь ли вы со мной, если я скажу, что наступает эра фейковых блогеров?По правде говоря, она уже наступила.

продолжить чтение

Искусственный интеллект без угодливости: OpenAI обновляет спецификацию ChatGPT

OpenAI выпускает значительно расширенную версию Model Spec — документа, определяющего, как должны вести себя модели AI.OpenAI значительно обновила свою спецификацию модели, расширив документ, в котором описывается, как должны вести себя ее модели AI с момента ее первоначального выпуска в мае 2024 года. Новые 63-страничные руководящие принципы сосредоточены на трех основных принципах: настраиваемость, прозрачность и интеллектуальная свобода.

продолжить чтение

Как жидкостный искусственный интеллект конкурирует с трансформерными моделями

Привет, на связи Юлия Рогозина, аналитик бизнес-процессов Шерпа Роботикс. Сегодня я перевела для вас статью о том, что стартап под названием Liquid AI утверждает, что модели на основе Liquid Foundational Models (M) превосходят модели на основе трансформеров, ставшие знаменитыми благодаря ChatGPT.

продолжить чтение

LIMO: Меньше — значит больше для рассуждающих LLM

Мизерный объем задач с ответами может разбудить спящего LLM-льва..."Мы представляем фундаментальное открытие, которое бросает вызов нашему пониманию того, как сложные рассуждения возникают в больших языковых моделях"

продолжить чтение

Как научить модель рассуждать, не переобучая её, меньше чем за 10$

ВведениеЭто статья обобщение моего исследования передачи знаний от большой модели с замороженными весами в малую модель, которую мы будем обучать через расширенный механизм кросс внимания или проще говоря через LLM модули. Оригинальное исследование доступно по ссылке: arxiv.org/abs/2502.08213 . Репозиторий с кодом и весами доступен на Hugging Face: LLM модули.

продолжить чтение

Исследование AI выявило ключевые факторы, лежащие в основе долгосрочных способностей LLM к рассуждениям

Систематическое исследование раскрывает методы, с помощью которых генерируются длинные цепочки мыслей моделей рассуждений. Результаты дают практические советы по оптимизации стратегий обучения. Команда IN.AI вместе с исследователями из Университета Цинхуа и Университета Карнеги-Меллона составила карту того, как модели AI развивают свою способность работать с длинными цепочками мыслей. Их систематическое исследование использовало контролируемую тонкую настройку (SFT) и обучение с подкреплением (RL) для выявления ключевых факторов, лежащих в основе этой способности.

продолжить чтение

Меньше надзора, больше эффективности: AI модели обобщают данные сами

Исследование Гонконгского университета и Калифорнийского университета в Беркли показало, что языковые модели лучше обобщают, если им позволить самостоятельно находить решения. Это касается как больших языковых моделей

продолжить чтение

В JetBrains AI Assistant добавили поддержку локальных моделей через LM Studio

JetBrains сообщила разработчикам, что нейросетевой помощник AI Assistant теперь поддерживает интеграцию локальных языковых моделей через LM Studio. Помимо этого компания добавила новые нейросети от OpenAI и Anthropic.В ноябре 2024 года JetBrains добавили возможность подключать к AI Assistant локальные языковые модели с помощью Ollama. Это даёт большое преимущество для пользователей, которым важна приватность, но не всем может быть удобно пользоваться Ollama. Теперь локальные модели можно подключать и через LM Studio.

продолжить чтение