llm. - страница 13

llm.

Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге

Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

продолжить чтение

Шизофрения LLM, или Поваренная книга вайбкодера

Я пишу код больше двадцати лет. В этом стаже было всё: говнокод, красивый код, снова говнокод — и сквозь всё это стремление к прекрасному, которое то побеждало, то сдавалось под дедлайном. Сейчас тот период вспоминается как другая жизнь. Не потому, что я разлюбил программирование — а потому, что код руками я больше почти не пишу. Я пишу роли, правила и планы. Код пишут агенты.

продолжить чтение

Что общего у Таро, Viterbi и LLM: как алгоритм выбирает один смысл из многих

Представьте, что человек спрашивает о смене профессии и вытягивает три карты: Повешенный → Маг → Колесница. Из одной и той же последовательности можно собрать несколько правдоподобных историй: о паузе и переосмыслении, о найденных ресурсах или о риске принять резкое действие за настоящее решение. Карты одинаковые, а смысловые маршруты — разные. Как интерпретатор выбирает один из них? И можно ли описать этот выбор так же, как поиск гипотезы в распознавании речи, машинном переводе или языковой модели?От множества трактовок к лучшему пути

продолжить чтение

Как не потерять себя в эпоху ИИ

Обещание, что скоро код не придется писать руками, звучит далеко не первый раз. COBOL делали похожим на английский, чтобы программы были понятны не только программистам. Предшественник SQL назывался SEQUEL, то есть буквально Structured English Query Language. Потом появились ноукод-платформы. Ручной работы действительно становилось меньше, но программисты никуда не исчезли. Наоборот, их становилось только больше.

продолжить чтение

Один ход агента — 120 000 токенов. Разбираемся, куда они уходят и как мы это починили

Мы делаем Uma Computer

продолжить чтение

ИИ-Автопилот: поток принятых задач вырос в тринадцать раз

В первой части я рассказал, как из ручного копипаста тикетов в консоль агента вырос ИИ-Автопилот — полный конвейер от YouTrack до проверки в живом 2D/3D GUI. По ощущениям всё летало: бэклог таял, в SVN постоянно появлялись коммиты, пользователи едва успевали проверять готовые задачи.Вот только «по ощущениям» — это ровно та валюта, в которой посчитано большинство статей про ИИ-агентов, и доверия к ней у меня немного. Любая активная система выглядит продуктивной: что-то постоянно собирается, коммитится, переписывается. Отличить эффективность от активности можно только замером.

продолжить чтение

Гибридные трансформеры под нагрузкой: где Gated DeltaNet проигрывает full attention

Гибридные модели обещают простую вещь. Память под контекст перестаёт расти линейно с его длиной, значит длинный контекст дешевеет, значит на ту же карту влезает больше пользователей. Звучит настолько разумно, что проверять как-то неловко.Я всё-таки проверил, потому что интересовало как эта архитектура будет вести себя под нагрузкой и вписываться в существующий стек инференса. Снял на вечер машину с двумя RTX 3090 и прогнал по двум моделям одну и ту же агентскую нагрузку. Qwen3-4B: обычная, полная аттеншн во всех 36 слоях. Qwen3.5-4B: гибридная, полная аттеншн осталась в 8 слоях из 32, а остальные 24 заменены на рекуррентные слои Gated DeltaNet (

продолжить чтение

Большие модели и цена миллиона токенов

Автор: Иван Богданов, Технический писатель 

продолжить чтение

Мобильный клиент для LM Studio: Мультичат и выбор моделей на лету

Продолжение начало https://habr.com/ru/articles/956272/Привет! Прошло время с момента выхода первой версии моего мобильного клиента для LM Studio. Приложение получило отклик, и появились идеи по его улучшению. В этой статье я расскажу о двух главных нововведениях, которые делают работу с локальными моделями ещё удобнее: мультичат и возможность выбирать модель на лету прямо в процессе диалога.Ключевые изменения:

продолжить чтение

Объявлена программа CIO CAMP 2026: как компании переводят ИИ из пилотов в рабочие процессы

INFOSTART CIO CAMP 2026 пройдет 14–15 августа в Санкт-Петербурге. Деловая программа первого дня посвящена практическим вопросам корпоративного внедрения искусственного интеллекта: от изменения операционной модели компании до инфраструктуры, безопасности, разработки агентов и оценки затрат.

продолжить чтение