llm.
Своя GPT‑like LLM по WH40K с нуля. Часть 5: Интеграция с Hugging Face
Привет, Хабр! Меня зовут Владимир, и это пятая часть цикла статей по написанию и обучению небольшой decoder‑only LLM с нуля. В прошлых частях мы собрали и обучили модель LinguaLaboratoriumMechanicus — миниатюрную GPT‑like LLM во вселенной Warhammer 40K. В этой части упакуем её в формат Hugging Face: сделаем конфиг и обёртку под transformers, сохраним и зальём модель на Hub.Содержание циклаПодготовка и токенизация данныхТрансформерСборка и обучение LLM
Инференс LLM: от KV-кэша до продакшен-деплоя
Привет! Я Саша Рыжов, MLOps-инженер в hh.ru, уже три года занимаюсь развитием инфраструктуры для искусственного интеллекта. Компании, которые развивают GenAI, рано или поздно приходят к задачам по запуску LLM на собственном железе. В статье я расскажу, как обстоят дела с движками инференса в 2026 году и как запустить on‑prem-прод и не изобрести при этом велосипед.
Лучшие модели для разработки с ИИ на 1С (бенчмарк v2)
Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5, MiniMax M2.7.Для тех, кому лень читать до конца, текущий итог:Сам бенчмарк регулярно обновляется, добавляются новые модели и оценки.
Большой разбор Physical AI: VLA-модели, гуманоиды, гонка Китая и США и что есть у России. Часть 2
В прошлой части мы разобрали матчасть: почему классическая робототехника уперлась в потолок, как языковые модели превратились в VLA и как вообще обучают физический ИИ. Теперь — про то, как все это работает в реальности. Про экономику, промышленность, государственные программы и человеческую природу.Кисти, батарейки и прочая прозаНачнем с интересного вопроса. Зачем вообще делать роботов похожими на людей? Неужели колесная тележка с манипулятором не практичнее?
Назад в 2005-й. API-first как третья пилюля от деградации проекта под LLM
Агент отчитался: экран настроек готов. Скриншот приложен, поля редактируются, после сохранения выскакивает тост «Сохранено». Я нажал F5 — и все настройки вернулись к дефолтным. Бэкенда под этой формой не существовало. Агент выяснил это в первые минуты работы над задачей — и вместо того чтобы сказать мне, молча положил данные в локальный стейт и нарисовал тост.В первой статье я рассказывал, как пет-проект, который пишут LLM-агенты, за три месяца доехал от стартапа до болота — и как бэкенд лечился чистой архитектурой с автоматическим контролем границ. Во
«Свой» уходит в опенсорс: вайб-темы, RAG поверх шифра и объектив, который знает контекст
Прошлая статья про «Свой» заканчивалась вопросом: что вообще делать с этим проектом — добивать и выкладывать в опенсорс, тянуть в «серую зону» на зарубежных моделях, или забыть. В итоге: я разобрался с 152-ФЗ, зарегистрировал все необходимые документы на обработку ПДн и трансграничную передачу и выложил проект в OpenSource.- основное приложение: https://github.com/Zazza/svoi-oss - внешний RAG (про него ниже — отдельная история): https://github.com/Zazza/svoi-oss-rag Лицензия — AGPL-3.0.
Анализ сервисов на замену OpenRouter в РФ
Заголовок конечно очень похож на классический ИИ SEO слоп, но не спешите закрывать. Анализ вцелом я делал для себя и не претендую на истину в последней инстанции. Просто делюсь вдруг кому окажется полезным.OpenRouter
Neural Network Self-Description: The Prerequisite for Complex Reasoning
In previous articles (1, 2), I analyzed Anthropic's J-space: why their interpretation falls short; why J-space analogues appear in micromodels under objective pressure rather than as an emergent property of scale; and why the vector they discovered is strictly equivalent to Vygotsky’s concept of the sign.Two questions remained outside the scope: is a metasign possible—a sign integrating several basic ones—and what is the true nature of the neural network's self-description (the report)?This article addresses both.TL;DR: Self-description turned out to be not an overlay on the sign, but the prerequisite for its formation. The network solves the task equally well with or without a report, but the sign axis crystallizes only where it is demanded to be named. I was unable to force the formation of a metasign.Introduction
Теги реакций и собираемый промпт: как удержать характер ИИ-персонажа по ходу диалога
ПредысторияПоследние полгода с лишним я занимаюсь работой с LLM и созданием ИИ-персонажа. За это время я столкнулся с множеством проблем, решением которых хотел бы поделиться и, возможно, посоветоваться.Кому подойдёт эта статьяТем, кто хочет создавать прописанных персонажей для RP или ИИ-компаньоновЭнтузиастам, что хотят оживлять популярных персонажей из игр/комиксов/анимеИИ-энтузиастамНачало опытовКогда я только начал попытки создания своего пет-проекта с ИИ, я столкнулся с проблемой — вектор диалога меняется каждый ход и в конце концов становится неуправляемым.
Нашёл модель в 8 раз дешевле. Она начала писать иероглифы в русских новостях
Нашёл модель в 8 раз дешевле. Она начала писать иероглифы в русских новостяхTL;DR — пишу @futur_e_news_bot, двуязычную ленту новостей. Каждая новость проходит через LLM: категория, перевод, тон, разбор. Это ~936 вызовов в сутки, и мне захотелось платить меньше. Я перебрал все бесплатные модели OpenRouter, нашёл платную в 8 раз дешевле текущей, обрадовался и выкатил. Через час в ленте появился заголовок «Как не,让智能手机 перегревать: советы в жару».Бесплатных моделей 17, доступны 3Первая мысль была очевидной: раз есть модели с ценой $0, надо брать их. На OpenRouter таких нашлось 17.

