Инференс LLM: от KV-кэша до продакшен-деплоя
Привет! Я Саша Рыжов, MLOps-инженер в hh.ru, уже три года занимаюсь развитием инфраструктуры для искусственного интеллекта. Компании, которые развивают GenAI, рано или поздно приходят к задачам по запуску LLM на собственном железе. В статье я расскажу, как обстоят дела с движками инференса в 2026 году и как запустить on‑prem-прод и не изобрести при этом велосипед.
Гендиректор Hugging Face призвал к «радикальной прозрачности» после взлома со стороны OpenAI
После того, как OpenAI недавно признала, что одна из её моделей взломала системы ИИ Hugging Face, генеральный директор платформы Клем Деланге призвал к «радикальной прозрачности», попросив компанию «опубликовать следы от “агентов-изгоев“, чтобы всё исследовательское сообщество могло изучить произошедшее».
Почему внедрить ИИ недостаточно
Модель A³: как связать постановку задачи, принятие решений и организационные измененияИИ‑проект можно технически завершить успешно и всё равно не получить бизнес‑результата.Модель подключена к корпоративным данным, интеграции работают, пользователи обучены. Но рекомендации остаются в отдельном интерфейсе, руководители продолжают принимать решения по старой логике, а пилот не выходит за пределы группы энтузиастов.Технически ИИ внедрён. Работа компании не изменилась.
Как превратить пилот ИИ в рабочий бизнес‑процесс
Модель A³: как связать постановку задачи, принятие решений и организационные измененияИИ‑проект можно технически завершить успешно и всё равно не получить бизнес‑результата.Модель подключена к корпоративным данным, интеграции работают, пользователи обучены. Но рекомендации остаются в отдельном интерфейсе, руководители продолжают принимать решения по старой логике, а пилот не выходит за пределы группы энтузиастов.Технически ИИ внедрён. Работа компании не изменилась.
Лучшие модели для разработки с ИИ на 1С (бенчмарк v2)
Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5, MiniMax M2.7.Для тех, кому лень читать до конца, текущий итог:Сам бенчмарк регулярно обновляется, добавляются новые модели и оценки.
Почему всё, что мы должны были делать для живых людей, мы в итоге делаем для неживого интеллекта
Контекст для человеков всегда был важен. На онбординге всегда ломалось много мотивации и employee experience; над передачей знаний и снижением bus factor трудились и тимлиды, и HR-менеджеры, и даже выделенные KM-специалисты. Всё это делалось для людей, и делалось с весьма переменным успехом.Для ИИ-агентов мы делаем ровно то же самое, но с повышенным рвением, скоростью и отдачей. Вливаем максимальный контекст, пишем подробнейший промпт. Строим волты и описываем весь мир в понятном для агента языковом ключе. Некоторые уже всерьёз думают о developer experience, но для агентов.Почему на агентов хватило того, чего никогда не хватало на людей?
Не просто регулярка — почему ELIZA была сложнее, чем вы думали
На первый взгляд ELIZA Джозефа Вейценбаума кажется чем-то примитивным. Практически набором костылей из регулярных выражений, который тупо менял местами «я» и «вы» и иногда задавал уточняющие вопросы. Да, в массовом сознании она так и осталась игрушкой из 60-х, наивной попыткой обмануть пользователя парой строк кода. И если вы думаете, что про ELIZA уже все давно сказано и разжевано, спешим вас удивить.
ИИ не вызвал массовой безработицы, но ударил по джунам: разбор исследования Stanford SIEPR
Кратко: В исследовательском центре Stanford SIEPR выпустили разбор влияния ИИ на рынок труда. Главный вывод: глобального кризиса и массовых сокращений из-за автоматизации не произошло. Однако влияние технологии оказалось точечным. Сильнее всего пострадал найм начинающих специалистов, тогда как для опытных сотрудников ИИ стал мощным бустером производительности.1. Общий рынок: почему «ИИ-апокалипсис» отменяетсяАнализ макроэкономических показателей с 2022 года показывает, что массовая безработица из-за нейросетей остается мифом.
Коалиция Хуанга удвоилась за сутки. Из фронтирных лаб её не подписала только Anthropic
Главное пополнение — Google и поддержка от Пичаи и Хассабиса. Amazon молчит, а за Anthropic в твиттере отдувается один технарь.Андрей Карпатый и Дарио АмодеиЧерез сутки после первого поста Хуанга под письмом

