Почему LLMProvider недостаточно: проектируем AI Gateway для SaaS на Go
Когда начинаешь делать AI-фичу в backend-приложении, первая архитектурная идея обычно выглядит очень здраво: спрятать конкретного провайдера за интерфейсом.Что-то вроде:type LLMProvider interface { Generate(ctx context.Context, req Request) (Response, error) }Сегодня за ним OpenAI-compatible API, завтра другой провайдер, послезавтра локальная модель. Код бизнес-логики от конкретного SDK не зависит, значит архитектурная задача вроде бы решена.
Почему юридический AI‑сервис нельзя строить как обычный чат: проектируем case‑first SaaS на Go
Несколько месяцев назад мне понадобилось заключить договор с водоканалом. Казалось бы, обычная бюрократическая задача: отправил документы, дождался ответа, подписал договор. На практике всё оказалось значительно веселее — ответа долго не было, сроки шли, а что делать дальше, было не совсем понятно.Юриста у меня не было, зато был AI. Я загрузил документы, описал ситуацию и начал разбираться, какие вообще есть варианты дальнейших действий. В итоге с помощью AI подготовил несколько обращений и жалоб, после чего ситуация сдвинулась с места и договор со мной всё‑таки заключили.
Как 17B активных бьют 70B плотных: анатомия Mixture-of-Experts (MoE)
Если вдруг вы моргнули на моменте, когда разработчики нейросетей мерились у кого больше цифра рядом с названием модели, а выморгнув, обнаружили, что теперь модно флексить скромными размерами активных параметров, эта статья для вас. Сегодня объясняю, как же так произошло, что все флагманы опенсорса внезапно стали MoE, почему Qwen3.5 на 397 миллиардов параметров строчит токены, как будто ей 17 и почему никто не разорился на видеокартах.Ну и для тех, кому «только спросить» откроем тайну: в каком же кабинете у MoE живет эксперт по медицине.
Осторожная попытка переосмыслить сложное: Как связать документы, диаграммы и знания?
Проблема. Вкладки, снова вкладки и еще больше вкладок...Сколько раз каждый из нас оказывался в ситуации окружения вкладками? Будь то браузер или даже несколько, когда мы изучаем что‑то новое и постепенно проваливаемся все глубже и глубже, при этом часто возникает ощущение что идешь словно по верхам, пока не отвлекаешься на рекламу или котиков.
Архитектор, параноик, фантазёр и другие сотрудники IT‑компании будущего
Известно, что развитие цивилизации идёт по спирали. Сейчас мы, кажется, находимся на очередном технологическом витке, когда вход в профессию IT становится существенно сложнее прежнего, возможно, даже сложнее, чем 30 лет назад, когда программисты считались гиками и заумными чудилами, которых многие сторонились и держались от них подальше. (привет одногруппникам с ИУ7 ;)
«Аниме-завод» открыт: выкладываю код конвейера, который сам режет эпизоды на Shorts
За последнее время я написал три статьи про систему, которая превращает длинные видео в вертикальные клипы: общий обзор «аниме-завода», разбор виртуальной камеры с face tracking и рассказ о том, почему связка «транскрипт + LLM» почти всегда даёт мусор.Комментарий, который повторялся под всеми тремя, был один и тот же: «покажи код».Показываю.→ github.com/ialakey/shorts-factory
В Москве пройдет уличный фестиваль для руководителей ИТ, ИБ и AI‑направлений
10 сентября 2026 года в московском «Берёzы парке» пройдет ИЗИфест — отраслевой фестиваль, организованный облачным провайдером Nubes. Его участниками станут CISO, CTO, ИТ‑директора, руководители инфраструктурных подразделений, архитекторы, Product Owner, DevOps‑ и SRE‑лиды.В центре программы вопросы, с которыми сегодня сталкиваются технологические команды: применение ИИ в реальных бизнес‑процессах, безопасность и ответственность при его внедрении, изменения регуляторных требований, импортозамещение, легаси‑системы, отказоустойчивость и взаимодействие между ИТ, ИБ и бизнесом.

