Мы дали ИИ доступ к учётной системе: что из этого вышло?
Большинство разговоров про ИИ в бизнесе пока заканчиваются примерно одинаково: написать письмо, пересказать документ, сделать картинку или проанализировать Excel.Но нам было интереснее проверить другой сценарий: что произойдет, если дать ИИ доступ не к выгрузке, а непосредственно к учетной системе компании? Чтобы он сам посмотрел продажи. Проверил остатки. Нашел должников. Создал заказ поставщику. Заполнил карточки товаров. А при необходимости разобрался, кто вчера поменял цены и насколько. Для этого мы подключили МойСклад к ИИ-ассистентам через MCP и начали давать им обычные задачи предпринимателя.
Open‑weight LLM догнали закрытые? Проверка на продакшене
Всем привет, меня зовут Сергей Прощаев, и в этой статье расскажу, почему фраза «open‑weight модели догнали закрытые» почти верна для бенчмарков и опасна для вашего продакшена. Я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E‑commerce и преподаю на курсах разработки и архитектуры в ОТУС.Представьте: пятница, вечер, в рабочий чат кто‑то кидает скриншот бенчмарка. Открытая модель отстаёт от флагмана за 25 долларов за миллион выходных токенов на пару пунктов. Через десять минут в тред приходит финансовый директор с вопросом:«А зачем мы платим в десятки раз больше?»
Локальный агент для кода на Mac: MTPLX + pi + Qwen3.8–27B. Что реально ускоряет, а что нет
Я хотел, чтобы кодовый агент работал целиком на ноутбуке, без облака: локальная модель, локальный сервер, агент в терминале. Главная боль с самого начала — скорость. Агент постоянно перечитывает длинный контекст и много «думает», и на локальном железе это превращается в минуты ожидания на каждую задачу.
Хотел свою систему, которую можно менять когда угодно, и сделал три десктопных AI-приложения
Хотел свою систему, которую можно менять когда угодно, и сделал три десктопных AI-приложенияПривет, Хабр! Это моя первая статья, и она про Zeqou: небольшую экосистему десктопных приложений для работы с языковыми моделями. Два приложения уже готовы, третье выйдет совсем скоро. Расскажу, что они умеют, как устроены и с какими неожиданными проблемами я столкнулся.Коротко. Zeqou — это три приложения: чат, рабочее пространство для агентов и студия дообучения моделей. Они бесплатные и работают на Windows, macOS и Linux. Чат и Harness готовы, xtraining выйдет очень скоро.Зачем всё этоЯ всегда хотел иметь
Как мы сделали универсальный ИИ-инструмент, который может создавать сам себя
Когда в компании заходит речь об ИИ-ассистенте для сотрудников, чаще всего выбирают из двух не очень удачных вариантов. Либо сотрудники уходят на личные подписки вроде ChatGPT — и рабочие данные утекают за периметр компании. Либо заводят корпоративного ассистента, который безопасен, но умеет только отвечать текстом: в отличие от прогрессивных моделей в веб-интерфейсе, он не может залезть в данные системы и внести в них реальные изменения.На GenAI-платформе SimpleOne
Одна цифра в двух смыслах: читаю whitepaper Сбера про AI-Disrupt PDLC со своей телеметрией в руках
В мае Сбер выпустил whitepaper “AI-Disrupt PDLC” - документ о том, как перестраивать жизненный цикл разработки вокруг намерения человека. В сентябре Олег Бунин разобрал его на Хабре, отделив инженерную рамку от продуктовой витрины.Меня в этом документе зацепили числа про стоимость агентной работы, потому что у меня на диске лежит телеметрия: я веду всю работу агентными инструментами, и логи пишутся сами. Я скачал обе версии whitepaper - короткую и полную на 175 страниц - посчитал свой расход и сел сравнивать.Главное, что я нашел, относится к самому документу:
Методология нейрослопа
А как вы смотрите на нейрокод?Нейросети с нами надолго. Даже если вдруг исчезнут OpenAI, Anthopic, Z.ai и прочие, мой личный Qwen 3.8 27B никуда не денется. Вопрос - a что с этим делать? Как разрабатывать софт в новую эпоху?
Anthropic выпустила Claude Opus 5.5: на 40% дешевле и более чем на 30% быстрее Opus 5
Anthropic выпустили Claude Opus 5.5, первую модель нового семейства Claude 5.5. По данным компании, на большинстве рабочих задач она показывает результаты уровня Fable 5.1, при этом генерирует более чем на 30% быстрее Opus 5 и обходится на 40% дешевле на типичных задачах.
Как мы мигрировали с MongoDB на Cassandra за квартал: опыт использования АI-агентов
Что делать, если критически важное хранилище с миллиардами записей требует слишком много дорогого железа, а на миграцию силами инженеров уйдет целый год? Меня зовут Александр Моргунов, я инженер Авито, в этой статье я расскажу как мы провели эту миграцию всего за один квартал силами одного архитектора, не написав руками ни одной строчки продакшн-кода, лишь с помощью ИИ-агентов.
Кто нашёл больше багов — агент или человек? Мои замеры 11 недель работы с AI-тестировщиком
Одиннадцать недель я вёл дневник каждой рабочей сессии с Claude Code: сколько часов работал агент, сколько я был рядом, кто нашёл каждый дефект и что случилось с каждым кандидатом — подтверждён, снят или ушёл вопросом. Вместо впечатлений — таблица: 277 агентских часов, 213 моих, 94 подтверждённые находки. Первая версия этого счёта оказалась завышенной почти вдвое — куда делась половина, тоже расскажу.Это четвёртая статья про paranoid-qa — опенсорсный пак скиллов, который заставляет Claude Code тестировать с доказательной дисциплиной. В первых трёх я показывал методику: вердикты только с пруфами,

