opencode.

Исследование: Claude Code отправляет в 4,7 раза больше служебных токенов, чем OpenCode

Компания Systima сравнила объём служебных данных, которые Claude Code и OpenCode передают языковой модели вместе с пользовательским запросом. Решение от Anthropic использует в 4,7 раза больше токенов и быстрее расходует лимит. 

продолжить чтение

Harness кодинг‑агента: разобрал исходники Codex, OpenCode, Pi и свою собственную

В прошлой статье про промпт-кэш я сформулировал вещь, которая на самом деле важнее самого кэша: модель ничего не помнит, она stateless

продолжить чтение

Разговариваем с датчиками на человеческом: как связать MQTT, TimescaleDB и LLM через Model Context Protocol (MCP)

Любой, кто когда-либо работал на фабрике или в автоматизированных коммерческих помещениях, хорошо знаком с этой болью: данные датчиков занимают гигабайты, но чтобы извлечь из них хоть какую-то пользу, нужно пройти семь кругов ада. Надо писать SQL-запросы, загружать данные в CSV, переводить на Python, составлять графики в Excel, внимательно просматривать и искать аномалии…

продолжить чтение

Локальные LLM в агентской разработке внутри компании: пользовательский опыт

Всем привет!Меня зовут Дмитрий Бутенко, я эксперт-разработчик банка Уралсиб.

продолжить чтение

Как я подключал YandexGPT к AI-агентам (OpenCode, Pi, Hermes и Claude Code)

Я уже исследовал возможности интеграции разных моделей в инструменты разработки. Недавно решил плотно посмотреть на Yandex AI Studio и понять, как легко их модели залетают в популярные клиенты.Главное открытие — у Яндекса отличная поддержка стандарта OpenAI «из коробки» (эндпоинт https://ai.api.cloud.yandex.net/v1). Оказывается, всё настраивается в разы проще, чем то, с чем я столкнулся при подключении GigaChat к OpenCode

продолжить чтение

AIналитик v2 по BABOK: как я переписал AI-платформу для бизнес-анализа, чтобы она работала c любыми LLM

Спойлер: архитектура AIналитика полностью переписана, теперь Платформу можно запускать практически под любым харнесом (OpenCode, Kodik, Codex, Claude Code), а также подключать любые LLM, включая локальные. Добавлено/в разработке много новых фич: многоагентная система, доска навигации и дашборд для тимлидов.Пару месяцев назад я опубликовал на Хабре статью «Как я научил Claude Code работать бизнес-аналитиком по руководству BABOK. Вот что получилось». Коротко, я разработал AI Платформу AIналитик - ai-ассистента, который работает рядом с бизнес-аналитиком, как опытный коллега. Он знает методологию BABOK v3

продолжить чтение

Как нам в Домклик LLM рефакторинг делала

Привет! Меня зовут Сергей, я Android-разработчик команды Новостроек в Домклик. Довольно давно наблюдаю за «сценой» ИИ в разработке, надо вовремя сменить профессию на электрика, эксперта в электрификации ИИ ЦОДов.Я постоянно вижу, как кто‑то навайбкодил новый (хорошо забытый) SaaS, или автоматизировал разработку новых фич, а может быть даже вообще заменил всю команду разработчиков в своём стартапе несколькими агентами. С другой стороны, так же часто я вижу и посты «Что делать — агент снёс мою продовую БД?!» и «Ищу опытного разработчика, сам я уже не в силах дорабатывать вайбкод».

продолжить чтение

Как я собрал LLM-печку на 4 GPU, и на что она способна

продолжить чтение

Локальные LLM в реальной работе: Gemma 4, Qwen 3.6 и Qwen Coder

Gemma 4 обыграла Qwen Coder в задачах программирования, а режим мышления заставил модели хуже следовать инструкциям. Рассказываю почему.Зачем я это затеялПривет, меня зовут Вячеслав. Я интересуюсь локальными LLM и тем, как они ведут себя в реальных задачах — не на синтетических бенчмарках, а когда нужно написать работающий код, отрефакторить файл с багами или вытащить данные из HTML.

продолжить чтение

Запускаем Qwen3.6 35B-A3B + opencode локально на RTX 4070 12GB — AI-ассистент для разработки без облака

Я давно слежу за развитием локальных LLM, но всегда упирался в одно и то же — либо модель маленькая и качество не устраивает, либо большая и не влезает в видеопамять. Всё изменилось когда я наткнулся на статью про MoE-модели и параметр -cmoe в llama.cpp.Расскажу как я запустил Qwen3.6 35B-A3B на RTX 4070 12GB с 32GB RAM, настроил его как AI-ассистент для реального проекта в opencode, и почему теперь эта модель у меня работает постоянно.Железо и ожиданияМоя конфигурация:GPU: RTX 4070 12GB VRAMRAM: 32GB DDR4CPU: 12 физических ядерOS: Windows 11 + WSL2 (Ubuntu)

продолжить чтение

12