llm.
MCP-агрегатор: объединяем инструменты для LLM в один сервер
При работе с локальными LLM через Claude Desktop, Kilo Code, Cursor или другие MCP-клиенты часто возникает одна и та же ситуация: Нужен filesystem для работы с файлами,web-search для поиска в интернете,memory для хранения контекста между сессиями, sequential-thinking для сложных рассуждений. И ещё десяток серверов…
meta‑attention is all you need
ВведениеВ этой статье я расскажу о интересной находке во время моих экспериментов с языковыми моделями, которую я решил назвать «мета‑трансформерами».Или я нашел реально что‑то интересное, или выдал желаемое из действительное, а обьективную оценку может дать только (технически подкованный) внешний наблюдатель, поэтому этот текст и был опубликован. Особенно тут кстати будут спецы по архитектуре трансформеров.Веса моделей, исходники проекта + вся документация будут приложены в конце статьи (в главе исходники), на Hugging‑Face и Codeberg
Не цитируй мне нейросеть
Если твой ответ начинается с "Вот что мне сказал Claude:" или 800 слов неотредактированной простыни от ChatGPT - поздравляю: ты только что доказал, что твой мозг - просто прокладка. Дарвин бы гордился. Пожалуйста, не размножайся.Что ты только что сделалКто-то задал тебе настоящий вопрос. С контекстом, с искренним намерением. Человек пришел именно к тебе. Ты взял его вопрос, закинул его в промпт, и вставил результат обратно. Наверняка почувствовал себя жутко продуктивным и умным, да? Что-ж... Спешу разочаровать: ты не стал умнее, ты просто доказал что разницы между вопрос к тебе и вопросом к ИИ больше нет.
Reasoning-модели сломали мой промпт-инжиниринг. Год переучиваюсь
Вторник, час ночи. Сижу пишу промпт чтобы вытащить из 40 PDF-ок с актами нужные поля в JSON. Задача рутинная, у меня под неё лежит проверенный шаблон. Развёрнутый CoT, три few-shot примера, роль «опытный финансовый аналитик с 15 лет опыта». Раньше работал как часы.Закидываю в GPT-5.5 с высоким мышлением. Получаю мусор. Половина полей не та, формат сломан, в выводе развёрнутое рассуждение которое я не просил.Думаю ладно, заглючило. Прогоняю ещё раз. То же самое.Удаляю промпт целиком. Пишу заново, тупо: «вытащи из приложенного текста поля X, Y, Z в виде JSON, никаких пояснений». Десять строк. Запускаю.Работает.
9 из 10 AI-пилотов в России не доходят до прода. Пять ошибок, которые мы совершили сами…
За два года мы запустили внутри Альпины не один десяток AI-пилотов. Большая часть не дожила до промышленной эксплуатации. Какое-то время мы считали это своей внутренней проблемой — пока в марте 2026 не вышел опрос рынка, и оказалось, что наши цифры совпадают с отраслевыми почти один в один. Без чужих кейсов и без слайдов про «революцию» — пять ошибок, которые мы совершили сами, и пять выводов из них.
Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM. Часть 4. Тестирование
Продолжаем серию про файнтюнинг и создание DevOps-агента Oni. В первой части я собирался в отпуск и хотел, чтобы локальная моделька через OpenClaw сама мониторила ошибки и переподнимала проекты — пока я отдыхаю. Перебрал много разных моделей через Ollama и понял, что половина либо не умеет tool calling, либо ломаются на multi-step. В отпуск я в итоге не уехал — вместо этого снял VM с RTX 3090, начал учить Qwen3-14B через Unsloth QLoRA, а через неделю купил с авито старенький Dell с 3090, чтобы обучать у себя на локалке — стало интересно победить проблему.Во второй части
Облачная LLM на 16 ГБ VRAM — часть 2: LangGraph Server, LangSmith и SDK
Друзья, привет! Возвращаюсь с продолжением.
Если пропустили Claude последние 3 месяца: топ-5 фич с юзкейсами и история про $400K в Bitcoin
Февраль–май 2026 — один из самых плотных кварталов у Anthropic за последний год. И большая часть того, что обсуждают в Twitter-X под тегом #ClaudeCode, — это вообще не новинки квартала. Subagents в Claude Code существуют с 2025 года, нативная поддержка плана и resumption — с октября. Skills анонсированы в октябре 2025, как open-standard — в декабре. MCP-протокол вообще запущен ещё в поздней осени 2024. Я хочу сразу обозначить честно: ничего из этого я в топ за квартал ставить не буду. У меня самого skills и subagents в workflow больше года.А вот что реально вышло за период:Opus 4.7 с командами /effort и /fast (поздний апрель)

