self-hosted.

Хватит сливать данные в Claude и GPT: как поднять свой on‑prem LLM

Да, вы абсолютно правы ✅ Это изображение подходит в вашу статью ✅ Будут еще вопросы, обращайтесь 😊

продолжить чтение

Готовое решение из коробки. Финал саги: мой ИИ-ассистент на Hermes улетел на GitHub. Забирайте! А грабли расскажу следом

Формат: туториал + личный опыт. Сложность: средняя. Время чтения: ~9 минут.Это третья и финальная часть истории про моего личного ИИ-агента. Предыдущие - «Как я переезжал ИИ-агента с OpenClaw на Hermes и собрал все грабли» и «DeepSeek, бесплатная NVIDIA и Codex: как я научил агента думать дёшево и работать, пока я сплю». Сквозную нумерацию граблей продолжаю с того места, где остановился, - с №26. Читать предыдущие не обязательно: рекап будет. Больше частей не планирую - на этой я историю закругляю.

продолжить чтение

Hermes оказался для меня игрушкой

Делюсь опытом эксплуатации Hermes в домашней лаборатории и выводами, к которым пришёл в процессе.ОглавлениеПозиционированиеХорошее применение (почти)Что я сам бы не смог сделать

продолжить чтение

YaGo: как я хотел бесплатный self-hosted Tavily API, а в итоге воскресил YaCy

Всё началось не с мечты про «поисковик нового поколения». Мне понадобился быстрый self-hosted Tavily-compatible API для собственных рабочих и личных AI-решений: без оплаты за каждый запрос, без внешнего сервиса в обязательной цепочке и с индексом, содержимое которого контролирую я сам.Тут я вспомнил про YaCy. Когда-то я уже поднимал его ноду. Идея мне нравилась, а реализация - заметно меньше: Java, тяжёлая машина и примерно шесть секунд ожидания ответа на моей тогдашней установке. Для человека, который один раз нажал Enter, это ещё можно пережить. Для агента, делающего несколько поисков, уточнений и extract

продолжить чтение

Два AMD Strix Halo в AI‑инфраструктуре: 34 контейнера на одном, ~70 tok-s Qwen3.6 на другом

На узле моей AI‑платформы крутятся 34 контейнера: Dify, RAGFlow, векторные базы, мониторинг и SSO. Большой языковой модели среди них нет: основную генерацию стек получает по LAN с DGX Spark. На втором таком же мини‑ПК я отдельно поднял локальную Qwen3.6–35B‑A3B и прогнал серию замеров от 1K до 64K при контекстном окне 256K.Обе машины — Beelink GTR9 Pro на Ryzen AI Max+ 395 (Strix Halo). Ниже — что эти коробки реально умеют: 117,4 ГиБ GTT после настройки ttm.pages_limit, p50/p95 локальных эмбеддингов и реранка, около 70 tok/s генерации через Vulkan/RADV и три грабли gfx1151.Что я хотел проверить

продолжить чтение

Тесты бюджетных сборок для ИИ до 100к рублей

GPU для локального ИИ достаточно дорогие, и мне стало интересно: а есть ли жизнеспособный инференс на CPU? А что будет если добавить дешевую видеокарту для майнинга или Tesla V100 16gb? Что можно выжать из максимально бюджетных решений для локального ИИ?Я собрал бюджетную сборку в разных вариациях (2 материнские платы и 2 видеокарты) прогнал тесты некоторых известных моделей LLM и построил графики чтобы можно было сделать выводы.Объем статьи достаточно большой, поэтому для простоты восприятия оформил 15-ти минутное видео на youtube.Навигация по тексту:Стенд

продолжить чтение

Vibecode по дешевке — домашний сервер с Qwen Code за 25к, который не отключит Anthropic

«У нас было две планки оперативной памяти, одна серверная Tesla V100, прочная открытая рама вместо корпуса, 5 райзеров, коробка, наполовину набитая переходниками питания, и целое море разноцветных SATA‑кабелей, стяжек и термопрокладок, а так же тюбик термопасты, моток шлангов для водянки, ящик вентиляторов, пинта изопропила и 12 саморезов неизвестного происхождения. Не то, чтобы всё это было категорически необходимо для сборки, но если уж начал собирать коллекцию, то к делу надо подходить серьёзно.»— по мотивам Хантера С. Томпсона, «Страх и Ненависть в Лас‑Вегасе»

продолжить чтение

Helix Agent Ai — российский самообучающийся AI-агент. Полное руководство по развертыванию и использованию в 2026 году

Заголовок: Helix — российский самообучающийся AI-агент с поддержкой MCP: полное руководство по развертыванию и использованию в 2026 годуВведениеВ 2026 году вопросы приватности данных, цифрового суверенитета и контроля над искусственным интеллектом стали особенно актуальными. Helix — это российский open-source самообучающийся AI-агент (MIT-лицензия), предназначенный для полностью on-premise эксплуатации.Проект сочетает современную архитектуру на базе LangGraph, мощную поддержку Model Context Protocol (MCP), продвинутую систему изоляции и удобные интерфейсы.

продолжить чтение

Как я «переезжал» своего ИИ-агента с OpenClaw на Hermes и собрал все грабли (чтобы Вы не собирали)

Формат: туториал + личный опыт. Сложность: средняя. Время чтения: ~15 минут.Кота-космонавта в стиле акварели нарисовал сам бот через gpt-image-2 — уже после переезда

продолжить чтение

PewDiePie выложил в open source Odysseus — персональный AI-хаб для локальной работы

Блогер PewDiePie выпустил Odysseus — self-hosted AI workspace, который он позиционирует как локальную альтернативу интерфейсам ChatGPT и Claude.

продолжить чтение