llm.
MCP Gateway: когда инструменты перестают быть интеграцией и становятся архитектурой
Привет, Хабр! Меня зовут Илья Гуляев, я работаю в команде Рег.облака над облачными решениями
Своя GPT-like LLM по WH40K с нуля. Часть 3: pre-train LLM
Привет, Хабр! Меня зовут Владимир, и это третья часть цикла статей по написании и обучению небольшой decoder-only LLM с нуля. В первой части мы обучили токенизатор и собрали pretrain-датасет, во второй части реализовали класс Трансформер-блока. В этой части будем собирать и предобучать нашу LLM.Содержание циклаПодготовка и токенизация данныхТрансформерСборка и обучение LLM (вы находитесь здесь)SFT этап (дообучение на Вопрос-Ответ)
YaGo: как я хотел бесплатный self-hosted Tavily API, а в итоге воскресил YaCy
Всё началось не с мечты про «поисковик нового поколения». Мне понадобился быстрый self-hosted Tavily-compatible API для собственных рабочих и личных AI-решений: без оплаты за каждый запрос, без внешнего сервиса в обязательной цепочке и с индексом, содержимое которого контролирую я сам.Тут я вспомнил про YaCy. Когда-то я уже поднимал его ноду. Идея мне нравилась, а реализация - заметно меньше: Java, тяжёлая машина и примерно шесть секунд ожидания ответа на моей тогдашней установке. Для человека, который один раз нажал Enter, это ещё можно пережить. Для агента, делающего несколько поисков, уточнений и extract
Автономная система ИИ-агентов атаковала Hugging Face: защититься помогла LLM
Hugging Face раскрыли подробности недавнего инцидента безопасности. По заявлению компании, это первый случай, когда атака на ее инфраструктуру была целиком проведена автономной системой ИИ-агентов — от первоначального проникновения до последующего развития атаки.
Атака на LLM, которую нельзя исправить патчем
Не так давно вопросы безопасности искусственного интеллекта считались скорее темой для научных докладов, чем реальной проблемой для бизнеса. Большинство компаний, внедрявших LLM, сосредоточились на нескольких первоочередных задачах. Они стремились как можно быстрее выпустить минимально жизнеспособный продукт. Также они подключали к нему корпоративные знания, обучали помощника отвечать клиентам и автоматизировали работу техподдержки. Вопросы безопасности при этом откладывали. Такой подход был
Astra Studio: enterprise веб-приложение для взаимодействия с ИИ с нуля
Часть 1: Архитектура и философия проектаПолностью локальная система с агентной архитектурой, продвинутым RAG, MCP и мультимодальными возможностямиРепозиторий проекта: https://github.com/NeKonnnn/Astra-StudioAstra Studio
J-Space in Micromodels: A New Interpretation of Anthropic’s Discovery
Recently, Anthropic reported the discovery of an analogue to the global workspace in LLMs — J-space. In a previous article, I analyzed why Lev Vygotsky’s theory offers a better interpretation of the researchers' findings.In this article, I argue, based on experiments, that J-space analogues do not depend on the size of the neural network. Rather, they are an inevitable stage in the evolution of a cognitive structure developing under pressure.TL;DR. Anthropic describes the model’s internal "workspaces" using the language of emergence — as a property that arises in sufficiently large networks.I tested this on micromodels, where every representation axis can be verified, and drew the following conclusions:
Я слышу, как модель думает
Привет, %username%! И заголовок – не метафора. Я часто ловлю тонкий, почти на грани слышимости писк, когда работаю с LLM на своем MacBook Pro. Иногда — когда вроде бы вообще ничего не запускал. Довольно долго подозревал, что профдеформация переросла в галлюцинацию.Оказалось — нет, это физика.Coil whine. Катушки индуктивности и керамические конденсаторы в VRM видеокарты и БП вибрируют на частоте переключения преобразователя — магнитострикция плюс пьезоэффект. Обычно 5–15 кГц, аккурат в верхнем углу слышимого диапазона. И это не маркер дешёвого железа, скорее наоборот: в обзоре RTX 4090

