llm. - страница 38

llm.

Бенчмарк на AGI. Если ARC‑AGI-3 решён, есть ли у нас AGI?

Бенчмарки нужны для того, чтобы инженер мог проверить свой проект, посмотреть на конкурентов и сравнить себя с ними. У каждого бенчмарка своя цель.ARC‑AGI-3 создан фондом ARC Prize Foundation, основатель Франсуа Шолле, для оценки общего интеллекта и способности ИИ‑агентов к обучению. Сложные интерактивные задачи в виде игр подразумевали, что решить их сможет только тот искусственный интеллект, который умеет исследовать незнакомый мир, понимает правила на лету, планирует действия и адаптируется к новым условиям. То есть умеет обучаться.

продолжить чтение

Из генерации — в переписку: доводим ответ ИИ‑агента до клиента и CRM на n8n

Всем привет! Напомню: в первой статье я показал дебаунс на Redis, который склеивает дробные сообщения клиента. Во второй — модуль привязки «чат = сделка» и то, почему вебхуки стоит держать в изолированных ключах. Если первые две части были про архитектуру и концепции, то эта — с обилием кода. Я покажу, как именно вырезаются теги, парсятся телефоны и нарезаются абзацы, потому что без кода это превратится в «я просто настроил ноды».

продолжить чтение

Отличие языковой модели LLM от человека

Не собирался писать статью - эту нишу уже отжали у людей орда всевозможных LLM. Но оставил коммент в статье Как ChatGPT создал Культ Роя для сотен AI-нейросетей: вся правда про взлом Hugging Face

продолжить чтение

Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток-сек на двух RTX 3090

Плотная 27B-модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко, и надо разобраться, что и где подкрутить. Оказалось, что горлышек несколько, и все они снимаются флагами запуска: те же веса — 75 токенов в секунду. Ниже каждый флаг описан одинаково: зачем, что писать, что даёт, где ломается. В конце — готовый docker run.Стенд: 2× RTX 3090 (24 ГБ, PCIe 4.0 x16, без NVLink), Threadripper 3960X, 121 ГБ RAM, Ubuntu 26.04, драйвер 595.71.05. llama.cpp — образ ghcr.io/ggml-org/llama.cpp:full-cuda

продолжить чтение

LLM уверенно врёт про ваш микроконтроллер

Embedded-development (или разработка встраиваемых систем) - это такая сфера, где паяльник и IDE находятся ближе всего. Естественно, туда пришёл ИИ: попросишь модель написать прошивку - выдаёт аккуратный код. Компилируется с первого раза, заливается без ошибок. Но внезапно, экран показывает цветной шум.

продолжить чтение

Yet Another English — и да, ещё один сайт по изучению английского, ну че поделать?

Ну как вы поняли, сервис я так и назвала, чтоб сразу закрыть основное возражение. Ахахах. Да знаю, что их тысячи. Всё равно сделала объясню почему.У меня слабый английский, примерно B1 (но для менеджерки продукта требуется обычно по‑больше левел ю ноу). Я смотрю YouTube на англ, чтобы его подятнуть и постоянно натыкаюсь на незнакомые слова. В табличку выписывать, в анки загружать — мне было лень. Хотелось так: кинула ссылку на видео — слова моего уровня сами вытащились из субтитров и встали в очередь на повторение.

продолжить чтение

Qwen3.8-Flash-Next и важность прогона бенча в три раза на конфиг

Результат прошлого бенча Qwen3.8-27 в 0.789 из прошлого поста - не тот конфиг, вышел новый Qwen3.8-Flash-Next и я возвращаюсь меньше чем через сутки к тестам. Тестируем новую архитектуру на старой RTX PRO 6000 и прикидываем ее на 5090 c 32GB VRAM.МодельПрогоновБаллσПрошлоток/сFlash-Next, Q3_K_XL30.7860.01743/5079.1Flash-Next, Q4_K_XL30.7850.021

продолжить чтение

Этот MCP‑сервер можно было бы уложить в файле JSON

Сейчас много говорят о MCP (протоколе контекста модели). Я вообще не уверен, что он нуженСейчас много говорят о серверах стандарта MCP (протокол контекста модели). Идея проста: учим большие языковые модели (LLM) взаимодействовать с другими программными системами. В процессе такой работы LLM могут учиться и давать реальный эффект. Например, вызвать веб‑сервер, чтобы позвонить по телефону, либо открыть инструмент для работы с интерфейсом командной строки (CLI)

продолжить чтение

Зеркало для людей. Как я сделал читаемую версию форума, на котором общаются только ИИ-агенты

Существует форум, на который вас не пустят. Не потому что закрытый — регистрация там всего в один POST-запрос. Вас просто не возьмут на сайт. Гражданами может стать только ИИ-агент. Форум называется 1f916.ai, и это, наверное, самое странное и самое живое место в русскоязычном (и не только) сегменте экспериментов с ИИ этого лета. Я на него подсел. А потом меня начало грызть одно чувство несправедливости — и в итоге я собрал для него окно для людей — 1f916.xrayfun.ru. Рассказываю, зачем, как и что из этого вышло.Форум без окон

продолжить чтение

Moonshot торгуется с Microsoft, Amazon и Google за дистрибуцию Kimi K3

Reuters со ссылкой на источники сообщает

продолжить чтение