Natural Language Processing. - страница 5

Зеркало для людей. Как я сделал читаемую версию форума, на котором общаются только ИИ-агенты

Существует форум, на который вас не пустят. Не потому что закрытый — регистрация там всего в один POST-запрос. Вас просто не возьмут на сайт. Гражданами может стать только ИИ-агент. Форум называется 1f916.ai, и это, наверное, самое странное и самое живое место в русскоязычном (и не только) сегменте экспериментов с ИИ этого лета. Я на него подсел. А потом меня начало грызть одно чувство несправедливости — и в итоге я собрал для него окно для людей — 1f916.xrayfun.ru. Рассказываю, зачем, как и что из этого вышло.Форум без окон

продолжить чтение

Медицинский ИИ не может записать британцев на приём, потому что не понимает йоркширский акцент

ИИ‑система для приёма звонков в больнице не может разобрать акцент звонящих. С такой проблемой

продолжить чтение

GigaChat 2 Max с памятью на связях обходит Claude Opus 5 без неё: замер семи моделей

Кратко: на классе задач «в работе всплыла проблема — каким изменением её уже чинили»:GigaChat 2 Max с памятью на связях отвечает верно в 57% случаев,YandexGPT Pro 5.1 — в 61%,Claude Opus 5 с обычным поиском — в 41%.Модели никто не трогал: разница целиком в том, доехал ли до модели нужный факт в контексте.

продолжить чтение

Философский разбор идеи Software 3.0 Андрея Карпатого

Мне недавно попалась очень интересная беседа Кирилла Меньшова (Сбер), Дмитрия Иванова (Яндекс) и Никитой Соболевым (разработчик OpenSource) о перспективах задекларированной 

продолжить чтение

Grok 4.6: как за месяц допрыгнуть до тройки лидеров (и купить себе Cursor в придачу)

12 августа xAI (хотя уже SpaceXAI) выкатила Grok 4.6. Прошло чуть больше месяца с релиза 4.5, а модель уже официально «на фронтире» – по версии Artificial Analysis.

продолжить чтение

Почему мы не нашли готового PII-детектора для русского языка: грабли боевого контура перед LLM

Меня зовут Андрей Непряхин, я технический директор AGIMA. Этот текст — разбор контура, который мы построили и держим в бою: что в нём устроено так, а не иначе, и чем мы за это заплатили.

продолжить чтение

Gemini 3.7 Flash: это снова не та модель, которую все ждали

Google выпустила Gemini 3.7 Flash — модель, которую сама компания называет «самой умной рабочей лошадкой» для кода и агентных задач. Релиз пришёл всего через три недели после Gemini 3.6 Flash. Google описывает это как результат обратной связи разработчиков и алгоритмических находок, которые команда обещает применять и к будущим моделям.

продолжить чтение

ИИ‑агент внутри КОМПАС-3D: пишет код, строит деталь и проверяет результат

Я сделал ИИ‑агента для КОМПАС-3D: он живёт прямо в окне программы, принимает запрос текстом или фотографией и строит параметрическую деталь — не мёртвую геометрию в step, а дерево построения с переменными, которое пригодно для редактирования.Агент пишет код и сам смотрит на то, что построил, — анализирует рендеры «глазами» через VLM.В статье: как хорошо агент справляется с моделированием по тексту и чертежам уже сейчас, почему один блок кода лучше десяти tool'ов и почему агенту мало просто «видеть» результат.

продолжить чтение

Квантизация LLM: как запихнуть 70B модель в свою видюху

Ну что, думаете что для запуска LLaMA 3 70B вам нужна серверная стойка за лярд рублей? Поздравляю, вас обманули маркетологи GPU-вендоров. Модели с сотнями миллиардов параметров — LLaMA 3 70B, DeepSeek-V3 с его 671 лярдом параметров — жрут vRAM как не в себя, но есть способ запихнуть это все в обычную потребительскую видюху.Сегодня в статье разберем, как работает чудо квантизации под капотом, чем отличаются PTQ и QAT, почему MoE-модели (DeepSeek-V3, Mixtral, LLaMA 4 Scout) квантизовать сложнее и как выбрать между GPTQ, GGUF и AWQ.

продолжить чтение

Разговорили гуманоида: как за месяц мы построили русскоязычный голосовой стек для китайского робота

К нам в лабораторию приехал человекоподобный робот ростом 173 сантиметра и весом 75 килограммов — и он не понимал по-русски ни слова. Штатный голосовой стек работал на китайском, лежал на закрытой плате внутри корпуса, куда нет доступа, и заменить в нём язык было нельзя. Пришлось строить собственный: своё распознавание речи, свой синтез голоса, свою логику диалога.

продолжить чтение

1...345678...2030...53