Natural Language Processing. - страница 12

Как мы научили большую языковую модель говорить на карачаево-балкарском

Рис 0. Демо-чатДавно ничего не писал где-либо: разработка занимает много времени. Надеюсь, наш путь будет кому-либо полезен, особенно тем, кто обучает модельки на малоресурсных языках.Большая в данном контексте - это условно. По сути, взяли

продолжить чтение

Гибель богов. Fable и ещё 10 LLM реорганизуют код. Сравнение

Русский и английский оригиналы статьи в моём блоге.Код и материалы.Это подробный разбор одного эксперимента. Я взял god node из реального LangGraph агента и попросил 5 американских и 6 китайских моделей сначала предложить, как её распутать, а потом оценить предложения друг друга. Дальше тремя разными способами пытался понять, кому из них в этом деле верить.ОглавлениеИсходная задача. Что за god node и чем она опасна.

продолжить чтение

Запускаем LLM локально на майнинг ферме из 4 GPU

В последнее время становится все более популярным локальный запуск LLM. У каждогг свои причины, но основные это: проблемы с западными сервисами, нестабильный интернет и утечка данных в открытый доступ (преценденты уже были).В этой статье я расскажу как запускал LLM локально на майнинговом железе, какие тонкости есть при запуске. Расскажу архитектуру моей сборки и примерную стоимость железа. Также протестирую скорость работы с некоторыми наиболее популярными MoE LLM, включая модели от гугла и ChatGPT. По поводу целесообразности подобных сборок решение каждый примет сам исходя из своих задач и финансовых ресурсов.

продолжить чтение

Почему дорогая LLM дороже: экономика инференса, которую видно в твоём 5-часовом лимите

Это очень интересный длиннопост о том, что именно показывают 5-ти часовые и недельные лимиты в Claude / GPT / Gemini и что происходит под капотом

продолжить чтение

Платформа для вайб‑кодинга Base44 запустила собственную ИИ-модель

Платформа для вайб‑кодинга Base44 запустила

продолжить чтение

Harness Bench: как оценить агентский harness и выбрать связку с моделью

Привет! Я Андрей Иванов, NLP-исследователь в R&D-лаборатории red_mad_robot.

продолжить чтение

Галлюцинации недели: Claude Tag, дистилляция от Alibaba и GPT-5.6, который научился жульничать

продолжить чтение

Почему я перестал слать каждый вопрос в LLM: архитектура предсказуемого конвейера

О проекте. Я разрабатываю систему ИИ-поддержки первой линии — «Финлоджик. Контур Поддержки» (FinlogiQ AI Support). Бот принимает обращения через веб-чат и Telegram, понимает суть вопроса, ищет ответ в базе знаний и передаёт сложные случаи живому оператору. Делаю один: начиналось как заказная разработка под клиента, затем выросло в самостоятельный продукт. Это первая статья из цикла о внутреннем устройстве системы.Пара терминов: LLM (large language model) — большая языковая модель, нейросеть вроде YandexGPT или DeepSeek; RAG

продолжить чтение

ContentCombine: как я сделал мультинишевый контент-комбайн и запустил ежедневный SEO-дайджест

Визуализация комбайна

продолжить чтение

LLM Sandbox: пример реализации агента с песочницей [часть 2, практика]

ВведениеСтатья посвящена практической реализации агента с изолированной средой исполнения кода. Рассказываю как устроен агент, который пишет и исполняет код в Docker песочнице.

продолжить чтение