Natural Language Processing. - страница 21

Новый режим «Книги» от Character.AI позволяет «пройти» книгу как ролевую игру

Компания Character.AI представила

продолжить чтение

Как за 30 000р дообучить модель, которая работает на уровне GPT-5.4 — на задачах российских учителей

Продолжение. В первой статье мы протестировали 30 нейросетей на задачах для российских учителей. Российские модели заняли последние места. Но строчка #9 — наша: дообученная модель за ~30 000₽, которая работает локально. Вот как мы её сделали.Зачем вообще дообучатьВ комментариях к первой статье справедливо спросили — почему российские модели плохи? GigaChat-2 Max набрал 2.39 из 4, YandexGPT 5.1 Pro — 2.51. Ответ простой: в обучающей выборке этих моделей мало российских школьных задач, они оптимизированы под чат, не под образовательную деятельность.

продолжить чтение

785 статей. 26 доменов. Для агентов, не людей

Live: https://happyin.space/ Repo: https://github.com/AnastasiyaW/knowledge-space (MIT)Когда агент пишет код в пустом проекте, он тратит первые 30-40% токенов на понимание того, что происходит вокруг. Не на работу - на ориентацию. README рассказывает мотивацию, туториал ведёт за руку, API-reference описывает параметры. Ни один из этих форматов не отвечает на вопрос, ради которого агент и пришёл: “вот задача, какой паттерн скопировать и где здесь грабли?”

продолжить чтение

«Я ща его ударю». Полтора года собирала жалобы на нейросети от нытиков и классифицировала

Дело было так. Я года полтора-два сижу в профильных телеграм-чатах про всякие эйяй – там разрабы, копирайтеры, редакторы, вайбкодеры и вайбкуколдеры (это кто смотрит, как другие вайбкодят, а у самого руки не доходят). Народ там не на трибуне выступает, скорее говорит, что на сердце, так что читать чистый кайф. Особенно, как они ссорятся с нейронками и потом в чат на них жалуются. И одни и те же жалобы у самых разных людей на разные модели.

продолжить чтение

Kimi выпустили открытую модель K2.6 для долгих задач по программированию

Moonshot AI представила Kimi K2.6 — открытую модель, заточенную под длинные задачи в программировании и агентные сценарии. В компании утверждают, что новая версия лучше справляется с многошаговой работой: может дольше удерживать контекст, чаще корректно вызывать инструменты и эффективнее координировать несколько субагентов.

продолжить чтение

NLP глазами CVшника. Чем мне запомнилась поездка в Марокко на конференцию EACL 2026

Привет, Хабр! Я — Андрей Москаленко, научный сотрудник лаборатории FusionBrain, AIRI, занимаюсь компьютерным зрением. В конце марта я оказался на своей первой конференции по NLP — EACL 2026. В этом году она впервые проходила в необычном для европейской конференции месте, а именно в Марокко, в Африке. Из нашей команды FusionBrain.Robotics со мной было двое коллег, с которыми мы представляли две статьи, написанные в соавторстве с командой «Прикладное NLP» AIRI.

продолжить чтение

Как переложить нагрузку по code review с разработчиков на LLM

Привет! Меня зовут Марк Каширский, я работаю DS-инженером в команде LLM Авито. Создаю инструменты для разработчиков, чтобы им было легче и удобнее работать. В статье рассказываю, как мы автоматизировали процесс Code review при помощи больших языковых моделей.В этой статьеПричины для автоматизации процесса Code reviewАрхитектура системы Code reviewВыбор LLM-моделиЭтапы ML-пайплайнаМетрики решения

продолжить чтение

Что такое искусственный интеллект (не нейросети) и какие у него есть виды

Привет, Хабр! На сегодняшний день большинство из нас пользуется инструментами искусственного интеллекта и иногда могут даже не знать об этом. Но задумывались ли вы, что такое ИИ? Многие знают термин "Нейросети" и часто приравнивают его к ИИ, но это не так. Нейросети – это одна из разновидностей ИИ, о которых я расскажу в этой статье.Прежде чем начать разбираться в том, как работают разные ИИ, и какие они вообще бывают, давайте разберемся, что вообще такое искусственный интеллект. Для начала, давайте определимся с основными понятиями."Техническая интеллектуальная система – система, обладающая интеллектом"

продолжить чтение

Anthropic выпустили Claude Opus 4.7

Сегодня Anthropic объявила о выходе Claude Opus 4.7. Модель стала заметным шагом вперёд в программировании: в тестах на реальных задачах Cursor зафиксировал рост с 58% до 70%, CodeRabbit отметил улучшение recall на 10% при стабильной точности, а Rakuten — трёхкратный рост решённых production-задач по сравнению с Opus 4.6.

продолжить чтение

Как заставить LLM ̶ ̶г̶а̶л̶л̶ю̶ ̶ эволюционировать

Привет, Хабр! На связи Олег и Камилла из команды применения больших языковых моделей ecom.tech

продолжить чтение

1...10...192021222324...3040...53