llm. - страница 158

llm.

Как я дообучал модель на своих текстах после провала статьи на Хабре

Привет, Хабр.Это будет не типичная статья в стиле «10 причин, почему ИИ уже заменил копирайтеров», а история фэйла с человеческим лицом.Не так давно я выпустил на Хабре статью и вполне заслуженно собрал минусов и комментов, которые были очень в точку. Например

продолжить чтение

Ваш любимый ИИ не умеет считать. Что ещё скрывает текстовая модель?

Технократический разбор для инженеров и бизнес-аналитиков. Без преувеличений и продающих лозунгов.Данная статья представляет собой результат кабинетного исследования об основных особенностях работы ИИ (LLM, модель). Здесь в систематизированном виде относительно простым языком описано, как реализуется вся та “магия” про ИИ, с которой мы сталкиваемся сами или слышим в восторженно-продающих материалах.Сразу уточню, что под ИИ тут понимается именно публичная Большая языковая (текстовая) модель (LLM), вроде ЧатаГПТ, ГигаЧата, Дипсика и др.В этой статье мы:

продолжить чтение

Positive Technologies научила нейросеть находить вирусы, «читая» файлы как текст

Компания Positive Technologies разработала нейросеть для обнаружения вредоносного кода. Модель ByteDog основана на архитектуре «трансформер», которую используют LLM (большие языковые модели). В отличие от классических моделей, ByteDog работает не с текстом или изображениями, а анализирует и понимает файлы как они есть — в виде байтов. Это позволяет ей определять вредоносное ПО на 20% точнее, чего раньше не могла достичь ни одна классическая модель машинного обучения. Это первая подобная разработка в информационной безопасности в России и Европе.

продолжить чтение

Вышел Claude Opus 4.7. Модель уже доступна в Veai для JetBrains IDE

Anthropic выпустили Claude Opus 4.7. Новая модель сосредоточена на агентных и инженерных задачах. Cursor зафиксировал рост с 58% до 70% на своём бенчмарке, CodeRabbit — улучшение recall на 10% при стабильной точности, Rakuten — трёхкратный рост решённых production-задач.

продолжить чтение

Anthropic выпустили Claude Opus 4.7

Сегодня Anthropic объявила о выходе Claude Opus 4.7. Модель стала заметным шагом вперёд в программировании: в тестах на реальных задачах Cursor зафиксировал рост с 58% до 70%, CodeRabbit отметил улучшение recall на 10% при стабильной точности, а Rakuten — трёхкратный рост решённых production-задач по сравнению с Opus 4.6.

продолжить чтение

AI-ready ITSM: платформа или коробка – и почему это главный вопрос 2026 года

Ещё три года назад ИИ в ITSM представлялся как просто чат-бот на входе, который пытается угадать категорию тикета. Сегодня уже другой разговор: ведущие платформы встраивают AI не как надстройку над тикет-системой, а как архитектурный слой, который участвует в маршрутизации, предсказывает инциденты до их возникновения, автономно закрывает типовые обращения и генерирует постмортемы. Рынок уже видит пользу — по данным Forrester

продолжить чтение

GenAI Exploit Round-up Report Q1 2026

Консорциум OWASP выпустил GenAI Exploit Round-up Report Q1 2026 — и это, пожалуй, один из самых показательных материалов о том, как быстро ИИ-риски перешли из теории в практику. В отчёт вошли инциденты за период с 1 января по 11 апреля 2026 года, а сам документ вышел 14 апреля 2026 года. Авторы собрали 8 заметных кейсов и прямо фиксируют сдвиг: главная проблема уже не только в «неправильных ответах» моделей, а в идентичностях агентов, оркестрации, правах доступа и уязвимостях цепочки поставок.

продолжить чтение

Мы отдали управление роботами OpenClaw. Что из этого вышло

Началась новая эра – эра автономных агентов. Пользователь пишет запрос на естественном языке, и агент сразу решает поставленную задачу. Или не сразу. Но в таком случае он самостоятельно ищет способ получить недостающие навыки для выполнения запроса.

продолжить чтение

Как измерить LLM для задач кибербеза: обзор открытых бенчмарков

Привет, Хабр!

продолжить чтение

Токсичный контент, промпт-хакинг и защита ИИ — всё о Guardrails для LLM

Когда мы говорим о безопасности веб-приложений, у нас есть десятилетия накопленного опыта. SQL-инъекции, XSS, CSRF — всё это давно задокументировано, есть готовые инструменты защиты, best practices и целые фреймворки безопасности. Но когда в архитектуру приложения добавляется языковая модель, картина кардинально меняется.LLM — это не функция с предсказуемым поведением. Это вероятностная система, которая может быть убеждена изменить своё поведение правильно составленным текстом. И это фундаментально новый класс уязвимостей, к которому большинство разработчиков пока не готовы.

продолжить чтение