llm. - страница 123

llm.

Я построила диагностику «стоит ли это автоматизировать» — и она трижды говорила глупости. Разбор ошибок

Инфографика-диалог из четырёх реплик между заказчиком и аналитиком, мемная

продолжить чтение

Get Shit Done: Кто виноват и что делать?

Как создатель главного фреймворка для кодовых агентов скомпрометировал проектВ мае 2026 года один из самых востребованных AI-инструментов для создания инженерной среды вокруг Claude Code и других кодовых агентов внезапно превратился в реальный кейс инцидента безопасности.Проект Get Shit Done (GSD), который многие разработчики считали «операционной системой для AI-агентов», оказался вовлечён в классический crypto rug pull.Создатель исчез.Токен рухнул.Сообщество срочно форкнуло проект и начало аудит безопасности кода.

продолжить чтение

RAG в энтерпрайзе: почему демо работает, а прод нет

Представьте себе типичное совещание. Кто-то из руководства возвращается с конференции, садится напротив и говорит: «У них там бот по внутренней документации, надо себе такой же. До конца квартала».Через четыре месяца у тебя есть Pinecone, OpenAI API, две недели работы над парсингом PDF и чат-бот, который на демо отвечает на пять подобранных вопросов идеально. А на шестой, который задаст любой нормальный сотрудник, отвечает уверенным бредом.Дальше про то, что именно между этими двумя состояниями происходит. Но без «правильной архитектуры RAG», потому что такой не существует.

продолжить чтение

AI-агент для финансовых процессов: как мы научили ИИ считать числа из базы данных без галлюцинаций

ИИ-агент в «Первой Форме» работает со всеми типами бизнес-процессов: документы, регламенты, задачи, заявки, договоры. Текстовые вопросы он закрывал хорошо с самого начала. А вот финансовые — с галлюцинациями. Мы переделали подход — и теперь агент отвечает точно, с совпадением с SQL до рубля. Ниже — как именно это устроено.Почему RAG не умеет считать

продолжить чтение

LLM не работает за вас. Она работает с вами

Опыт после обучения 10+ коллег: почему одни ускоряются в разы, а другие получают уверенную кашу.За последние пару месяцев я обучил свою команду, как встроить LLM в рабочий процесс.Не «поиграться с ChatGPT вечером». Не «задать вопрос, как сделать то-то». А именно начать использовать LLM в реальной работе: код, тексты, анализ, ревью, документация, исследование, планирование задач.Мой вывод стал неожиданностью для меня:LLM не работает за вас. Она работает с вами.

продолжить чтение

Сапожник с сапогами

ИИ на службе... на службе технической поддержки. История про то, как использование больших языковых моделей помогло оптимизировать работу службы технической поддержки крупного Холдинга. А также размышления про то, к чему это может привести в итоге.Когда перед департаментом информационных технологий крупного отечественного Холдинга встала задача внедрения инструментов ИИ в бизнес-процессы Холдинга, то одним из перспективных направлений приложения усилий была выбрана оптимизация работы собственной службы технической поддержки с помощью больших языковых моделей.

продолжить чтение

Когда Claude Code ошибается не по своей вине: документационный долг в соло-проектах

TL;DRУ соло-разработчика CLAUDE.md устаревает быстрее кода. Через пять-шесть итераций фич он начинает уверенно врать, и Claude верит ему, потому что у него больше нечему верить. Ниже - про понятие документационного долга, кейс с пропавшей подсистемой, пять проверок руками на пятнадцать минут и метод двух слоев + двух сессий, который заменяет код-ревью для соло-разработчика. Главный вывод: одноразовая чистка не работает, документация для AI - это процесс (сюрприз!), не артефакт.1. СимптомОткрываю Claude Code, прошу «продолжить вчерашнюю работу с ХХХ». Он уверенно вызывает функцию validate_post_length

продолжить чтение

Когда нейросети перестанут галлюцинировать? И почему на «что за дичь» они несут ещё большую дичь?

Каждый, кто работал с большими языковыми моделями (LLM), знает эту боль. Ты задаёшь вопрос. Бот выдаёт уверенный, красивый, но абсолютно ложный ответ. Ты пишешь: «Что за дичь ты несёшь?» Бот извиняется: «Вы абсолютно правы, вот исправленный вариант». И выдаёт ещё большую дичь, чем в первый раз. Прямо как студент на экзамене.Сегодня разбираемся, почему так происходит, и когда это наконец починят. Спойлер: не скоро и не полностью.Анатомия "галлюцинации"Начнём с выдуманного примера классического диалога:Пользователь:Кто написал роман «Солярис» в 1972 году?ИИ:

продолжить чтение

___, или «Заголовок намеренно оставлен пустым»

Статья 3 из цикла «Слова, которых нет»Начало здесь >>> и здесь >>>Возвращаюсь к случаю, с которого этот цикл начался.

продолжить чтение

ИИ-боты сканируют даже логи TLS-сертификатов. Любая информация используется для обучения LLM

Согласно статистическому отчёту State of AI Traffic от компании по компьютерной безопасности Human Security, за последний год резко увеличилась активность ИИ-агентов, ботов и ИИ-инструментов в интернете.Например, трафик от ИИ-агентов увеличился почти в 80 раз (на 7851%), трафик от ИИ-скраперов — на 597%. Весь ИИ-трафик за последний год увеличился на 187%, а в целом он растёт в восемь раз быстрее, чем человеческий.

продолжить чтение