llm. - страница 100

llm.

GigaChat vs Opus в агентском аудите файрвола: попытка сравнения

Взяли один агент, один навык и одну выгрузку правил Ideco NGFW – и прогнали её через GigaChat Max и Claude Opus 4.8. Рассказываем, что из этого получилось, почему «настоящего» агентского теста не вышло и сколько всё это стоило в токенах и рублях.Зачем мы это затеялиВ прошлой статье – «Пещера Аладдина для безопасника»

продолжить чтение

Как тестировать LLM-фичи: пишем автоэвалы и гоняем их в CI

Привет! У нас в проде живёт бот, который отвечает на вопросы по документации продукта — обычный RAG. Первые месяца три мы катили его, как все: поправил промпт, прогнал пяток вопросов руками, поставил в голове галочку «вроде стало лучше» и выкатил. Закончилось это предсказуемо. Коллега подкрутил промпт ретривера под свой кейс и по дороге сломал мой, причём заметили мы это через две недели по жалобе пользователя. А когда обновились на свежую версию модели, часть ответов просто уехала непонятно куда, и никто не мог сказать, стало в среднем лучше или хуже. Потому что «лучше» жило у нас в головах и мерялось настроением.

продолжить чтение

«ChatGPT с AliExpress» или лучшая китайская нейросеть: разбираемся в Qwen 3.7

Роли между популярными нейросетями более-менее распределены.

продолжить чтение

Не просто чат-бот: как мы встраиваем MCP-агентов в корпоративную платформу SimpleOne

ИИ-агенты уже умеют писать письма, резюмировать встречи и искать ответы в базе знаний. Но в корпоративной среде этого мало. Пока агент только работает с текстом, он остаётся помощником рядом с процессом, а не участником самого процесса.

продолжить чтение

Anthropic вводит верификацию по паспорту и селфи

Коротко о главном: Anthropic внезапно разослала уведомления. Уже в июле пользователям Claude, возможно, придется проходить реальную верификацию личности. Теперь перед каждым использованием Claude стоит держать паспорт наготове.У Anthropic снова громкие новости!В последние дни многие пользователи Claude, открыв почту, обнаружили письмо от Anthropic.Заголовок выглядит вполне буднично — «Уведомление об обновлении Политики конфиденциальности». Однако содержание шокировало многих: «Мы можем попросить вас подтвердить свой возраст или личность».

продолжить чтение

Искусственный интеллект без крайностей: реальные риски и реальные возможности

Помните, как в детстве казалось, что будущее - это летающие скейтборды из «Назад в будущее 2» и роботы-помощники? Ховерборд, может, еще и не появился, но с роботами-помощниками мы точно не ошиблись - пришло время Искусственного интеллекта.ИИ уже пишет статьи, создаёт изображения, сочиняет музыку, «снимает» видео, генерирует код, пишет отзывы (сам же их и читает по запросу пользователя), готовит SEO-страницы, придумывает посты и новости, заказывает еду через интернет по расписанию. Всё, что раньше делал только человек, теперь делают и LLM.

продолжить чтение

Искусственный интеллект с LangChain. Разработка ИИ-агентов на Python

Представляем новый практический курс по ИИ-агентам на Python от мастера обучающей литературы Владимира Дронова

продолжить чтение

Claude дал неправильную архитектуру. Настоящая ошибка была не в Claude

Как Claude Code помог увидеть, что проблема была не в LLM, а в постановке задачи для embedded-деплояОдин из моих крупных бизнес-проектов - разработка электроники и софта для БПЛА. Дошел до момента, когда на железе после MVP надо стало развернуть корректную воспроизводимую архитектуру деплоя. Конечно, я стал делать это Клодом. Для этого я попросил обнюхать весь проект.Для понимания: проект действительно многосторонний. Ubuntu Linux, патченное ядро и драйвера, радио, сеть, несколько ролей у устройства, пачка собственного софта и утилит. Claude прочитал документы, нашёл скрипты, конфиги, тесты и выдал вполне осмысленный план.

продолжить чтение

Spec-driven development в микросервисах, часть 3: archspec investigate — исследование фичи до кода

Третья, заключительная статья из цикла. Часть 1 — где LLM теряет межсервисный контекст и почему локальных спек недостаточно.

продолжить чтение

Контекстное окно: почему нейросеть забывает части разговора

Представьте, что вы разговариваете с невероятно умным и эрудированным собеседником. Только очень странным. Несмотря на весь свой интеллект и тысячи фактов, которые он непринужденно рассказывает, он не может ничего запомнить. Ваш диалог с ним каждый раз как бы начинается заново. Вы даете ему вводные, задаете вопросы, что-то уточняете, а он, на основе всего этого, выдает ответ.

продолжить чтение