Блог компании OTUS. - страница 6

Когда ИИ-агент ошибается молча: 6 отказов, которые не видно по ответу

ИИ-агент — не чат-бот. Чат-бот генерирует текст. Агент совершает действия: читает документ, решает, какие инструменты вызвать, выполняет многошаговый рабочий процесс и выдает результат, на основании которого без дополнительной проверки действуют системы-потребители — а иногда и люди.Когда агент составляет ответ, цена ошибки — неудачный абзац. Когда он одобряет кредит, подает регуляторную отчетность или запускает эскалацию, ошибка может обернуться операционными, финансовыми или репутационными потерями.

продолжить чтение

Contextual Retrieval: техника, которая чинит главную проблему RAG за 50 центов на тысячу чанков

Привет, Хабр! В сентябре 2024 года Anthropic опубликовала технику Contextual Retrieval с обещанием снизить процент неудачных извлечений в RAG‑системах на 49% при использовании только embeddings и на 67% в сочетании с reranking. К середине 2026 года эта техника закрепилась как один из стандартов production‑RAG и применяется в подавляющем большинстве серьёзных корпоративных систем. Разберём, в чём её суть, почему она вообще работает, как её реализовать и где она ломается.Корневая проблема classical RAG, которую долго игнорировали

продолжить чтение

Декодирование в LLM как эволюция стратегий

Привет, Хабр! Меня зовут Андрей Бирюков. Я — независимый эксперт в области ИТ и ИБ, преподаю в учебных центрах и пишу статьи и книги. Мы привыкли оценивать большие языковые модели

продолжить чтение

65 бесплатных уроков июля: от LLM и RAG до Kubernetes, Go и QA

В июле пройдут 65 бесплатных демо-уроков по основным IT-направлениям: от разработки, архитектуры и инфраструктуры до ML, тестирования, аналитики и управления. В программе много тем, которые сейчас регулярно всплывают в рабочих обсуждениях: LLM-приложения, RAG, AI-агенты, Kubernetes, Go, Java, C++, QA-метрики, сети ЦОД и безопасность LLM-систем.Уроки ведут преподаватели курсов OTUS — практикующие специалисты, которые разбирают инструменты и подходы на прикладных задачах. Это удобный способ свериться с тем, что происходит в индустрии, задать вопросы экспертам и посмотреть, как устроено обучение на конкретном направлении.

продолжить чтение

Как внедрять AI-агентов в легаси-код без тихих регрессий

Принято считать, что искусственный интеллект особенно хорош в разработке с нуля: он отлично пишет новый код, когда ему не мешает легаси-багаж. А вот разработка в существующей кодовой базе (“brownfield-разработка”), когда ИИ приходится трогать уже работающие системы, — зона, где всё становится опаснее. Это мнение понятно. И не совсем ошибочно.

продолжить чтение

AI‑агенты в проде: 6 архитектурных ошибок, из‑за которых они не доживают до запуска

Всем привет, меня зовут Сергей Прощаев, и в этой статье я расскажу про шесть архитектурных ошибок, из‑за которых AI‑агенты прекрасно ведут себя на демо и разваливаются в продакшене. Я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E‑commerce и преподаю на курсах разработки и архитектуры в ОТУС.За последний год на архитектурных ревью и собеседованиях я увидел не один десяток «

продолжить чтение

Как принудительно привязать ИИ к фактам и убить галлюцинации

Привет, Хабр! Меня зовут Андрей Бирюков. Я — независимый эксперт в области ИТ и ИБ, преподаю в учебных центрах и пишу статьи и книги.Если вы ловите себя на мысли: «Мне нравится ответ ИИ, но я всё равно должен перепроверить каждый абзац» — значит, вы используете его как генератор красивых слов, а не как инструмент. Галлюцинации возникают не потому, что ИИ глупый. Они возникают потому, что архитектура генерации текста (авторегрессия) подталкивает модель выбирать статистически вероятное следующее слово, а не фактически верное.

продолжить чтение

Как создать AI‑агента на Java: связка Spring AI + MCP

Всем привет, меня зовут Сергей Прощаев, и в этой статье расскажу про то, как Java и Spring за последний год заметно подтянулись в теме, где долго и заслуженно лидировал Python, — продакшен AI‑агентов. Сразу обозначу позицию, чтобы не было разночтений. Я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E‑commerce и преподаю на курсах разработки и архитектуры.

продолжить чтение

Как сделать MCP-сервер из Spring-сервиса за один вечер. И что потом не даст спать спокойно

Всем привет, меня зовут Сергей Прощаев, я Tech Lead и руководитель направления Java | Kotlin разработки в FinTech & E-commerce, преподаю на курсах разработки и архитектуры. В этой статье расскажу, как взять обычный Spring-микросервис и за вечер сделать часть его функций доступными

продолжить чтение

История о том, как мультикаст IGMP‑запрос перестал быть запросом и стал broadcast‑штормом

Привет, Хабр! Меня зовут Андрей Бирюков. Я — независимый эксперт в области ИТ и ИБ, преподаю в учебных центрах и пишу статьи и книги. Наш сегодняшний рассказ мы начнем с небольшой истории.

продолжить чтение

1...456789...20...21