ai-агенты. - страница 9

AI‑агенты в крупном бизнесе: где сейчас рынок, что построили мы и как внедрять, чтобы взлетело

Привет, Хабр! Я, Катрушенко Максим, занимаюсь внедрением ИИ в Первой Грузовой компании — крупном железнодорожном операторе на рынке грузовой логистики. Последние полгода активно изучаю тему использования ИИ‑агентов в больших компаниях. Многие рассказывают захватывающими истории, как раньше ничего не работало, а теперь «полетело», кто‑то смело делится провалами. Хочу поделиться, что получилось сделать у нас за довольно ограниченный срок и какой опыт мы извлекли.

продолжить чтение

Gemini API: получаем ключ, разбираемся в моделях и платим из России

Я подключаю API нейросетей почти каждую неделю. Собираю пайплайны для генерации контента, тестирую модели под задачи клиентов, веду сервис, который гоняет запросы через десяток провайдеров. Дольше всего из всех провайдеров я разбирался с Gemini: модели у Google сильные, а вот добраться до них сложнее, чем до любых других.

продолжить чтение

Компилятор как первый ревьюер: петля верификации Go‑кода, который написал агент

Год назад мой типичный пулл‑реквест писался руками часа три и ревьюился минут двадцать. Сейчас четыреста строк агент выдаёт за минуту, а ревью того же дифа занимает час: приходится вычитывать уверенно написанный чужой код, в котором ошибка выглядит ровно так же убедительно, как правильное решение. Узкое место переехало с набора кода на его проверку, и усилием воли оно не расширяется.В августе у Google вышел текст о том, почему Go хорошо подходит для разработки с агентами

продолжить чтение

ОК или НеОК: как мы строили LLM‑судью и дважды меняли формулу вердикта

У нашего AI‑агента поддержки было десять метрик и ноль ответов на главный вопрос: какую долю обращений он решает?Судья, который читал только текст диалога, ставил 18/20, а проверка по реальным вызовам инструментов давала 8/20. Текстовые проверки считали правдоподобный ответ верным и не могли отличить его от подтвержденного. Самодельный «процент фантомных эскалаций» оказался измерением того, насколько слова бота согласованы с его же внутренними флагами. Каждая метрика что‑то измеряла, и ничего продуктового

продолжить чтение

Как собрать AI-контур на VPS: подписки ChatGPT и Claude, OmniRoute, LiteLLM и разработка без VPN

Думаю, практически каждый разработчик из России рано или поздно задавался вопросом: можно ли наконец перестать плясать с VPN и прокси, чтобы просто пользоваться нейросетями — и в собственных проектах, и непосредственно во время разработки?

продолжить чтение

Маршрутизация моделей кажется простой задачей. Но только до продакшна

продолжить чтение

От LLM-портала до фабрики внутренних агентов: как в Авито строят корпоративного ассистента «Виталик»

Привет! Меня зовут Никита, я старший DS-инженер в Авито. В этой статье расскажу, как мы строили «Виталика» — нашу корпоративную экосистему ИИ-агентов. Отвечу на три главных вопроса: как процесс становится агентом, как сделать систему production-ready и куда развивать её дальше.Статья будет полезна ML-инженерам, AI-архитекторам и техническим лидам, которые строят агентные системы на базе LLM в корпоративной среде.Якорный кейс про закупку программного обеспеченияАгентами становятся успешные процессы

продолжить чтение

Anthropic публикует системные промпты Claude. Разбираем, как они менялись от Haiku 3 до Opus 5

Что Claude получает ещё до первого сообщения пользователя, зачем модели отдельные инструкции по работе с инструментами и длинными задачами и какие идеи из system prompts можно использовать в собственных AI-ассистентах.Когда мы отправляем Claude первый запрос, для пользователя диалог только начинается.Для модели нет.До пользовательского сообщения Claude уже получает системную инструкцию, которая задаёт контекст работы: кто модель, какая сейчас дата, как оформлять ответы, как работать с доступными инструментами, что делать с неопределённостью и какие ограничения учитывать.

продолжить чтение

Cursor запустил Origin: конкурента GitHub для AI‑агентов

Cursor начал развёртывание Origin: собственного сервиса для хранения кода, рассчитанного на работу с большим количеством AI‑агентов. Платформа была анонсирована в июне как альтернатива традиционным Git‑хостингам, а теперь стала доступна в ранней бете пользователям платных тарифов Cursor.На старте Origin поддерживает репозитории, пул‑реквесты, просмотр и поиск кода, а также синхронизацию с GitHub. Репозитории можно создавать через вкладку Codebase или выборочно импортировать из GitHub.

продолжить чтение

Что настоящего осталось в программисте?

Привет, Хабр !А вот реально, что настоящего осталось в программисте когда вокруг llm ? Где его суть и индивидуальность, где теперь его ценность ?Дисклеймер

продолжить чтение