llm. - страница 254

llm.

Когда одного агента мало: практический кейс применения мультиагентной системы

продолжить чтение

Нейро-дайджест: ключевые события мира AI за 3-ю неделю октября

Привет! Это новый выпуск «Нейро-дайджеста» — коротких и полезных обзоров ключевых событий в мире искусственного интеллекта и технологий.Меня зовут Вандер

продолжить чтение

H2O LLM Studio: как дообучить языковую модель под свои задачи, не привлекая внимания датасаентистов

продолжить чтение

От экспериментов с ИИ до AI-Native: уровни зрелости и архитектура. Часть 2

Всем привет! Это продолжение статьи о трансформации подхода к использованию ИИ — от базового применения к AI-Native.В первой части мы разобрали уровни зрелости искусственного интеллекта, ключевые этапы ИИ-трансформации и классификацию приложений и модальностей LLM.Читать первую частьВо второй части:Эволюция инженерных практикОт Software к Trustware: в процессе непрерывной технологической трансформации AI-Powered Trustware Development Lifecycle

продолжить чтение

Небольшое количество примеров может отравить LLM любого размера

Команда AI for Devs подготовила перевод исследования в котором учёные показали: чтобы встроить «бэкдор» в большую языковую модель, вовсе не нужно контролировать огромную долю обучающих данных — достаточно около 250 вредоносных документов. Этот результат переворачивает представления о масштабируемости атак через отравление данных и ставит новые вопросы к безопасности ИИ.

продолжить чтение

От LangChain к LangGraph: детально разбираемся с фреймворками и всей Lang-экосистемой

LangChain или LangGraph? Какой фреймворк для ии-агентов выбрать? А может быть LangSmith? Или LangFuse? LangFlow? Если вы сходу не отличаете все эти Lang между собой или просто хочется побольше узнать о внутренностях LangChain и LangGraph, то добро пожаловать в эту статью, которую мне хотелось сделать фундаментальной, чтобы ответить сразу на все возникающие вокруг LangChain вопросы.Поговорим про архитектурные различия между LangChain и LangGraph, их подходы, посмотрим как это выглядит в коде, поищем лучшие точки применения и взглянем на сформированную экосистему вокруг.

продолжить чтение

Как ИИ-агенты учатся работать в браузере, и почему это может перевернуть будущее веба

продолжить чтение

Gemini 3 Pro умеет за один промпт создать полноценную симуляцию macOS или Windows прямо в браузере

Google представила новую демонстрацию возможностей модели Gemini 3 Pro

продолжить чтение

ИИ-агенты выходят из лаборатории: бизнес учится доверять нейросетям. Пересказ исследования G2

Исследование G2 «A Leap of Trust: AI Agents Are Winning Hearts and Wallets» показывает: 2025 год стал моментом, когда ИИ-агенты перестали быть лабораторным экспериментом и вошли в операционную реальность. Три из четырёх компаний уже инвестировали в автономные системы, а более половины готовятся увеличить бюджеты. Мы выделили главное из отчёта — как меняется мотивация бизнеса, где агенты приносят измеримый эффект и почему доверие становится новой валютой цифровой эпохи.Дисклеймер: это выжимка из исследования компании G2. Материал подготовила редакция «

продолжить чтение

Cursor делает разработчиков менее эффективными?

Одно любопытное исследование опубликовала некоммерческая организация Model Evaluation and Threat Research (METR). Они пригласили 16 опытных разработчиков, работающих над крупными open-source репозиториями, чтобы те исправили 136 реальных багов. Оплата составила 150 долларов в час. Части разработчиков выдали для работы AI-инструменты, другим — нет. Исследователи записывали экраны участников, а затем изучили и проанализировали 146 часов видеозаписей. Вывод оказался следующим:

продолжить чтение