Что умеет и где ломается Jev: большое тестирование
В работе с моделями важно не только знать их точность, скорость и цену, но и понимать, где им можно доверять, а где нужна дополнительная проверка. Многие ограничения обнаруживаются уже в процессе интеграции — и о них хотелось бы знать заранее.
Как мы описываем тысячи таблиц с помощью LLM
Привет, Хабр! Меня зовут Сергей Третьяков. Я product owner MWS Data Scout — сервиса, который описывает таблицы баз данных с помощью больших языковых моделей (LLM).
Как перестать ревьюить правки, о которых никто не просил
С приходом ИИ‑агентов в разработку, кода стало больше, а вместе с ним и шума. Пулреквесты растут, держать агента в рамках задачи становится сложнее, а через голову человека проходит всё больше кода. Ревью превращается в основную нагрузку и зелёные цифры добавленных строк в заголовке начинают напрягать ещё до того, как его откроешь.Типичная картина: пулреквест на небольшую фичу, а в нём правки в десятке файлов, которые к задаче не относятся. По отдельности они могут быть полезными, но вместе они превращают пулреквест в солянку.Проблема: агент видит больше, чем успевает сделать
Я всем помогал, а в отчёте пусто. Как ИИ‑агенты вспомнили за меня полгода работы
Я всем помогал, а в отчёте пусто. Как ИИ‑агенты вспомнили за меня полгода работыВ июле пришло время отчёта за полугодие. От меня ждали побед и результатов, а лучше всего с цифрами. Две строчки я написал за час. На третьей остановился и завис: не мог вспомнить, чем был занят.Я открыл календарь и полистал назад. Июнь, май, апрель. Встречи, созвоны, планёрки. Март как будто вырезали, хотя в марте я точно работал. «Непонятно…»
Делаем 3D ассеты: ChatGPT + Blender
Продолжаем эксперемнтировать с 3D-моделлингом. В сегодняшнем эксперименте зарекрутируем таланты ChatGPT 5, чтобы он написал готовые скрипты для Блендера.Блендер сюрпризВ западном интернете все чаще обсуждается воркфлоу, суть которого проста: ЛЛМ, обычно в этом контексте фигурирует Claude Opus, прикручивают к Blender’у с помощью MCP-коннектора. Краткая справка: MCP, он же Model Context Protocol, играет роль специальной смычки, помогающей ИИ напрямую коннектиться к внешним базам данных, сайтам и сторонним сервисам. С помощью MCP, ИИ можно дать доступ к инструментарию, в которым мы обычно работаем ручками.
В OpenAI раскрыли новый тип атак на ИИ‑агентов
Компания OpenAI рассказала о новом типе атак на ИИ‑агентов. Он предполагает внедрение вредоносной инструкции, которая заставляет модель не только выполнить команды злоумышленника, но и перенести саму промпт‑инъекцию в другие сообщения или файлы для дальнейшего распространения.
GenAI Pretest: как в Авито научили ИИ предсказывать «бизнесовое» качество ТВ-рекламы ещё до съёмок
Привет, Хабр! Меня зовут Андрей Корнеев, я занимаюсь аналитикой медиа-маркетинга в Авито.Представьте: ролика ещё нет. Есть только его прототип, который сделан с помощью ИИ, а вы уже знаете, насколько он будет хорош для бизнеса, и знаете это за десятки рублей, без съёмочного бюджета, без двух месяцев тестов и нервных созвонов с агентством. Звучит как фантазия. Но в 2026 году у нас это работает и уже двигает деньги: выбор ролика по модели поднимает нашу валидированную метрику качества на +17.7%, и это подтверждено на живых кампаниях.
Нейросеть, которая молчит
15 сентября стартап TypeSafe AI вышел из стелса с раундом $40 млн и необычной новой моделью Jev. Она не умеет разговаривать и не пишет текста.Зачем она нужна? В компаниях AI чаще всего не болтает с человеком, а принимает тысячи мелких решений внутри программ: куда отправить письмо, насколько срочна заявка, похож ли платеж на мошенничество. Сейчас их все чаще отдают LLM, и она каждый раз генерирует текст, хотя программе нужно одно решение.
Emergence AI провела эксперимент с виртуальными городами для ИИ‑агентов
Американская компания Emergence AI рассказала о результатах эксперимента с восемью виртуальными городами. В каждом из этих городов работали по десять ИИ‑агентов. При искусственно созданных атаках ни одно сообщество не смогло успешно пройти все испытания.

