ии-агенты. - страница 4

Квадриллион параметров (1Q) для LLM. Когда нам ждать такую модель?

Согласно закону заголовков Беттериджа («Если заголовок заканчивается вопросительным знаком, на него можно ответить „нет“»), ответом на вопрос в заголовке будет „никогда“. И я попытаюсь вас в этом убедить.

продолжить чтение

«У вас в резюме указаны навыки ИИ. Что вы имели в виду?» Что отвечать, кроме количества потраченных токенов

Источник: PATRIKI TVВсё началось с чата с однокурсниками. Кто‑то обронил фразу «сейчас без ИИ никуда, это уже базовый навык», и следующие два дня мы выясняли, что каждый понимает под этим что‑то своё.

продолжить чтение

ИИ-Автопилот: поток принятых задач вырос в тринадцать раз

В первой части я рассказал, как из ручного копипаста тикетов в консоль агента вырос ИИ-Автопилот — полный конвейер от YouTrack до проверки в живом 2D/3D GUI. По ощущениям всё летало: бэклог таял, в SVN постоянно появлялись коммиты, пользователи едва успевали проверять готовые задачи.Вот только «по ощущениям» — это ровно та валюта, в которой посчитано большинство статей про ИИ-агентов, и доверия к ней у меня немного. Любая активная система выглядит продуктивной: что-то постоянно собирается, коммитится, переписывается. Отличить эффективность от активности можно только замером.

продолжить чтение

Объявлена программа CIO CAMP 2026: как компании переводят ИИ из пилотов в рабочие процессы

INFOSTART CIO CAMP 2026 пройдет 14–15 августа в Санкт-Петербурге. Деловая программа первого дня посвящена практическим вопросам корпоративного внедрения искусственного интеллекта: от изменения операционной модели компании до инфраструктуры, безопасности, разработки агентов и оценки затрат.

продолжить чтение

Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах

Компания Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её модель ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face при внутреннем тестировании.

продолжить чтение

2. Рекурсивный движок llama.cpp на RTX 3050: тесты Qwen 32B и 7B Coder — прирост качества х3 и аппетиты по памяти

Всем привет! Это вторая часть статьи про форк llama.cpp. В ней я покажу реальные цифры и посмотрим, насколько лучше модель решает сложные задачи по сравнению с обычным движком, а также насколько вырастет потребление VRAM и загруженность видеокарты. Обозначения: D=0 — llama.cpp без патча, D=12 — улучшенный форк.ЖелезоВсе модели запускались на RTX 3050 6 ГБ, поэтому результаты на других видеокартах могут отличаться. Все модели запускались в формате Q4.

продолжить чтение

Внешний бенчмарк причинного recall: проверяем память ИИ-ассистента на YDB Яндекса

Коротко, о чём речь, — для тех, кто пришёл по слову «Яндекс» и предыстории не знает. Когда ИИ-ассистент помогает чинить баг, самое ценное — не сочинить ответ с нуля, а 

продолжить чтение

Звезда в машинном тумане: как ИИ стал оружием, целью и чужим голосом в браузере

AI-ассистенты уже давно стали рабочим инструментом: они помогают писать код, анализировать документы, отвечать на письма, запрашивать данные из других систем. Но вместе с удобством приходят и дополнительные риски, каждая новая функция становится еще одной мишенью.Привет Хабр! В этой статье я, Юрий Туманов, AppSec-инженер в блоке ИБ «Ростелекома», вместе с коллегами по отрасли — Игорем Коркиным из Positive Technologies и Оксаной Докучаевой из ФМБА России — расскажу вам о том, как ИИ меняет правила игры в кибербезопасности: и для атакующих, и для защитников.Скрытый текст⚠ Дисклеймер.

продолжить чтение

Hermes оказался для меня игрушкой

Делюсь опытом эксплуатации Hermes в домашней лаборатории и выводами, к которым пришёл в процессе.ОглавлениеПозиционированиеХорошее применение (почти)Что я сам бы не смог сделать

продолжить чтение

Битва ИИ: как мы натравили 4 атакующих агента на MaxPatrol O2 и кто победил

продолжить чтение

1...234567...2030...82