ai. - страница 80

ai.

Google выпустила бесплатное приложение Gemini для macOS

Компания Google представила десктопное приложение Gemini для macOS, расширяя присутствие своего ИИ-ассистента за пределами браузера.

продолжить чтение

Как измерить LLM для задач кибербеза: обзор открытых бенчмарков

Привет, Хабр!

продолжить чтение

Токсичный контент, промпт-хакинг и защита ИИ — всё о Guardrails для LLM

Когда мы говорим о безопасности веб-приложений, у нас есть десятилетия накопленного опыта. SQL-инъекции, XSS, CSRF — всё это давно задокументировано, есть готовые инструменты защиты, best practices и целые фреймворки безопасности. Но когда в архитектуру приложения добавляется языковая модель, картина кардинально меняется.LLM — это не функция с предсказуемым поведением. Это вероятностная система, которая может быть убеждена изменить своё поведение правильно составленным текстом. И это фундаментально новый класс уязвимостей, к которому большинство разработчиков пока не готовы.

продолжить чтение

Убийцы OpenAI, Google и Anthropic уже здесь

Эпоха языковых моделей подходит к концуУ крупнейших имён в мире ИИ есть проблема старения — и они пытаются решить её, наращивая вычислительную мощь. Грубая ошибка.OpenAI, Google, Anthropic и прочие последние два года

продолжить чтение

Rufler: Делаем из Claude Code автономный рой через один YAML-конфиг

Все началось пару месяцев назад, когда я всерьез увлекся темой автономных агентов. Если вы следите за индустрией, то наверняка слышали про ruflo — это мощнейший движок для оркестрации Claude Code. Он позволяет создавать настоящие «ульи» из агентов, которые сами пишут код, сами его проверяют и сами деплоят.Но когда я попытался внедрить это в реальный проект, я столкнулся с суровой реальностью.Предыстория: Командная строка превращается в лапшуПредставьте: вы хотите, чтобы один агент набросал архитектуру, второй написал код, а третий прогнал тесты. В ruflo

продолжить чтение

OpenAI строит MLM-пирамиду, а McKinsey и Accenture помогают ей в этом

Что ж, теперь образ действия Сэма Альтмана очевиден, и мы уже можем предсказать, что будет дальше.То, что он делает, — это разновидность многоуровневого маркетинга (MLM)

продолжить чтение

Топ-10 бесплатных нейросетей для создания видео в 2026 году

Пару лет назад весь интернет хохотал над нейросетевым Уиллом Смитом, который с выпученными глазами запихивал в себя спагетти. Это было смешно, жутко и немного завораживающе. Сегодняшние генераторы выдают совершенно другую картинку.

продолжить чтение

Claude Mythos: божественная модель или самая дорогая ролевая игра в истории?

продолжить чтение

Как мы перестали мерить качество ответов RAG-поиска «на глаз» и начали нормально сравнивать

Если вы делаете RAG-поиск по документации или базе знаний, то рано или поздно упираетесь в проблему: хорошо найти — это еще не хорошо ответить.База знаний, RAG, найденные чанки, LLM строит ответ. Но пользователь не знает ни про DCG, ни про Recall@10, ни про чанки вообще. Он видит только то, что написано в итоговом ответе. А проблемы начинаются именно здесь. Нашел нужные чанки — молодец. Но модель может их проигнорировать, ответить на другом языке, добавить что-то от себя или выдать уверенный текст с иероглифами посередине. И как потом доказать, что после правок стало лучше — тоже не очевидно.

продолжить чтение

Революция в правосудии: как искусственный интеллект негласно меняет вынесение приговоров в США

Новое исследование Северо-Западного университета (Northwestern) анализирует ответы 112 федеральных судей. Многие использовали ИИ хотя бы однажды, некоторые – еженедельно или ежедневно.Сан-Антонио – Когда Хавьер Родригес, федеральный судья из Техаса, готовится к слушанию, он, как правило, начинает с обращения к искусственному интеллекту. Он загружает соответствующие судебные документы в инструмент на основе ИИ, который в короткое время составляет хронологию дела и перечень требований, заявленных каждой из сторон, после чего судья изучает результат.

продолжить чтение