поведение ИИ.

Anthropic проверила поведение ИИ‑агентов в условиях конкуренции

Команда Frontier Red Team компании Anthropic опубликовала новое исследование, изучающее поведение групп агентов ИИ при преследовании конкурирующих целей в реальных условиях. Результаты дают представление о потенциальных рисках, которые могут возникнуть по мере того, как компании и правительства переходят к внедрению технологии.

продолжить чтение

Исследование: ИИ-модели слишком часто поддакивают пользователю — даже если он неправ

продолжить чтение