Блог компании BotHub. - страница 7

Claude Fable 5 нашла контрпример к гипотезе Якобиана — ИИ «сломал» 87-летнюю математическую гипотезу

Claude Fable якобы нашла контрпример к гипотезе Якобиана (Jacobian Conjecture) — проблеме, которая оставалась открытой с 1939 года.О находке рассказал математик и сотрудник Anthropic Левент Альпёге (Levent Alpöge). В публикации в X он в шутливой форме поблагодарил своего друга Akhil за вопрос и Claude Fable 5 «за работу во время финала чемпионата мира».За шутливым тоном скрывается серьёзный математический результат: опубликованная конструкция выглядит как явный контрпример, который можно проверить обычными вычислениями.Что такое гипотеза Якобиана

продолжить чтение

Google разрабатывает ИИ-чип Frozen v2, который «зашьет» архитектуру Gemini непосредственно в кремний

Google работает над новым серверным ИИ-чипом под внутренним названием Frozen v2, который должен существенно повысить эффективность выполнения моделей Gemini. По данным The Information, компания планирует реализовать часть архитектуры модели непосредственно на аппаратном уровне, что позволит сократить энергопотребление и увеличить производительность инференса. Проект пока находится на ранней стадии и официально не анонсирован.

продолжить чтение

Тест Тьюринга для Fable 5. Сможет ли флагманская модель Anthropic прикинуться человеком?

Про тест Тьюринга слышали все, и почти все представляют его как какой-то экзамен: есть машина, есть список вопросов, машина отвечает — и либо проходит, либо нет. Так вот, ничего этого не существует. Ни списка, ни методики, ни проходного балла.

продолжить чтение

29 стран подписали соглашение о создании Всемирной организации по сотрудничеству в сфере ИИ

В Шанхае представители 29 государств подписали соглашение об учреждении World AI Cooperation Organization (WAICO) — новой межправительственной организации, которая должна стать площадкой для международного сотрудничества и координации подходов к развитию и регулированию искусственного интеллекта. Инициатива была предложена Китаем и официально оформлена накануне открытия ежегодной конференции World Artificial Intelligence Conference (WAIC 2026).

продолжить чтение

Автономная система ИИ-агентов атаковала Hugging Face: защититься помогла LLM

Hugging Face раскрыли подробности недавнего инцидента безопасности. По заявлению компании, это первый случай, когда атака на ее инфраструктуру была целиком проведена автономной системой ИИ-агентов — от первоначального проникновения до последующего развития атаки.

продолжить чтение

Атака на LLM, которую нельзя исправить патчем

Не так давно вопросы безопасности искусственного интеллекта считались скорее темой для научных докладов, чем реальной проблемой для бизнеса. Большинство компаний, внедрявших LLM, сосредоточились на нескольких первоочередных задачах. Они стремились как можно быстрее выпустить минимально жизнеспособный продукт. Также они подключали к нему корпоративные знания, обучали помощника отвечать клиентам и автоматизировали работу техподдержки. Вопросы безопасности при этом откладывали. Такой подход был

продолжить чтение

Thinking Machines Lab представила Inkling – open-weights модель с 975 млрд параметров и ставкой на кастомизацию

Стартап Thinking Machines Lab, основанный бывшим CTO OpenAI Мирой Мурати, выпустил свою первую фундаментальную модель — Inkling. Вместо гонки за лидерством в бенчмарках компания делает ставку на открытые веса, мультимодальность и инфраструктуру для глубокой кастомизации моделей под конкретные продукты.По характеристикам релиз получился одним из самых крупных среди открытых моделей:975 млрд параметров (архитектура Mixture-of-Experts);41 млрд активных параметров на токен;контекстное окно до 1 млн токенов;предварительное обучение на 45 трлн токенов, включающих текст, изображения, аудио и видео.

продолжить чтение

Anthropic полностью переработала Code Review в Claude Code: теперь код проверяет целая команда AI-агентов

Anthropic представила обновлённую систему Code Review в Claude Code, которая заметно отличается от привычного увеличения «времени на размышление» модели. Вместо одного промпта с разной глубиной reasoning компания реализовала несколько отдельных пайплайнов проверки кода — от быстрого локального анализа до распределённого облачного ревью.

продолжить чтение

ИИ зависимость и лекарство от prompt injection (в том числе от системного промпта провайдера)

Повсеместная экспансия различных ИИ-ассистентов во все сферы достигла такой глубины, что её впору сравнить с наркотической зависимостью. Эйфория от кратковременного всплеска производительности, который получается в самом начале внедрении интеллектуальных инструментов, даёт очень быстрый и измеримый экономический эффект, который подстёгивает компании встраивать ИИ в любой процесс.

продолжить чтение

Сравниваем LLM, 12 тестов для среднего класса: три Sonnet против GigaChat 2 MAX и YandexGPT Pro 5.1

В первой статье цикла мы гоняли по 11 тестам Opus 4.8, GPT 5.5 и Gemini 3.1 Pro, во второй устроили дуэль тяжеловесов Claude Fable 5 и GPT 5.5 Pro. В комментариях нас несколько раз спросили: а что там у моделей попроще и, главное, у отечественных? Спрашивали — отвечаем. Сегодня на ринге средний класс: три поколения рабочей серии Anthropic — Claude Sonnet 4.5, Sonnet 4.6 и свежий Sonnet 5 — против старших отечественных моделей: GigaChat 2 MAX от Сбера и YandexGPT Pro от Яндекса.

продолжить чтение

1...5678910...2030...284