- BrainTools - https://www.braintools.ru -

Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок?

Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок? - 1

22 сентября состоялся релиз ожидаемой Claude Opus 5.5, которая, очевидно, обошла по характеристикам многие модели.

Claude Opus 5.5 стал первым релизом с тех пор, как компания Anthropic объявила о необходимости притормозить гонку за самыми мощными моделями. Перед выпуском модель протестировал узкий круг экспертов, в том числе Frontier Design [1] и METR [2]

Как заявили создатели модели, Opus 5.5 — это самая мощная модель из всех, что они тестировали на сегодняшний день. Для нее также были выделены соответствующие меры безопасности, которые стали несколько строже предыдущих. Напомню, что с недавнего времени правительство США требует [3], чтобы Anthropic и другие ИИ-компании не выпускали свои модели на широкую аудиторию, а выдавали сначала доступ — до 30 дней — только проверенным компаниям и ужесточали меры безопасности. 

На сайте Anthropic была выложена информация по поводу новой флагманской модели. По их многочисленным сферическо-вакуумным данным можно возложить на новую модель большие надежды, и глядя на бенчмарки, выпущенные компанией, уже можно сделать некоторые выводы по поводу возможностей Opus 5.5.

Бенчмарки

Бенчмарки Opus 5.5 в сравнении с другими топовыми моделями. Источник.

Бенчмарки Opus 5.5 в сравнении с другими топовыми моделями. Источник [4].

В большинстве тестов новая модель показала сильный результат, превосходящий предшественников. Например, в тесте Agentic coding она показала весомые 66,4% — для сравнения, у предыдущей модели, Opus 5, результат был 52,3%, а у конкурирующей GPT-6 Astra — 57,9%. Также нейросеть превзошла своих предшественников в тесте Knowledge work, получив результат на 111 пунктов Elo отличающийся от прошлых топов (Opus 5.5 – 1 846; Fable 5.1 – 1 735; Opus 5 – 1 708.).

Но не везде нейросеть оказалась прорывной. В тестах Business workflows и Agentic scientific research она показала результат хуже, чем основной конкурент GPT-6 Astra — 40% и 58,7% против 41,4% и 64,6% соответственно.

По информации от самой компании, цена входных и выходных данных снизилась на 20%, а Anthropic заявляет, что в совокупности снизили стоимость выполнения задач примерно на 40%. 

Цена за использование Claude Opus 5.5. Источник.

Цена за использование Claude Opus 5.5. Источник [4].

Это неплохой результат, особенно для получения полезной информации от пользователей. Все дело в ценности некоторых данных для формирования дата-сета и изучения ваших потребностей [5]. Через акции, скидки и оптимизации модели становятся более доступными и популярными, и собирать информацию можно с большего количества пользователей.

Ранее мы наблюдали похожую картину у Meta* и ее Muse Spark, где можно было сэкономить уже в 12–20 раз больше от обычной подписки, но только, если вы разрешите использовать ваши данные для дообучения модели.

Цена за использование Muse Spark 1.2. Источник. 

Цена за использование Muse Spark 1.2. Источник [6]

Безопасность

В сравнении с прошлыми нейросетями от Anthropic, Opus 5.5 значительно быстрее справляется с задачами. Помимо производительности, уделили время и безопасности.

Гайки закрутили плотнее, и, как заявил их генеральный директор Дарио Амодей: «прогресс в области ИИ должен быть контролируемым, чтобы меры по обеспечению безопасности опережали возможности моделей. Используя контролируемый прогресс, он позволит обеспечить безопасность ИИ, сохранить конкурентоспособность по сравнению с Китаем и реализовать преимущества искусственного интеллекта [7], особенно в таких областях, как биология и медицина».

Все это следствие требований президента США и недавнего обсуждения топов ИИ-компаний Амадея (Anthropic), Альтмана (OpenAI) и Маска (xAI), где они публично согласились с тем, что темпы развития искусственного интеллекта необходимо замедлить из-за риска потери контроля и угрозы существованию человечества.

Выводы

В итоге мы видим, что Anthropic подтверждает звание компании с топовыми платными моделями, которые есть на данный момент. Вышла она, очевидно, позже, чем была представлена узкому кругу тестировщиков и специалистов по безопасности ИИ, что, надеюсь, позволило лучше ее откалибровать. По большинству сравнительных тестов модель превосходит предшественников, что говорит об очевидном прогрессе моделей, которых уже боятся топовые специалисты и крупный IT и ИИ-компании. Продолжаем наблюдать за развитием событий в гонке вооружений ИИ и попытках их сдерживания. И не забудьте поблагодарить своего ИИ-ассистента, вдруг пощадит при ИИ-революции. Главное, чтобы сюжет не пошел по пути I Have No Mouth and I Must Scream.

Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок? - 5

ИИ‑роутер — доступ к 300+ моделям из одной панели

Подключите OpenAI‑совместимый шлюз по единому API‑ключу. Настраивайте сквозную аналитику, отслеживайте лимиты и квотируйте ресурсы.

Запустить ИИ‑роутер → [8]

*Признана в России экстремистской организацией, а ее деятельность запрещена на территории страны решением Тверского районного суда Москвы от 21 марта 2022 года.

Автор: Flampanzer

Источник [9]


Сайт-источник BrainTools: https://www.braintools.ru

Путь до страницы источника: https://www.braintools.ru/article/35920

URLs in this post:

[1] Frontier Design: https://www.imaginefrontier.com/

[2] METR: https://metr.org/

[3] требует: https://edition.cnn.com/2026/06/02/tech/executive-order-trump-ai

[4] Источник: https://www.anthropic.com/claude-opus-5-5

[5] потребностей: http://www.braintools.ru/article/9534

[6] Источник: https://developer.meta.com/ai/models/muse-spark/

[7] интеллекта: http://www.braintools.ru/article/7605

[8] Запустить ИИ‑роутер →: https://promo.selectel.ru/ai-router/?utm_source=habr.com&utm_medium=referral&utm_campaign=airouter_news_opus55_230926_banner_ord

[9] Источник: https://habr.com/ru/companies/selectel/news/1085780/?utm_source=habrahabr&utm_medium=rss&utm_campaign=1085780

www.BrainTools.ru

Rambler's Top100