Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок?. ai.. ai. chatgpt.. ai. chatgpt. IT-компании.. ai. chatgpt. IT-компании. ml.. ai. chatgpt. IT-компании. ml. mlops.. ai. chatgpt. IT-компании. ml. mlops. selectel.. ai. chatgpt. IT-компании. ml. mlops. selectel. Блог компании Selectel.. ai. chatgpt. IT-компании. ml. mlops. selectel. Блог компании Selectel. искусственный интеллект.. ai. chatgpt. IT-компании. ml. mlops. selectel. Блог компании Selectel. искусственный интеллект. искусство.. ai. chatgpt. IT-компании. ml. mlops. selectel. Блог компании Selectel. искусственный интеллект. искусство. Исследования и прогнозы в IT.. ai. chatgpt. IT-компании. ml. mlops. selectel. Блог компании Selectel. искусственный интеллект. искусство. Исследования и прогнозы в IT. Машинное обучение.
Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок? - 1

22 сентября состоялся релиз ожидаемой Claude Opus 5.5, которая, очевидно, обошла по характеристикам многие модели.

Claude Opus 5.5 стал первым релизом с тех пор, как компания Anthropic объявила о необходимости притормозить гонку за самыми мощными моделями. Перед выпуском модель протестировал узкий круг экспертов, в том числе Frontier Design и METR

Как заявили создатели модели, Opus 5.5 — это самая мощная модель из всех, что они тестировали на сегодняшний день. Для нее также были выделены соответствующие меры безопасности, которые стали несколько строже предыдущих. Напомню, что с недавнего времени правительство США требует, чтобы Anthropic и другие ИИ-компании не выпускали свои модели на широкую аудиторию, а выдавали сначала доступ — до 30 дней — только проверенным компаниям и ужесточали меры безопасности. 

На сайте Anthropic была выложена информация по поводу новой флагманской модели. По их многочисленным сферическо-вакуумным данным можно возложить на новую модель большие надежды, и глядя на бенчмарки, выпущенные компанией, уже можно сделать некоторые выводы по поводу возможностей Opus 5.5.

Бенчмарки

Бенчмарки Opus 5.5 в сравнении с другими топовыми моделями. Источник.

Бенчмарки Opus 5.5 в сравнении с другими топовыми моделями. Источник.

В большинстве тестов новая модель показала сильный результат, превосходящий предшественников. Например, в тесте Agentic coding она показала весомые 66,4% — для сравнения, у предыдущей модели, Opus 5, результат был 52,3%, а у конкурирующей GPT-6 Astra — 57,9%. Также нейросеть превзошла своих предшественников в тесте Knowledge work, получив результат на 111 пунктов Elo отличающийся от прошлых топов (Opus 5.5 – 1 846; Fable 5.1 – 1 735; Opus 5 – 1 708.).

Но не везде нейросеть оказалась прорывной. В тестах Business workflows и Agentic scientific research она показала результат хуже, чем основной конкурент GPT-6 Astra — 40% и 58,7% против 41,4% и 64,6% соответственно.

По информации от самой компании, цена входных и выходных данных снизилась на 20%, а Anthropic заявляет, что в совокупности снизили стоимость выполнения задач примерно на 40%. 

Цена за использование Claude Opus 5.5. Источник.
Цена за использование Claude Opus 5.5. Источник.

Это неплохой результат, особенно для получения полезной информации от пользователей. Все дело в ценности некоторых данных для формирования дата-сета и изучения ваших потребностей. Через акции, скидки и оптимизации модели становятся более доступными и популярными, и собирать информацию можно с большего количества пользователей.

Ранее мы наблюдали похожую картину у Meta* и ее Muse Spark, где можно было сэкономить уже в 12–20 раз больше от обычной подписки, но только, если вы разрешите использовать ваши данные для дообучения модели.

Цена за использование Muse Spark 1.2. Источник. 

Цена за использование Muse Spark 1.2. Источник

Безопасность

В сравнении с прошлыми нейросетями от Anthropic, Opus 5.5 значительно быстрее справляется с задачами. Помимо производительности, уделили время и безопасности.

Гайки закрутили плотнее, и, как заявил их генеральный директор Дарио Амодей: «прогресс в области ИИ должен быть контролируемым, чтобы меры по обеспечению безопасности опережали возможности моделей. Используя контролируемый прогресс, он позволит обеспечить безопасность ИИ, сохранить конкурентоспособность по сравнению с Китаем и реализовать преимущества искусственного интеллекта, особенно в таких областях, как биология и медицина».

Все это следствие требований президента США и недавнего обсуждения топов ИИ-компаний Амадея (Anthropic), Альтмана (OpenAI) и Маска (xAI), где они публично согласились с тем, что темпы развития искусственного интеллекта необходимо замедлить из-за риска потери контроля и угрозы существованию человечества.

Выводы

В итоге мы видим, что Anthropic подтверждает звание компании с топовыми платными моделями, которые есть на данный момент. Вышла она, очевидно, позже, чем была представлена узкому кругу тестировщиков и специалистов по безопасности ИИ, что, надеюсь, позволило лучше ее откалибровать. По большинству сравнительных тестов модель превосходит предшественников, что говорит об очевидном прогрессе моделей, которых уже боятся топовые специалисты и крупный IT и ИИ-компании. Продолжаем наблюдать за развитием событий в гонке вооружений ИИ и попытках их сдерживания. И не забудьте поблагодарить своего ИИ-ассистента, вдруг пощадит при ИИ-революции. Главное, чтобы сюжет не пошел по пути I Have No Mouth and I Must Scream.

Claude Opus 5.5 вышел в релиз, а повлияло ли это на рынок? - 5

ИИ‑роутер — доступ к 300+ моделям из одной панели

Подключите OpenAI‑совместимый шлюз по единому API‑ключу. Настраивайте сквозную аналитику, отслеживайте лимиты и квотируйте ресурсы.

Запустить ИИ‑роутер →

*Признана в России экстремистской организацией, а ее деятельность запрещена на территории страны решением Тверского районного суда Москвы от 21 марта 2022 года.

Автор: Flampanzer

Источник