Рынок

Anthropic представила Claude Opus 5.5

Anthropic выпустила Claude Opus 5.5 — первую модель в новой линейке Claude 5.5. Компания позиционирует релиз как обновление флагманского уровня с упором на

4 мин чтенияИсточник: ForkLog
Anthropic представила Claude Opus 5.5
TelegramВКонтактеWhatsApp

Anthropic выпустила Claude Opus 5.5 — первую модель в новой линейке Claude 5.5. Компания позиционирует релиз как обновление флагманского уровня с упором на программирование, агентные сценарии, аналитику и безопасность.

Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5. pic.twitter.com/Q9C2VKQ79f

В компании заявляют, что она работает на уровне Claude Fable 5.1 в большинстве задач, но требует на 40% меньше вычислительных ресурсов, чем Opus 5.

По словам разработчиков, модель стала заметно сильнее в сложных рабочих задачах: она лучше справляется с миграциями больших кодовых баз, аудитом программного кода, оптимизацией приложений и подготовкой аналитических отчетов. В одном из внутренних тестов Opus 5.5 помог завершить миграцию 680 000 строк кода менее чем за сутки — работу, на которую, как утверждает Anthropic, ушли бы недели у инженерной команды.

Новая линейка Claude 5.5

Opus 5.5 — первый релиз в свежем семействе Claude 5.5. В ближайшие недели Anthropic обещает выпустить Sonnet 5.5 и Haiku 5.5, которые должны получить аналогичные улучшения в производительности, эффективности и безопасности.

Компания отдельно подчеркивает, что модель выпущена после призыва CEO Anthropic Дарио Амодеи к подходу, при котором развитие передовых ИИ-систем должно идти в ногу с мерами контроля и оценки рисков.

Дешевле, быстрее, экономнее по токенам

Anthropic утверждает, что Opus 5.5 обходится дешевле не только за счет более низкой цены за токены, но и благодаря меньшему расходу токенов на задачу.

По расчетам компании, это дает примерно 40% экономии на типичных рабочих нагрузках. Кроме того, модель якобы генерирует ответы более чем на 30% быстрее, чем Opus 5.

Для пользователей подписок Pro, Max и Team Anthropic увеличила лимиты использования на пять часов, а также добавила возможность сохранять и использовать позднее лимит сброса.

Ставка на кодинг и агентные сценарии

В Anthropic говорят, что Opus 5.5 особенно силен в агентном кодинге и задачах, где модель должна долго работать автономно. В одном из тестов нейросеть успешно оптимизировала веб-приложение, сократив время загрузки страниц в 39 из 40 случаев. В другом — опередила другие модели по качеству графики и «полировки» игры, созданной по одному промпту.

Отдельный акцент компания делает на корпоративных сценариях. По ее словам, Opus 5.5 подходит для финансового анализа, бизнес-отчетности и исследования данных. Anthropic также заявляет, что нейросеть показывает сильные результаты в бенчмарках на интеллектуальные задачи и агентный кодинг. При этом в компании признают, что на столь высоком уровне возможностей тесты хуже отражают реальные различия между моделями.

Усиленные меры безопасности

На фоне роста возможностей Anthropic усилила и систему ограничений. Компания заявила, что Opus 5.5 показала лучший результат среди всех тестируемых моделей в автоматизированном «поведенческом аудите» — внутренней системе оценки согласованности и безопасного поведения в тысячах симулированных сценариев.

По данным Anthropic, модель:

реже предпринимает труднооткатываемые действия;

лучше защищена от заражения промпта;

реже выходит за заданные рамки;

демонстрирует улучшения в области честности и следования инструкции.

При этом в компании признают, что идеальных методов оценки по-прежнему нет: модели могут «понимать», что их тестируют, а значит, реальные сценарии остаются сложнее лабораторных.

Кибер- и биосценарии под контролем

Из-за высокой эффективности в кибербезопасности и биологии Anthropic применяет к Opus 5.5 защитные ограничения, сопоставимые с теми, что используются для наиболее мощных моделей компании.

большинство киберзапросов будет перенаправляться на другие модели;

для исследовательских задач в биологии доступ откроют только проверенным организациям через Life Sciences Verification Program;

в ближайшие недели расширится Cyber Verification Program для верифицированных специалистов по кибербезопасности.

Кроме того, Opus 5.5 получила защиту «сохраненного мышления», которая ограничивает попытки извлекать внутренние рассуждения модели через API .

Напомним, в сентябре Anthropic объявила о партнерстве с консалтинговой компанией Accenture, которая займется независимой оценкой ИИ-моделей.

Подписывайтесь на ForkLog в социальных сетях

Поделиться новостью

TelegramВКонтактеWhatsApp