Anthropic выпустила более дешёвую и производительную модель Opus 5.5
Компания Anthropic во вторник представила новую модель Opus 5.5, которая, по её словам, устанавливает новый стандарт производительности в программировании и интеллектуальных задачах, при этом стала дешевле и быстрее предшественницы. Релиз состоялся спустя всего два месяца после выхода Opus 5.

Компания Anthropic во вторник объявила о выпуске новой модели Opus 5.5, которая, по заявлению разработчиков, демонстрирует рекордные результаты в программировании и интеллектуальной работе. По данным компании, новая модель превосходит более крупную модель Fable по ряду тестов и справилась с несколькими неформальными задачами, с которыми не справилась Fable.
Более низкие цены и высокая скорость
Opus 5.5 также заметно дешевле в использовании: цена за миллион выходных токенов снижена до 20 долларов против 25 долларов у предыдущей модели. Другие показатели цен снизились в схожих пропорциях. Модель также работает быстрее, что отражает общее снижение вычислительных затрат на её обслуживание. Изменился и стиль общения модели — Opus 5.5 реже использует профессиональный жаргон и чаще размещает самую важную информацию в начале ответа.
Релиз состоялся всего через два месяца после выхода Opus 5, представленной 24 июля. Anthropic сообщила, что в ближайшие недели выйдут модели Sonnet 5.5 и Haiku 5.5 с аналогичными улучшениями производительности.
Меры безопасности и замедление темпов развития
Anthropic отмечает, что возможности Opus 5.5 в области биологии и кибербезопасности сопоставимы с моделью Mythos, поэтому на неё распространяются те же меры предосторожности, что и на модель Fable — они ограничивают использование модели для поиска уязвимостей в скомпилированных программах и разработки узнаваемого биологического оружия.
Это первый релиз Anthropic после того, как генеральный директор Дарио Амодеи заявил о намерении сознательно замедлить темпы развития возможностей ИИ, чтобы дать время на развитие систем безопасности. Обучение Opus 5.5 в части безопасности в целом повторяло процесс предыдущих моделей, включая тестирование на соответствие ценностям и оценку сторонними организациями, такими как METR и Frontier Design. При этом компания подчеркнула, что уже готовит более совершенные системы обучения и мониторинга для будущих моделей и планирует вскоре раскрыть больше подробностей.


