Производительность и эффективность
Компания Anthropic официально представила Claude Opus 5.5, новую модель в своем семействе, ориентированную на операционную эффективность и специализированные задачи программирования. Согласно данным Anthropic, модель демонстрирует производительность на уровне Claude Fable 5.1 при стоимости эксплуатации на 40% ниже, чем у предыдущей версии Opus 5. Этот релиз, ставший первым после заявления компании о необходимости замедления темпов развития пограничных моделей, направлен на снижение затрат при выполнении сложных автономных задач.
Данные тестирования показывают значительное улучшение в эффективности кодирования. В ходе внутренних тестов Opus 5.5 провела аудит и исправление 200 000 строк кода менее чем за три часа — задача, на которую у Opus 5 ушло более 20 часов при значительно большем потреблении ресурсов. Кроме того, модель продемонстрировала высокую надежность в работе с информацией: при анализе финансовых данных и проведении исследований Opus 5.5 показала более высокий уровень фактической точности по сравнению с предшественниками.
Протоколы безопасности и тестирования
Безопасность остается центральным элементом релиза Opus 5.5. Как сообщает Anthropic, модель показала лучшие результаты в автоматизированном поведенческом аудите, предназначенном для проверки реакций ИИ в тысячах смоделированных сценариев. Компания внедрила классификатор, проверяющий каждое действие перед его выполнением, а также открытую «песочницу» (sandbox), позволяющую командам безопасности контролировать поведение модели. Эти меры призваны исключить возможность совершения труднообратимых действий.
Учитывая высокие возможности модели, особенно в области биологии и кибербезопасности, доступ к ней регулируется программами верификации. Исследования в чувствительных областях ограничены для прошедших проверку организаций через программу Life Sciences Verification Program. В ближайшие недели Anthropic планирует расширить доступ к аналогичной программе для специалистов по кибербезопасности.
Экономические показатели и перспективы
Экономическая модель Opus 5.5 оптимизирована для агентских рабочих процессов. Стоимость входных и выходных токенов снижена на 20% по сравнению с Opus 5, а стоимость кэшированного чтения — на 60%. Эти изменения дополняются увеличением лимитов использования для планов Pro, Max, Team и Enterprise.
В ближайшие недели Anthropic выпустит модели Claude Sonnet 5.5 и Claude Haiku 5.5, которые будут включать аналогичные оптимизации. Компания отмечает, что по мере роста возможностей моделей стандартные бенчмарки становятся менее надежным инструментом, что требует перехода к оценке на основе конкретных практических результатов.

