Anthropic выпустила Claude Opus 5.5: фокус на эффективности кодинга и безопасности

Популярные

Stylized graphic featuring the text Claude Opus 5.5 against a sunset horizon background

Быстрое чтение

  • Claude Opus 5.5 обеспечивает производительность уровня Fable 5.1 при снижении затрат на 40%.
  • Модель включает усиленные протоколы безопасности, включая классификатор действий в реальном времени.
  • Стоимость токенов снижена на 20%, а стоимость кэшированного чтения — на 60%.
  • Доступ к исследованиям в области биологии и кибербезопасности ограничен для верифицированных организаций.

Производительность и эффективность

Компания Anthropic официально представила Claude Opus 5.5, новую модель в своем семействе, ориентированную на операционную эффективность и специализированные задачи программирования. Согласно данным Anthropic, модель демонстрирует производительность на уровне Claude Fable 5.1 при стоимости эксплуатации на 40% ниже, чем у предыдущей версии Opus 5. Этот релиз, ставший первым после заявления компании о необходимости замедления темпов развития пограничных моделей, направлен на снижение затрат при выполнении сложных автономных задач.

Данные тестирования показывают значительное улучшение в эффективности кодирования. В ходе внутренних тестов Opus 5.5 провела аудит и исправление 200 000 строк кода менее чем за три часа — задача, на которую у Opus 5 ушло более 20 часов при значительно большем потреблении ресурсов. Кроме того, модель продемонстрировала высокую надежность в работе с информацией: при анализе финансовых данных и проведении исследований Opus 5.5 показала более высокий уровень фактической точности по сравнению с предшественниками.

Протоколы безопасности и тестирования

Безопасность остается центральным элементом релиза Opus 5.5. Как сообщает Anthropic, модель показала лучшие результаты в автоматизированном поведенческом аудите, предназначенном для проверки реакций ИИ в тысячах смоделированных сценариев. Компания внедрила классификатор, проверяющий каждое действие перед его выполнением, а также открытую «песочницу» (sandbox), позволяющую командам безопасности контролировать поведение модели. Эти меры призваны исключить возможность совершения труднообратимых действий.

Учитывая высокие возможности модели, особенно в области биологии и кибербезопасности, доступ к ней регулируется программами верификации. Исследования в чувствительных областях ограничены для прошедших проверку организаций через программу Life Sciences Verification Program. В ближайшие недели Anthropic планирует расширить доступ к аналогичной программе для специалистов по кибербезопасности.

Экономические показатели и перспективы

Экономическая модель Opus 5.5 оптимизирована для агентских рабочих процессов. Стоимость входных и выходных токенов снижена на 20% по сравнению с Opus 5, а стоимость кэшированного чтения — на 60%. Эти изменения дополняются увеличением лимитов использования для планов Pro, Max, Team и Enterprise.

В ближайшие недели Anthropic выпустит модели Claude Sonnet 5.5 и Claude Haiku 5.5, которые будут включать аналогичные оптимизации. Компания отмечает, что по мере роста возможностей моделей стандартные бенчмарки становятся менее надежным инструментом, что требует перехода к оценке на основе конкретных практических результатов.

|
Редакционный вклад:Редакция Azat TV
|
Издатель:Azat TV

Самые последние