Anthropic выпустила Claude Opus 5.5: новый флагман стал быстрее, экономичнее и приблизился к Fable 5.1
Мир 3D технологий

Anthropic выпустила Claude Opus 5.5: новый флагман стал быстрее, экономичнее и приблизился к Fable 5.1

  • AlexT
  • 23-сен-2026, 08:00
  • 0 комментариев
  • 1 просмотров

Anthropic представила Claude Opus 5.5 — первую модель новой линейки Claude 5.5. Основной упор разработчики сделали на длительные автономные задачи, программирование, работу с компьютером и профессиональными документами. По заявлению компании, новинка заметно превосходит предыдущий Opus 5 в ряде сценариев, генерирует ответы быстрее и в среднем позволяет снизить расходы примерно на 40%. Запуск модели 22 сентября подтверждают и независимые публикации.

При этом Opus 5.5 позиционируется не просто как очередное увеличение производительности. Anthropic пытается перенести возможности дорогих моделей верхнего уровня в более доступный сегмент: по ряду задач новая версия приближается к Claude Fable 5.1, которая стоит $10 за миллион входных и $50 за миллион выходных токенов. Для Opus 5.5 заявлена цена $4 и $20 соответственно. Одновременно разработчики усилили механизмы безопасности и контроль над действиями ИИ при продолжительной автономной работе.

Главный акцент — длительная самостоятельная работа

Одним из ключевых направлений развития Claude Opus 5.5 стали агентные сценарии. Модель рассчитана на задачи, которые нельзя решить одним запросом: ей необходимо составить план, последовательно выполнить множество операций, воспользоваться внешними инструментами, проверить полученный результат и при необходимости исправить собственные ошибки.

Особенно заметны изменения в программировании. По данным Anthropic, один из ранних пользователей поручил Opus 5.5 перенос кодовой базы объёмом около 680 тысяч строк. Работа была завершена менее чем за сутки, тогда как ручная миграция, по оценке пользователя, потребовала бы от инженерной команды нескольких недель.

В другом испытании ИИ провёл аудит и внёс исправления в проект, насчитывающий около 200 тысяч строк кода, менее чем за три часа. Предыдущему Claude Opus 5 на сопоставимую задачу потребовалось более 20 часов, причём расход токенов оказался примерно в 2,5 раза выше.

Opus 5.5 сравнили с более дорогой Fable 5.1

Показательным испытанием стала миграция HAProxy с C на Rust. Согласно опубликованным результатам, Claude Opus 5.5 справилась с ней за 9,5 часа, тогда как Fable 5.1 потребовалось около 12 часов. Стоимость выполнения задачи новой моделью оказалась на 51% ниже.

Разница в цене особенно заметна на фоне официальных тарифов Fable 5.1. Эта модель обходится разработчикам в $10 за миллион входных и $50 за миллион выходных токенов. Она рассчитана прежде всего на наиболее сложные рассуждения и продолжительные агентные процессы.

Ещё одно испытание касалось оптимизации веб-приложения. Opus 5.5 смогла уменьшить время загрузки страниц в 39 случаях из 40. Anthropic утверждает, что предыдущая версия чаще ограничивалась менее существенными оптимизациями и в отдельных ситуациях могла одновременно изменить поведение приложения.

Результаты тестов программирования

В собственных испытаниях Anthropic новая модель показала высокие результаты сразу в нескольких специализированных тестах.

В Terminal-Bench 4.0, проверяющем способность ИИ-агентов решать многоэтапные задачи через командную строку, результат Claude Opus 5.5 составил 66,4%. По данным компании, это выше показателей Opus 5, Fable 5.1, GPT-6 Astra и GPT-5.6 Sol.

В FrontierCode v1.1 модель получила 54,4%. Для сравнения, заявленный результат Fable 5.1 составляет 50,3%, а GPT-6 Astra — 53,3%. В CursorBench 4.0 Opus 5.5 набрала 57,8%, также превысив результаты Fable 5.1 и предыдущего Opus.

Впрочем, сама Anthropic предостерегает от слишком буквального сравнения флагманских моделей исключительно по бенчмаркам. По оценке разработчиков, в реальных сценариях разница между Opus 5.5 и Fable 5.1 может быть значительно меньше, чем следует из отдельных тестовых показателей.

Не только код: документы, исследования и финансы

Разработчики расширили возможности модели в профессиональных задачах, не связанных непосредственно с программированием. Речь идёт о подготовке и анализе документов, исследованиях, финансовых моделях и других видах интеллектуальной работы.

В GDPval-AA v2.1, моделирующем профессиональные задания для 44 специальностей, Opus 5.5 получила 1846 баллов. У Fable 5.1 заявлено 1735 баллов, а у предыдущей Opus 5 — 1708.

Отдельный внутренний эксперимент Anthropic проверял способность модели находить и обрабатывать финансовую информацию. ИИ требовалось самостоятельно отыскать нужный релиз в специально подготовленной копии интернета, а затем составить финансовый отчёт. Критерии были строгими: единственная неверная цифра или цитата означала провал всей попытки.

Opus 5.5 успешно прошла такой тест в 16 случаях из 18. Согласно данным разработчика, Fable 5.1 и Opus 5 установленный порог качества не преодолели ни разу.

Ответы должны стать проще и понятнее

Изменения затронули не только способности модели, но и манеру её общения с пользователем. Anthropic заявляет, что Claude Opus 5.5 лучше выделяет главное, аккуратнее структурирует большие ответы и реже перегружает текст профессиональным жаргоном или необычными оборотами.

Такой подход особенно важен для продолжительных рабочих сессий, когда ИИ выполняет многоэтапное задание и пользователю необходимо быстро понимать, что уже сделано, какие проблемы обнаружены и что происходит на текущем этапе.

Подобное направление Anthropic развивает и в других современных Claude. Например, Fable 5.1 ориентирована на многочасовую автономную работу и способна самостоятельно планировать последовательность действий, использовать инструменты, восстанавливаться после неудачных шагов и информировать пользователя о ходе выполнения задания.

Opus стала дешевле

Одно из наиболее заметных изменений — стоимость API. Миллион входных токенов Claude Opus 5.5 оценивается в $4 вместо $5 у Opus 5, а миллион выходных — в $20 вместо $25.

Чтение данных из кэша подешевело с $0,50 до $0,20 за миллион токенов, запись — с $6,25 до $5. С учётом более эффективного расходования токенов Anthropic оценивает среднее снижение стоимости выполнения задач примерно в 40%. Основные цены новой модели подтверждаются независимыми публикациями о запуске.

Одновременно более чем на 30% выросла скорость генерации. Для задач, где время важнее стоимости, предусмотрен Fast Mode. В Claude Code и Claude Platform он способен работать до 2,5 раза быстрее стандартного режима. Однако цена при этом увеличивается до $8 за миллион входных и $40 за миллион выходных токенов.

Для сравнения, Claude Fable 5.1 стоит $10 и $50 за миллион входных и выходных токенов соответственно, а её контекстное окно достигает одного миллиона токенов.

Усиленная защита при автономной работе

Рост возможностей агентных моделей создаёт дополнительные риски: ИИ получает больше свободы при использовании инструментов и выполнении длинных цепочек действий. Поэтому значительная часть изменений в Opus 5.5 касается безопасности.

Перед выпуском модель проходила внешние проверки, в том числе с участием организаций Frontier Design и METR. По утверждению Anthropic, в испытаниях Opus 5.5 примерно на 85% реже пыталась нарушить установленные границы изолированной среды по сравнению с Opus 5 и Mythos 5.1. При этом компания подчёркивает, что полностью обнаружить все возможные нежелательные сценарии поведения до публичного развёртывания ИИ невозможно.

Разработчики также заявляют о повышенной устойчивости к prompt injection — атакам, при которых сторонний контент пытается незаметно передать модели дополнительные инструкции. Кроме того, система должна осторожнее относиться к действиям, последствия которых трудно или невозможно отменить.

Ещё одним защитным механизмом стала технология preserved thinking. Она, среди прочего, призвана осложнить массовое извлечение внутренних рассуждений модели с использованием сетей поддельных API-аккаунтов.

Для опасных областей сохраняются дополнительные ограничения

Особые правила предусмотрены для запросов, связанных с кибербезопасностью, биологией и некоторыми сценариями дистилляции моделей.

Значительная часть чувствительных запросов по кибербезопасности будет перенаправляться на Claude Opus 4.8. Расширенные возможности Opus 5.5 в таких областях предполагается предоставлять проверенным специалистам через программы Cyber Verification и Life Sciences Verification.

Подобный подход Anthropic применяла и ранее. Например, для Fable 5.1 компания использует дополнительные защитные механизмы и перенаправление части чувствительных запросов на другие модели Claude.

Claude Opus 5.5 уже доступна пользователям

Новая модель уже начала распространяться через сервисы Anthropic. Помимо собственных продуктов компании, доступ к Opus 5.5 заявлен через крупные облачные платформы, включая Amazon Web Services, Google Cloud и Microsoft Azure.

На Opus 5.5 обновление семейства Claude не закончится. В ближайшие недели Anthropic планирует представить Claude Sonnet 5.5 и Claude Haiku 5.5. Ожидается, что младшие модели получат часть тех же изменений, связанных с производительностью, стоимостью работы и безопасностью.

Таким образом, с выпуском Opus 5.5 Anthropic делает ставку не только на рост результатов в тестах. Более существенным изменением становится сочетание длительной автономной работы, высокой производительности и заметно меньшей стоимости эксплуатации — именно эти характеристики могут оказаться наиболее важными при использовании ИИ в крупных программных и корпоративных проектах.

img
Привет, я Айтишка!

Самый настоящий сургутский лисенок. Я аватар компании ИТ-Телеком и тут я хочу делиться с вами интересными новостями.

Категории сайта
Календарь
«    Сентябрь 2026    »
ПнВтСрЧтПтСбВс
 123456
78910111213
14151617181920
21222324252627
282930