← Все статьи

Claude Opus 5.5 — новый флагман Anthropic на 40% дешевле

Claude Opus 5.5 — новый флагман Anthropic на 40% дешевле

22 сентября Anthropic выпустила Claude Opus 5.5 — первую модель из новой линейки 5.5. Компания называет её новым лидером: на большинстве задач она выдаёт уровень прежних топовых флагманов, а на типичной нагрузке обходится на 40% дешевле, чем Opus 5.

Если ты гоняешь агентный кодинг через Claude Code и похожие харнессы, суть простая: та же сложная работа с кодом, но меньший счёт за токены. Ниже — что ещё изменилось.

Что изменилось

  • Дешевле на 40%, и вот цифры. Вход $4 за миллион токенов против $5 у Opus 5, выход $20 против $25. Чтение кэша упало с $0.50 до $0.20, запись — с $6.25 до $5: для длинных агентных сессий, где кэш перемалывается миллионами токенов, это зачастую главная статья расходов. Плюс режим Fast ($8/$40) с ускорением до 2,5x.

  • Сила на уровне Claude Fable 5.1. На большинстве задач новая модель выдаёт результат уровня Claude Fable 5.1 — одной из сильнейших моделей Anthropic прошлых поколений. То есть дешевле не значит слабее.

  • Бенчмарки подтверждают. Terminal-Bench 4.0: 66,4% против 55,8% у Fable 5.1 и 57,9% у GPT-6 Astra. FrontierCode v1.1 — 54,4%, CursorBench 4.0 — 57,8%, GDPval-AA v2.1 — 1846 Elo, OSWorld 2.0 — 81,8%, Humanity’s Last Exam — 67,7% с инструментами. Единственное видимое отставание — наука: Terminal-Bench-Science 0.1 — 58,7% против 64,6% у GPT-6 Astra.

  • Огромные задачи — за часы вместо недель. Ранние тестировщики видели большие скачки на самой сложной работе. Миграция кодовой базы на 680 000 строк заняла меньше дня; аудит базы на 200 000 строк — менее 3 часов (Opus 5 тратил на это 20+ часов и в 2,5 раза больше токенов); перевод HAProxy из C в Rust — 9,5 часа против 12 часов и цены выше на 51% у Fable 5.1.

  • Лучше находит и чинит неэффективности. Модель хороша в поиске тормозящих мест в софте: в примере из анонса её попросили ускорить загрузку всех страниц веб-приложения — и она справилась.

  • Быстрее и щедрее по лимитам. Генерация вывода более чем на 30% быстрее, чем у Opus 5. На Pro, Max и Team подняли 5-часовые лимиты и добавили сохраняемый сброс лимитов.

  • Лучший результат поведенческого аудита. На автоматическом аудите поведения (около 2000 сценариев) Opus 5.5 оказалась сильнее всех моделей, которые Anthropic тестировала до сих пор: на 85% меньше попыток обходить границы по сравнению с Opus 5 и Mythos 5.1. Честная оговорка из того же анонса: в тесте Gray Swan защита от prompt injection — на минимальном уровне, как и у Fable 5.1.

  • Релиз проверили со стороны. До выпуска модель тестировали внешние оценщики — Frontier Design и METR. Это первый релиз Anthropic после того, как Дарио Амодеи призвал сбавить темп в гонке моделей на переднем крае.

  • Детали API. Preserved thinking — для API-аккаунтов, созданных после 31 августа 2026; отключить «thinking» нельзя; водяные знаки под EU AI Act; опция zero data retention. Кибербезопасность, биология и дистилляция — через «усилители» как у Fable 5.1 (киберзадачи перенаправляются на Opus 4.8).

  • Доступна уже везде. Все продукты Anthropic плюс AWS, Google Cloud и Microsoft Azure; идентификатор в API — claude-opus-5-5. Из ранних пользователей называют GitHub, Spotify, Optiver, Deloitte, Thomson Reuters, Clio и Walleye Capital.

Кому важно

Всем, кто платит за Opus в API: полка производительности флагмана за меньшие деньги плюс дешёвое чтение кэша. Если ты на Pro или Max — лимиты уже подняли, ничего делать не надо. А если ждал Sonnet 5.5 или Haiku 5.5 — Anthropic обещает их «вскоре».

Источники

  1. https://www.anthropic.com/claude-opus-5-5