
Anthropic выпустила Claude Opus 5 — новую флагманскую модель, которая заменила Opus 4.8 в качестве Opus-уровня. Модель уже доступна в Claude Max (по умолчанию) и Claude Pro (как самая сильная). Цены на API остались прежними: $5 за миллион входных токенов и $25 за миллион выходных. Компания позиционирует Opus 5 как приближающуюся по интеллекту к Claude Fable 5, но вдвое дешевле.
Ключевые технические характеристики
Модель имеет идентификатор claude-opus-5. Контекстное окно — 1 миллион токенов (как дефолтное, так и максимальное, без уменьшенной версии). Максимальный выход — 128k токенов через синхронный Messages API, а через Message Batches API с бета-заголовком output-300k-2026-03-24 можно достичь 300k токенов. Минимальный кэшируемый промпт снижен с 1024 до 512 токенов.
Por que importa
Агентное кодирование и компьютерное взаимодействие
На SWE-bench Verified модель набрала 96,0%, на SWE-bench Pro — 79,2% (Fable 5 — 80,0%). На SWE-bench Multimodal прыжок значительный: с 38,4% у Opus 4.8 до 59,4%. На OSWorld 2.0 результат 70,57% против 55,7% у предшественника. Zapier AutomationBench показал 26,0% против 17,0% у Opus 4.8 и 17,4% у Fable 5. При среднем усилии (medium effort) модель набирает 24% при цене $0,89 за задачу.
На Artificial Analysis GDPval-AA v2 Opus 5 занял первые два места с ELO 1861 и 1827. Режим xhigh (максимальное усилие) превосходит все остальные модели, используя на 25% меньше выходных токенов, чем в режиме max.
Contexto
Бенчмарки общего интеллекта и математики
На FrontierBench v0.1 (74 задачи, наследник Terminal-Bench 2.1) Opus 5 набрал 43,3% при максимальном усилии, против 18,7% у Opus 4.8, 33,7% у Fable 5 и 37,5% у GPT-5.6 Sol. При xhigh усилии средняя награда достигает 44,4%.
Anthropic протестировала модель на шести задачах Международной математической олимпиады 2026 года без инструментов и агентной обвязки. Три модели-судьи оценили все 24 сгенерированных решения как правильные, а независимые эксперты дали одному предварительно заданному решению 7/7. Итоговый результат 42/42 — уровень золотой медали (порог 29/42).
На ARC-AGI-3 при высоком усилии модель показала 30,16% — примерно в четыре раза выше предыдущего рекорда (GPT-5.6 Sol — 7,78%, Opus 4.8 — 1,52%). На Humanity’s Last Exam — 56,3% без инструментов и 64,7% с ними.
Безопасность и кибервозможности
Anthropic подчёркивает, что не обучала Opus 5 на задачах кибербезопасности, но способности выросли как побочный эффект общего роста. На ExploitBench модель получила 10,14 средних флагов способностей в ветке AutoNudge и создала 99 полных эксплойтов с выполнением произвольного кода (Mythos 5 — 132). На OSS-Fuzz решено 79,4% целей (Mythos 5 — около 80%), но полных эксплойтов — 4 против 13 у Mythos 5.
Классификаторы безопасности срабатывают примерно на 85% реже, чем на Fable 5. При тестировании на косвенную инъекцию промптов (Gray Swan) успех атак в 15 попытках упал с 5,5% у Opus 4.8 до 2,0%. В браузерных средах Claude Cowork — с 31,5% до 0% при включённом авторежиме.
UK AISI протестировала ранние чекпоинты на трёх киберполигонах (100 млн токенов на попытку). Opus 5 решил сценарий «The Last Ones» полностью в 8 из 10 попыток; более сложный «Doing Life» не пройден, но достигнут шаг 22 из 23 — дальше, чем любая другая модель.
Ключевые факты
| Параметр | Значение |
|———-|———-|
| Модель | claude-opus-5 |
| Контекст | 1 млн токенов |
| Цена (вход/выход) | $5 / $25 за млн токенов |
| SWE-bench Verified / Pro | 96,0% / 79,2% |
| OSWorld 2.0 | 70,57% |
| FrontierBench v0.1 (max) | 43,3% |
| Цена за задачу (medium effort) | $0,89 |
Что это значит для разработчиков
Claude Opus 5 предлагает существенный скачок в агентных задачах и кодировании при сохранении прежнего ценообразования. Для практиков, работающих с автоматизацией, сложными пайплайнами и компьютерным взаимодействием, модель становится доступным инструментом с пограничными возможностями. Снижение минимального кэшируемого промпта до 512 токенов также удешевляет повторяющиеся запросы.
Источник: MarkTechPost по материалам блога Anthropic, системной карты Claude Opus 5 и страницы «What’s new in Claude Opus 5». Полный материал: https://www.marktechpost.com/2026/07/24/meet-the-new-claude-opus-5-frontier-class-agentic-coding-and-computer-use-at-unchanged-opus-pricing/
Datos clave
| Punto | Detalle |
|---|---|
| Fuente | MarkTechPost |
| Fecha | 2026-07-24T21:50:46+00:00 |
| Tema | Meet the New Claude Opus 5: Frontier-Class Agentic Coding and Computer Use at Unchanged Opus Pricing |