Anthropic выпустила Claude Opus 5: 96% на SWE-bench и цена вдвое ниже Fable 5 при флагманском качестве
24 июля Anthropic официально выпустила Claude Opus 5 — новый флагман, доступный в Claude.ai, Claude Code и через API. Главная интрига: модель обходит более дорогую Fable 5 на большинстве бенчмарков, а стоит при этом вдвое дешевле по входному токену. Разбираем, что это меняет.
Цифры
- Цена: $5 за миллион входных токенов и $25 за выходной — та же, что была у линейки Opus, и вдвое ниже входной цены Fable 5.
- Контекст 1 млн токенов, вывод до 128 тысяч за ответ.
- SWE-bench Verified: 96,0% — почти потолок на реальных задачах из репозиториев.
- SWE-bench Pro: 79,2%; на мультимодальном SWE-bench скачок крупнее — с 38,4% до 59,4%.
Отдельно отмечены рекорды в новых областях: 43,3% на Frontier-Bench (агентный кодинг), 30,2% на ARC-AGI-3 (новое рассуждение — примерно втрое выше следующей модели), 70,57% на OSWorld 2.0 (работа с компьютером) против 55,7% у Opus 4.8.
Главное — цена относительно Fable 5
Тут интересный сдвиг в линейке Anthropic. Fable 5, вышедшая в июне, была позиционирована как самая мощная модель компании, класса выше Opus, по цене $10/$50. Opus 5 при вдвое меньшей входной цене:
| Что сравниваем | Opus 5 | Fable 5 |
|---|---|---|
| Цена входа (за 1 млн) | $5 | $10 |
| Цена выхода (за 1 млн) | $25 | $50 |
| Ведёт по бенчмаркам | 7 из 12 общих | 5 из 12 |
| SWE-bench Pro | 79,2% | 80,0% |
Opus 5 обходит Fable 5 на 7 из 12 общих бенчмарков — включая разрыв почти в 10 пунктов на Frontier-Bench. Fable 5 удерживает лидерство лишь на SWE-bench Pro, и то на 0,8 пункта. То есть новый Opus почти догнал модель классом выше за половину цены.
Что это значит на практике
Для тех, кто платит за API. Появился флагман, который делает почти то же, что топовая Fable 5, за вдвое меньшие деньги. На объёмах это прямая экономия без потери качества — редкий случай, когда «дешевле» не значит «слабее».
Для агентного кодинга. 96% на SWE-bench и рекорды на Frontier-Bench и OSWorld — это про модель, которая не просто пишет код, а выполняет многошаговые задачи и работает с компьютером. Именно сюда смещается фронтир.
Для тех, кто выбирает модель. Расстановка сил в линейке Anthropic стала менее очевидной: самый дорогой уже не значит однозначно лучший. Стоит ли сразу переходить на новинку — вопрос отдельный, мы разбираем его в гайде про переход на новую флагманскую модель.
Оговорки
Бенчмарки — это заявления вендора в собственном анонсе. На реальных задачах расстановка бывает другой, а «почти догнал по цифрам» и «догнал в бою» — не одно и то же. Что означают сами бенчмарки и каким верить — в разборе.
Отдельно про доступ из России: как и прежние модели Anthropic, Opus 5 официально в РФ недоступен — нужны обходные пути и зарубежная оплата.
Что запомнить
- Claude Opus 5 — новый флагман Anthropic, цена $5/$25 (вдвое ниже Fable 5).
- 96% на SWE-bench Verified, контекст 1 млн, рекорды на агентном кодинге.
- Обходит более дорогую Fable 5 на 7 из 12 бенчмарков.
- Главный сдвиг — топовое качество за половину цены предыдущего флагмана.
- Бенчмарки — заявления вендора; официального доступа из РФ нет.
Полная карточка модели — в каталоге нейросетей. Прямое сравнение с Fable 5 — здесь. Прикинуть стоимость под свой объём поможет калькулятор стоимости.