Claude Opus 5
Claude Opus 5 — флагманская модель Anthropic, вышедшая 24 июля 2026 года. Главная особенность релиза — редкое сочетание: топовое качество по цене прежней линейки Opus ($5 за миллион входных токенов, $25 за выходной), то есть вдвое дешевле по входу, чем более старшая Fable 5.
По цифрам это уверенный фронтир. На SWE-bench Verified — 96,0% (почти потолок на реальных задачах из репозиториев), на SWE-bench Pro — 79,2%, а на мультимодальном SWE-bench скачок особенно крупный: с 38,4% до 59,4%. Отдельно отмечены рекорды в новых областях: 43,3% на Frontier-Bench (агентный кодинг), 30,2% на ARC-AGI-3 (новое рассуждение, примерно втрое выше следующей модели), 70,57% на OSWorld 2.0 (работа с компьютером).
Самое интересное — расстановка внутри линейки Anthropic. Opus 5 обходит более дорогую Fable 5 на 7 из 12 общих бенчмарков, уступая ей лишь на SWE-bench Pro (79,2% против 80,0%) и на волосок на CursorBench. То есть новый Opus почти догнал модель классом выше — за половину цены входного токена.
Окно контекста — 1 млн токенов, вывод до 128 тысяч за ответ. Модель заточена под агентные сценарии: многошаговые задачи, работа с компьютером, длинные автономные прогоны.
Оговорки стандартные для Anthropic: официального доступа из России нет, нужны обходные пути и зарубежная оплата. И бенчмарки — это заявления вендора в собственном анонсе; на конкретной задаче расстановка бывает иной, поэтому прогон на своих данных важнее таблицы из релиза.
- ✓Топовое качество за половину цены Fable 5 ($5/$25)
- ✓96% на SWE-bench Verified — почти потолок
- ✓Обходит более дорогую Fable 5 на 7 из 12 бенчмарков
- ✓Рекорды на агентном кодинге и работе с компьютером
- ✓Окно контекста 1M токенов
- ✕Нет официального доступа из РФ
- ✕Уступает Fable 5 на SWE-bench Pro (на 0,8 пункта)
- ✕Бенчмарки — заявления вендора, на своей задаче проверяйте