Claude Opus 5 от Anthropic: разбор релиза и скачок на ARC-AGI 3 | AI Радар
Продукт

Anthropic выпустила Claude Opus 5: рост на ARC-AGI 3 в четыре раза при прежней цене

📅 25 июля 2026 ✍️ Александр Григорьев 🏷 Anthropic · Claude · LLM
Anthropic 24 июля представила Claude Opus 5 — модель показала 30,2% на бенчмарке ARC-AGI 3 против 7,8% у GPT-5.6 Sol и лишь 1,5% у предыдущего Opus 4.8. Цена осталась на уровне предшественника — $5/$25 за миллион входных/выходных токенов, при этом результаты по сложному коду выросли почти вдвое.
30,2%
ARC-AGI 3
vs 7,8% у GPT-5.6 Sol
43,3%
Frontier-Bench
новый рекорд (SOTA)
$5/$25
за млн токенов
цена не изменилась

Что показал Claude Opus 5 на тестах

Anthropic выпустила Claude Opus 5 24 июля — четвёртую по счёту модель компании за два последних месяца, что само по себе говорит о темпе, с которым лидеры рынка сейчас обновляют флагманские линейки. Главный результат — скачок на бенчмарке ARC-AGI 3, который считается одним из самых сложных тестов на абстрактное рассуждение: Opus 5 набрал 30,2%, тогда как флагман OpenAI GPT-5.6 Sol остановился на 7,8%, а предыдущая модель самой Anthropic, Opus 4.8, — всего на 1,5%. Такой разрыв за одно поколение — редкость даже для нынешнего темпа гонки моделей.

На Frontier-Bench, комплексном тесте на знание работы, Opus 5 показал 43,3% — новый рекорд среди всех протестированных моделей. По собственным данным компании, результаты по сложным задачам программирования выросли почти вдвое по сравнению с Opus 4.8, а модель одновременно стала «самой согласованной» (aligned) моделью Anthropic за всю историю — то есть реже отклоняется от инструкций и меньше подвержена джейлбрейкам.

Чем Opus 5 отличается от остальной линейки Anthropic

Важная деталь релиза — ценовая политика. Несмотря на резкий рост качества, Anthropic сохранила цену на уровне предшественника: $5 за миллион входных и $25 за миллион выходных токенов. Это осознанный шаг: компания подчёркивает, что Opus 5 приближается по «сырому» интеллекту к более дорогой флагманской модели Claude Fable 5, но стоит примерно вдвое дешевле. В нише наступательной кибербезопасности Opus 5 сознательно уступает специализированной модели Mythos 5 — Anthropic по-прежнему разделяет модели по профилю риска, а не пытается сделать одну универсальную систему сильнее всех сразу.

Для корпоративных клиентов и разработчиков это означает выбор без резкого удорожания: те, кто уже платит за Opus 4.8, автоматически получают заметно более способную модель по прежнему прайсу — редкий случай на рынке, где рост качества обычно сопровождается ростом цены.

Доступность для российских разработчиков

Официально Anthropic не работает в России — прямой доступ к API Claude для российских юрлиц закрыт, а оплата с российских карт не проходит. Тем не менее модели семейства Claude остаются одними из самых востребованных у российских разработчиков и AI-стартапов, которые получают доступ через зарубежные юрлица, посредников или агрегаторы API, включенные в состав many-model платформ. Релиз Opus 5 с сохранённой ценой особенно интересен именно этой аудитории: качество растёт, а стоимость доступа через посредников — которая и так включает наценку 15–30% — не увеличивается пропорционально возможностям модели.

Это же обновление стоит рассматривать и как ориентир для сравнения с отечественными моделями. Сбер уже сопоставлял GigaChat 3.5 Ultra с DeepSeek по кодовым бенчмаркам — теперь ARC-AGI 3 и Frontier-Bench Opus 5 задают новую верхнюю планку, по которой рынок будет измерять как открытые китайские модели, так и российские GigaChat и YandexGPT. Разрыв в абстрактном рассуждении на уровне 20–30 п.п. — сигнал, что фронтир по-прежнему определяют несколько лабораторий в США, а не открытый рынок моделей.

Для отечественных компаний, работающих с задачами, где важна точность многошагового рассуждения — юридический анализ, сложная разработка, финансовое моделирование, — Opus 5 на практике останется эталоном качества, даже если официально он недоступен: разрыв с локальными альтернативами определит, сколько бизнеса продолжит уходить к посредникам вместо перехода на российские модели.

Темп релизов как отдельный фактор конкуренции

Отдельного внимания заслуживает сам темп: Opus 5 — четвёртая модель Anthropic за два месяца, и это уже не исключение, а норма для всех трёх лидеров гонки. GPT-5.6 у OpenAI, Gemini 3.6 Flash у Google и теперь Opus 5 у Anthropic выходят практически одновременно, каждая пытаясь удержать заголовки хотя бы неделю. Для корпоративных заказчиков это означает, что цикл принятия решения о выборе модели должен сокращаться вместе с циклом релизов — модель, выбранная полгода назад, почти гарантированно уступает актуальному флагману на 15–20 процентных пунктов по профильным бенчмаркам. Для российских интеграторов, которые выстраивают продукты поверх зарубежных API, это создаёт постоянную техническую задолженность: без регулярного пересмотра стека они рискуют предлагать клиентам вчерашнее качество по сегодняшней цене.

📎 Первоисточник: TheNextWeb · Июль 2026 ↗