Anthropic выпустила Claude Opus 5. Цена осталась за использование флагманской версии осталась прежней: $5 за миллион входных токенов и $25 за миллион выходных — ровно столько стоила предыдущая Opus 4.8. На внутреннем тесте Frontier-Bench (агентные задачи) новинка набрала 43,3% против 18,7% у предшественницы, а вдвое более дорогая Fable 5 по $10 и $50 взяла на нем 33,7%. Модель сразу стала вариантом по умолчанию на подписке Max и самой сильной из доступных на Pro.
На тесте CursorBench по программированию при максимальном усилии она отстает от пика флагмана меньше чем на полпроцента, а стоит вдвое дешевле за задачу. В OSWorld, где нейросеть работает с компьютером результат вырос до 70,6%, и это выше флагманского примерно за треть его цены. На ARC-AGI 3, собранном из задач, которых модель раньше не встречала, она втрое обошла ближайшего конкурента.
Один эпизод компания описала отдельно, и он объясняет больше, чем сухие цифры сравнения. В задании нужно было по чертежу детали написать код и собрать ее трехмерную модель, но посмотреть на сам чертеж системе не дали. Она создала скрипт для компьютерного зрения, вытащила геометрию прямо из пикселей и восстановила деталь целиком. Ни одна конкурирующая нейросеть в тех же условиях не решила эту задачу за пять попыток.
Все замеры Anthropic проводила на своих стендах, и независимо их пока никто не повторил. Единственная внешняя проверка, о которой компания рассказала, — испытания ранних версий на киберполигоне Института безопасности ИИ Великобритании. В системной карточке разработчики называют и слабое место: модель галлюцинирует чуть чаще предшественницы. А независимый сервис Artificial Analysis намерил около 68 секунд до первого символа ответа на максимальном усилии.
Интересно, что при этом Anthropic советует брать Sonnet 5 для большинства ИИ-приложений — клиентских агентов, продакшн-кода, генерации контента и поиска в реальном времени. Самые тяжелые и длинные автономные сценарии компания по-прежнему отдает Fable 5. Получается, у бывшего флагмана, а теперь средней по цене модели нет собственной территории: снизу подпирает дешевый Sonnet, сверху стоит Fable 5.
Разгадка лежит в мощностях и тарифных планах. Fable 5 в подписки просто не поместилась: с 20 июля она входит в Max и премиальные места Team лишь в пределах половины недельного лимита, а владельцы Pro получили разовые $100 кредитов и дальше платят по счетчику. Модель, которая на Pro включена без доплат, — как раз Opus 5.
Есть и разница, которую в таблицах не видно. У Opus 5 нет требований по хранению данных при общем доступе, а у старшей модели они есть, и для корпоративных задач одно это решает выбор. Защитные фильтры по кибербезопасности срабатывают примерно на 85% реже, чем у Fable, а биологические запросы, которые флагман блокирует, теперь уходят именно сюда — так средний тариф стал самым сильным общедоступным инструментом для научной работы. Знания у него тоже свежее: обучающие данные обрываются на мае 2026 года против января у обеих соседок по линейке.
