ITNEWS.pro
29 мая 2026 в 07:39
Подписаться
Anthropic обновила флагманскую модель Opus и пообещала дать общий доступ к нейросети, которую боится ЕС

Anthropic выпустила новую флагманскую модель Claude Opus 4.8 всего через 41 день после релиза Opus 4.7. Это стало самым коротким циклом обновления в истории компании. Что именно изменилось? На бенчмарке SWE-bench Verified, где модели тестируют на реальных задачах разработки, Opus 4.8 набрал 88,6% против 87,6% у предшественника. На SWE-bench Pro — 69,2% против 64,3%. По GPQA Diamond (тест на научное рассуждение уровня доктора наук) — 93,6%. На олимпиадных задачах USAMO 2026 (одно из самых престижных математических соревнований для старшеклассников в США) Opus 4.8 набрал 96,7% — против 69,3% у Opus 4.7.

Модель стала в четыре раза реже пропускать ошибки в генерируемом коде, а показатели «несогласованного поведения», когда ИИ вводит в заблуждение или уклоняется от ответа, теперь приближаются к уровню закрытой модели Mythos Preview. Именно «честность» стала главным достоинством релиза. Anthropic делает акцент на том, что ИИ-модели порой «делают поспешные выводы, уверенно заявляя о прогрессе, когда доказательств почти нет». Bridgewater Associates (один из крупнейших хедж-фондов мира) отметил, что главное отличие Opus 4.8 — склонность заранее предупреждать о проблемах с необходимыми для работы данными, в то время, как другие модели просто выдают ответ.

Ценообразование осталось прежним: $5 за миллион входящих токенов и $25 за миллион исходящих. Одновременно Anthropic запустила Dynamic Workflows — функцию, которая позволяет модели планировать работу и запускать сотни параллельных субагентов (вспомогательных ИИ-процессов) в одной сессии. Теперь Claude может самостоятельно провести рефакторинг (переработку) огромной базы кода — от постановки задачи до слияния изменений в репозиторий, без вмешательства человека.

Параллельно компания заявила о планах дать доступ к своей самой мощной нейросети Mythos всем желающим. Изначально Anthropic держала ее в строжайшем карантине. Для использования модели даже был создан Project Glasswing, через который доступ предоставлялся только 50 организациям (Google, Cisco, Microsoft, CrowdStrike, Mozilla и другим) исключительно для поиска и закрытия уязвимостей в распространённом ПО. Причина такой осторожности была вполне оправдана. Британский Институт безопасности ИИ выяснил, что Mythos способна автономно завершить 32-шаговую симулированную атаку на корпоративную сеть. Mozilla сообщила, что модель обнаружила 271 уязвимость в Firefox в ходе внутреннего тестирования.

Не обошлось без скандала. Европейские регуляторы настаивали на доступе к Mythos для изучения, но ни одна компания из ЕС не попала в исходный список партнёров, а Anthropic ограничилась устными заверениями в стиле «скоро предоставим».

И вот компания объявила, что Mythos появится у всех клиентов «в ближайшие недели», хотя ещё в начале месяца называла горизонт в 6–12 месяцев. Сейчас Anthropic заявила, что «стремительно продвигается в разработке защитных механизмов» и ожидает завершения работы в ближайшее время, но так и не раскрыла, что именно считает достаточной защитой и будут ли все клиенты получать одинаковый уровень доступа.

Подписывайся на наш Telegram и не пропусти главные новости!