ITNEWS.pro
…
2 часа назад
Подписаться
Sonnet 5.5. Средняя модель Anthropic догнала флагман за полцены

Anthropic выпустила Claude Sonnet 5.5, свою модель среднего класса. В ряде собственных тестов она почти сравнялась с флагманом Opus 5.5, который вышел всего неделей раньше. При этом токены (фрагменты текста, которыми модели измеряют объем работы) у новинки вдвое дешевле: $2 за миллион на входе и $10 на выходе против $4 и $20 у старшей модели.

Показательнее всего результат на тесте GDPval-AA, который оценивает задачи из реальных профессий. Sonnet 5.5 набрала 1844 балла, Opus 5.5 — 1846, а предыдущая Sonnet 5 — 1449. В управлении компьютером (тест OSWorld 2.1) разрыв с флагманской нейросетью компании сократился до пары пунктов: 80,1% против 81,8%. В агентном программировании на Terminal-Bench 4.0, где модель сама работает в командной строке, средняя модель даже обошла Opus 5.5, 70,6% против 66,4%. У Sonnet 5 там было 10,3%, так что за одно поколение результат вырос почти всемеро.

Цену за токен Anthropic не изменила, и на этом построен весь расчет релиза. Компания обещает, что новая модель пишет текст на 30% быстрее и обходится до 30% дешевле за задачу, потому что тратит меньше токенов и реже обращается к инструментам. На нескольких тестах Sonnet 5.5 в режиме низкой или средней «глубины размышлений» превзошла лучший результат Sonnet 5 примерно за десятую часть стоимости. Первые клиенты приводят свои цифры. В Box модель работала в 2,4 раза быстрее и тратила на 12% меньше токенов, Lovable насчитала на треть меньше вызовов инструментов, а сервис Base44 на 118 реальных сборках приложений получил в среднем 3,6 итерации против 7,7 у Opus 5.

Такой переход от цены токена к цене задачи продиктован рынком. Неделей раньше OpenAI выпустила GPT-6 Sol ровно с теми же $2 и $10 за миллион, а Google продает Gemini 3.8 Flash по цене $0,75 и $3,75. Соревноваться прайсом стало тесно, поэтому Anthropic предлагает считать стоимость готового результата вместо отдельной строчки счета. Со стороны это похоже на попытку сделать так, чтобы большинству компаний просто не понадобилось подниматься до уровня флагмана.

Вместе с возможностями выросли и ограничения. Sonnet 5.5 стала первой моделью в линейке с защитой, которую раньше ставили только на самые мощные системы: рискованные запросы, связанные со взломом, модель передает прежней Sonnet 5. Кроме того, Anthropic добавила фильтры против дистилляции, то есть обучения чужой модели на массовых ответах более сильной. Интересно, что сами крупные лаборатории обучались на чужих текстах без спроса, так что моральная позиция тут шаткая.

Новинка рассчитана на понятные повседневные задачи: отладку кода, документы, таблицы и презентации. Для размытых долгих проектов, где нужно подробное резюме и всестороннее исследование вопроса, компания по-прежнему советует Opus 5.5. Модель доступна через API (интерфейс для подключения программ), а также в AWS, Google Cloud и Microsoft Azure. В Claude Code по умолчанию стоит средний уровень усилий.

Линейку 5.5 закроет Claude Haiku 5.5 для массовых дешевых нагрузок, ее обещают в ближайшие недели. А 1 января 2027 года вводная цена Gemini 3.8 Flash вырастет вдвое, до $1,50 и $7,50 за миллион. Тогда станет заметнее, во что обходится экономия на токенах и во что экономия на шагах.

Подписывайся на наш Telegram и не пропусти главные новости!