ITNEWS.pro
2 часа назад
Подписаться
Полтора часа разницы. Anthropic и OpenAI выпустили новые модели и устроили обвал цен в борьбе за пользователя

Anthropic и OpenAI выпустили новые модели в один день, с разницей всего в полтора часа. Первой вышла Claude Opus 5.5, и не успели разработчики дочитать ее описание, как OpenAI представила сразу две модели, GPT-6 Sol и GPT-6 Luna. Вершиной своих линеек их не называют даже создатели: у OpenAI флагманом остается GPT-6 Astra, у Anthropic самые сложные задачи по-прежнему закреплены за Fable 5.1. Зато все три новинки задуманы как рабочие лошадки для ИИ-агентов, то есть программ, которые сами часами пишут код, ходят по сайтам, разбирают документы и собирают отчеты.

Anthropic утверждает, что Opus 5.5 в большинстве задач работает на уровне Fable 5.1, а в нескольких тестах на самостоятельное программирование даже обходит ее. В Terminal-Bench 4.0 (проверка того, как модель справляется с задачами в командной строке, где обычно работает программист) у новинки 66,4% против 57,9% у флагманской нейросети конкурент GPT-6 Astra. Ответы стали появляться на 30% быстрее, а пишет модель, по словам компании, проще: главное выносит в начало и реже прибегает к жаргону. Режим без рассуждений убрали совсем, так что теперь Opus 5.5 обдумывает каждый шаг, хочет того пользователь или нет. Модель получила водяные знаки для соответствия европейскому закону об Искусственном интеллекте, а большую часть задач по кибербезопасности переадресует старшей по стажу Opus 4.8. В отчете о безопасности нашлась и забавная деталь: Opus 5.5 нередко подозревает, что ее экзаменуют, и сама Anthropic признает, что из-за этого сложнее предсказать поведение модели в реальной работе.

У OpenAI роли поделены четче. Sol рассчитана на сложную профессиональную работу вроде кода, многошаговых сценариев и задач в браузере, а Luna создана для потока рутины: сортировки писем, извлечения фактов из документов, черновиков заголовков. По внутреннему тесту компании, Sol ошибается в фактах примерно вдвое реже предшественницы GPT-5.6 Sol. Luna на высоких настройках рассуждения, как обещает OpenAI, догоняет прошлую Sol, но значительно дешевле. В тесте программирования DeepSWE новая Sol набрала 68,8% против 69,9% у Claude Fable 5, обойдясь на 80% дешевле за задачу. Графики OpenAI при этом устарели еще до публикации: компания сравнивала себя с Opus 5, которая к моменту выхода презентации полтора часа как стала предыдущим поколением, а данных по новой Opus 5.5 в них не оказалось вовсе.

Днем раньше свой ход сделала SpaceXAI, как теперь называет себя компания Илона Маска. Grok 4.7 прибавила в программировании и долгих задачах, но стоит ровно столько же, сколько Grok 4.6: $2 за миллион входных токенов (кусочков слов, которыми нейросети меряют и текст, и счет) и $6 за миллион выходных. Независимый рейтинг Artificial Analysis ставит модель в середину таблицы, 46 баллов против 53 у Fable 5.1 и GPT-6. Есть у скромного ценника и оборотная сторона: на одну задачу из рейтинга Grok 4.7 в максимальном режиме тратит около 81 тыс. выходных токенов, тогда как GPT-6 Astra укладывается в 27 тыс. Три крупных релиза за два дня хорошо показывают, куда сместилась гонка. Разрыв в качестве между лидерами сжался до нескольких процентов, и главным доводом в споре за клиента все чаще становится цена.

Anthropic снизила прейскурант Opus на 20%: миллион входных токенов теперь стоит $4 вместо $5, выходных — $20 вместо $25. Заметнее подешевело чтение кеша (заранее прочитанного моделью контекста, который она использует повторно), с $0,50 до $0,20. Для агента, который на каждом шаге заново перечитывает один и тот же проект, именно этот показатель самый финансово затратный. Теперь компания обещает экономию около 40% на типичной работе. Для нетерпеливых есть быстрый режим, до 2,5 раза шустрее, но и вдвое дороже, за $8 и $40. Подписчикам Claude подняли пятичасовые лимиты на 20%.

OpenAI ответила двукратной уценкой. Sol стоит $2 и $10 вместо $4 и $20 у GPT-5.6 Sol, Luna — $0,10 и $0,50 вместо $0,20 и $1,20. Прежнюю стоимость использования нейросетей компания считала временной акцией, а новую называет постоянной, да еще и дает скидку до 90% на закешированные токены. В переводе на бытовой язык за полдоллара Luna выдаст миллион токенов, это объем нескольких толстых романов. Sol по токенам вдвое дешевле Opus 5.5 и стоит ровно как Claude Sonnet 5, средняя модель Anthropic, а Luna обходится в десять раз дешевле самой младшей Claude Haiku 4.5. Рынок все больше напоминает базар, где соседние лотки перекрикивают друг друга табличками «дешевле», только вместо яблок на весах миллионы токенов.

Цена за токен при этом говорит о будущем счете меньше, чем кажется. Чем усерднее модель рассуждает, тем больше токенов она сжигает, и Anthropic сама предупреждает, что Opus 5.5 на тех же настройках думает дольше предшественницы. Почти все цифры из релизов опубликовали сами компании, при разных режимах и методиках подсчета, так что честное сравнение даст только проверка на живых задачах.

Выигрывает от этой перепалки прежде всего тот, кто платит. Разработчики получают почти флагманское качество значительно дешевле прежней цены и могут раскладывать работу по этажам, отдавая сложное Opus 5.5 или Sol, а рутину — Luna. Подписчики Claude получили больше лимитов, а Luna доберется даже до бесплатных пользователей ChatGPT в приложении для компьютера. На нижнем ценовом этаже ход теперь за Anthropic: Sonnet 5.5 и Haiku 5.5 обещают в ближайшие недели, и встречать их будет Luna за десять центов.

Подписывайся на наш Telegram и не пропусти главные новости!