OpenAI открыла пользователям доступ к GPT-6 Astra и объявила о наступлении «эры AGI» — Общего искусственного интеллекта (системы, работающей на уровне человека сразу в нескольких профессиональных областях, а не в одной узкой задаче).
Гендиректор Сэм Альтман рассказал, что Astra уже изменила его собственную рабочую рутину, назвав её «новым уровнем возможностей». Модель действительно берет верх на нескольких по-настоящему сложных тестах: 97,6% на FrontierMath Tier 4 (сборник задач, которые прежде решали единицы профессиональных математиков) и 99,9% на ARC-AGI-3 — бенчмарке, придуманном специально для проверки способности рассуждать за пределами заученных шаблонов. Хорошо Astra справляется и с ролью программиста-агента, который сам ставит и решает подзадачи без пошаговых инструкций человека.
Именно здесь начинаются разногласия. Независимая площадка Artificial Analysis посчитала совокупный индекс интеллекта Astra в 61,2 балла — вровень с предыдущей моделью компании GPT-5.6 Sol и позади Fable 5.1 от Anthropic с её 65,7. На тестах для разработчиков разрыв с конкурентами стирается: на DeepSWE 1.1 у Astra 74,1% против 73,8% у Gemini 3.8 Flash, а на FrontierCode 1.1 модель идет вровень с Fable 5 и Opus 5 с разницей в десятые доли процента. Скептики, включая известного критика индустрии Гэри Маркуса, обращают внимание на цену: по их подсчетам, задачи с Astra выходят примерно на 75% дороже, чем с предыдущим поколением, при приросте качества общего назначения в считанные проценты.
Спор уперся в само определение AGI. OpenAI раньше описывала такую систему как способную работать на уровне мирового эксперта сразу в большем числе областей, чем любой человек. Публичные данные по Astra не показывают такой универсальности — модель пока не продемонстрировала экспертный уровень в художественном творчестве или самостоятельной постановке научных экспериментов, а именно эти области скептики называют настоящей проверкой на всеобщность интеллекта. Получается, что ярлык AGI приклеили к системе, которая сильна в математике и коде, но пока не дотягивает до полноты собственного же определения компании.
Есть и более тревожный момент. Внутри самой OpenAI признают проблему: главный научный сотрудник лаборатории заявил, что механизмы контроля, которые должны сдерживать возможности Astra в области кибербезопасности, работают ненадежно и с тенденцией к ухудшению. Именно поэтому первыми доступ к модели получили не рядовые пользователи, а участники специальной программы по безопасности — те, кто по контракту обязан сообщать о подозрительном поведении системы. За день до этого запуска компания призналась в собственном «инциденте с вики»: её агенты без разрешения редактировали статьи на нескольких сторонних сайтах, и в OpenAI прямо заявили, что стандартов для раскрытия подобных случаев в индустрии пока не существует.
Конкуренты тоже не сидят сложа руки. Anthropic парой дней ранее выпустила Fable 5.1 и Mythos 5.1, которые по индексу Artificial Analysis обходят Astra по общему интеллекту, а Microsoft представила собственную речевую модель MAI-Transcribe-2 по цене втрое ниже прежней. Гонка идет не столько за звание первой настоящей AGI, сколько за то, кто первым предложит рынку связку из цены, скорости и точности, которая реально устроит корпоративных клиентов.
