ITNEWS.pro
1 час назад
Подписаться
Claude создает Claude. Самосовершенствование в цифрах: Anthropic измерила скорость разработки ИИ, которую сама же назвала опасной

Дарио Амодеи призывает индустрию «сбавить темп» в гонке ИИ — но делает это в момент, когда Anthropic сама демонстрирует, насколько стремительно разгоняет разработку следующих поколений Claude. Контраст трудно не заметить: глава компании предупреждает об опасности самоускоряющихся систем, а через несколько дней его команда публикует цифры, показывающие, что Claude уже заметно участвует в создании собственного преемника.

Четверть работы над следующей версией нейросетей компании выполняет сама Claude. Anthropic впервые раскрыла точные цифры того, как ее собственная модель участвует в разработке преемника: в августе 2026 года 26% задач исследования и разработки дошли до четвертого уровня по внутренней шкале автоматизации — того самого, где ИИ ведет работу, а человек только задает направление. В феврале эта доля равнялась нулю.

Шкала, которую компания назвала R&D Automation Index, устроена просто. Ноль — все делает человек. Пять — полная автономия, где нейросеть сама находит задачи, планирует и исполняет их без участия людей. Уровни от третьего и выше, где Claude выступает полноценным соавтором или ведущим исполнителем, охватывают больше 90% всей исследовательской работы компании. Полгода назад такого не было вовсе.

На главной внутренней платформе агентов Anthropic одновременно работает около 30 тысяч экземпляров Claude, занятых исследованиями и инженерными задачами. Только в августе система зафиксировала больше миллиарда решений, принятых этими агентами. Люди при этом непосредственно разбирают от силы полсотни особо важных случаев в неделю. Остальное идет под автоматическим наблюдением, которое блокирует примерно одно действие из 47 тысяч.

Тренд, который стоит за этим ростом, компания подробно разбирала еще в июне в докладе «When AI Builds Itself» («Когда ИИ строит себя»): длина задач, которые модели способны выполнять самостоятельно без вмешательства человека, удваивается примерно каждые четыре месяца — быстрее, чем прежний темп в семь месяцев. Весной 2024-го Claude Opus 3 справлялась с работой, занимающей у человека около четырех минут. Год спустя Claude Sonnet 3.7 дотянулась до полутора часов. Свежий Claude Opus 4.6 уже уверенно держит задачи длиной в 12 часов.

Сама компания не скрывает, что все цифры — ее собственные измерения, без внешней проверки. Ни одна независимая сторона не подтверждала оценки уровней автоматизации, а план подключить сторонних оценщиков пока остается только планом. В день публикации доклада больше сотни исследователей и специалистов по оценке ИИ подписали открытое письмо: по их словам, у людей, которым поручено следить за такими компаниями, как Anthropic, попросту нет ни независимости, ни ресурсов, ни правовой защиты, чтобы делать это всерьез. Даже показатель блокировки в 0,002% допускает два противоположных прочтения — то ли агенты почти никогда не пытаются сделать что-то рискованное, то ли наблюдатель почти никогда не вмешивается по замыслу. Компания сама признает: цифра не говорит ни о высоком, ни о низком риске.

Пока идет спор о том, что означают эти проценты, инфраструктура продолжает расти без остановки. Anthropic обещает подключить независимых внешних наблюдателей к оценке системы — конкретной даты для этого шага компания пока не называет.

Подписывайся на наш Telegram и не пропусти главные новости!