Anthropic: нейросеть Claude помогает создавать следующую версию самой себя

Алгоритм берет на себя все больше инженерных задач, приближая момент рекурсивного самосовершенствования, что вызывает серьезные споры о безопасности ИИ.
JRdes/Shutterstock/FOTODOM

Компания Anthropic объявила, что языковая модель Claude активно участвует в проектировании и обучении собственной следующей, более продвинутой версии, сообщает АР. Подобный прецедент знаменует фундаментальный шаг к практическому исследованию рекурсивного самосовершенствования алгоритмов — гипотетического момента, когда искусственный интеллект сможет автономно и непрерывно улучшать собственную архитектуру.

Согласно отчету лаборатории, Claude уже выступает ведущим исполнителем в 26% исследовательских и инженерных процессов компании. Это означает способность модели закрывать полный цикл сложных задач, хотя окончательный контроль пока сохраняется за человеком-оператором. О полной автономности речи еще не идет, однако степень самостоятельности системы стремительно увеличивается.

От ассистента к ведущему разработчику

Темпы интеграции алгоритма в научный поиск оказались беспрецедентными. Еще в феврале доля задач, которые Claude вел автономно, равнялась нулю. К августу этот показатель подскочил до четверти от общего объема научно-исследовательских и опытно-конструкторских работ лаборатории.

Если же рассматривать задачи, решаемые в тесном тандеме с человеком, то Claude задействован уже в 90% разработок. Нейросеть берет на себя массивные блоки кода и расчетных процессов, следуя указаниям инженеров. Для обеспечения таких масштабов в инфраструктуре Anthropic по состоянию на конец лета действовало порядка 30 тысяч специализированных ИИ-агентов, непрерывно выполняющих исследовательские операции.

Риски рекурсивного прогресса

Столь быстрый переход инициативы к алгоритмам вызывает серьезные опасения у экспертов. В Anthropic открыто признают: ситуация, при которой модели сами ускоряют свое развитие, способна сделать эти системы практически непостижимыми для человеческого понимания и слабо поддающимися контролю.

Компания настаивает на сокращении информационного разрыва между закрытыми лабораториями и обществом. Anthropic призвала всех игроков рынка стандартизировать метрики вовлеченности ИИ в собственную разработку и публиковать их открыто. Это позволит независимо оценивать дистанцию до точки сингулярности. Для снижения рисков компания развертывает системы мониторинга сбоев и намерена допустить к контролю внешних независимых аудиторов.

Публикация отчета совпала с обострением полемики вокруг безопасности ИИ, вызванным уходом одного из ведущих исследователей Anthropic, предупредившего об экзистенциальных угрозах технологии. Генеральный директор компании Дарио Амодеи, а также Сэм Альтман и Илон Маск все чаще высказываются за осознанное замедление темпов ради внедрения защитных мер. Однако политическое руководство США и часть лидеров кремниевой индустрии выступают против паузы, опасаясь потерять технологическое превосходство.

Подписывайтесь и читайте «Науку» в MAX