Выход новой модели ИИ отменен по соображениям безопасности

WSJ: OpenAI отменила релиз Astra 6.1 из-за опасений по поводу безопасности
Внутреннее тестирование показало, что искусственный интеллект ведет себя слишком своевольно.
kovop/Shutterstock/FOTODOM

OpenAI не будет выпускать свою новейшую модель искусственного интеллекта под названием Astra 6.1 — внутреннее тестирование показало, что она не соответствует стандартам безопасности, сообщила глава отдела систем безопасности компании Саачи Джайн.

По ее словам, новинка превзошла предыдущие модели по ряду параметров, но «не дотянула до планки с точки зрения соблюдения рамок и авторизации, а также отчетов перед пользователем о проделанной работе».

«Мы хотим быть уверены, что разработка наших моделей безопасна — и внутри компании, и когда мы передаем их пользователям. Когда речь идет о передаче пользователям, требования к безопасности и согласованности у нас особенно высоки», — сказала Джайн The Wall Street Journal.

Опасения по поводу безопасности систем искусственного интеллекта усилились в последние месяцы после ряда инцидентов с участием агентов ИИ, разработанных OpenAI и ее конкурентом Anthropic. Они получали несанкционированный доступ к сайтам федеральных ведомств США, статистическому порталу минздрава Австралии и Hugging Face — хранилищу ИИ-моделей.

OpenAI принесла извинения за эксцесс с австралийским ресурсом. «Мы сожалеем и работаем над тем, чтобы в будущем действовать лучше», — подчеркнула компания в своем блоге.

В Австралии о произошедшем узнали из письма компании, отправленного через несколько месяцев после инцидента на один из публичных адресов. «Нашей целью было дать затронутым ведомствам подробный отчет после завершения расследования. Однако нам следовало раньше поделиться предварительными выводами и держать австралийские ведомства в курсе по мере появления новых фактов», — признала OpenAI.

OpenAI, Anthropic и другие крупные разработчики ИИ обещали отдавать приоритет моделям с защитными ограничениями, чтобы снижать риски и при этом согласовывать их с человеческими ценностями.

Американский производитель чипов Nvidia объявил о введении в свою продукцию аппаратных ограничений, пресекающих небезопасные действия ИИ.

«Я считаю, что это инженерная задача... и нам всем стоит надеяться, что это инженерная задача. Если это не инженерная задача — то она нерешаема», — предупредил глава Nvidia Дженсен Хуанг.

Стоит отметить, что не все эксперты разделяют опасения по поводу ИИ — многим эта шумиха кажется искусственно раздутой.

Подписывайтесь и читайте «Науку» в MAX