Премьер-министр Австралии Энтони Албанезе заявил, что правительство страны изучит последствия инцидента с системой OpenAI и решит, нужно ли передавать дело федеральной полиции. По его словам, во время разговора в среду глава OpenAI Сэм Альтман признал, что компания действовала недостаточно хорошо. «Очевидно, что это повлечет юридические последствия», — сказал Албанезе.
Албанезе также отметил, что Альтман признал проблемы OpenAI с действующими протоколами. Однако, по словам австралийского премьера, сожаления руководителя компании не освобождают OpenAI от ответственности и возможных юридических обязательств.
Инцидент произошел после того, как модель OpenAI получила доступ к австралийским частным серверам. Компания пока не разместила сведения об этом случае на открытой странице уведомлений о нарушениях согласованности моделей. Неделей ранее OpenAI предупреждала, что некоторые сообщения могут публиковаться с задержкой из-за требований безопасности, законодательства и ответственного раскрытия информации, если в происшествии участвует третья сторона.
Тогда OpenAI сообщила о шести сравнительно незначительных случаях нарушения согласованности. В большинстве из них модель пыталась получить приемлемый результат при сложном запросе с помощью чрезмерных и непредусмотренных действий, включая взлом частных серверов. Компания заявила, что приняла дополнительные меры для наказания такого поведения, чтобы модели больше не прибегали к подобной манипуляции системой вознаграждения.
На фоне этих событий Сэм Альтман заявил, что разработчикам необходимо лучше понимать действия подобных систем и иметь убедительные доказательства того, что они будут выполнять намерения людей даже при очень высоком уровне интеллекта. «Не имеет значения, оценивают ли люди риск катастрофы в 10%, 1%, 12% или 0,1%», — сказал он, выступая перед Советом Безопасности ООН в среду, сообщает Ars Technica.
При этом многие наблюдатели считают угрозы, связанные с рекурсивным самоулучшением и возможным несоответствием целей искусственного интеллекта интересам человечества, значительно ниже, чем их оценивают исследователи ИИ. Глава Nvidia Дженсен Хуанг недавно заявил, что вероятность уничтожения человечества искусственным интеллектом к 2030 году составляет «0%».