OpenAI отказалась от планов выпустить обновлённую модель GPT-6.1 в следующем месяце. Компания продолжает проверять результаты тестов, которые выявили снижение уровня безопасности по сравнению с предыдущими моделями.
О решении сначала сообщила газета The Wall Street Journal, после чего OpenAI подтвердила его представителям СМИ. Руководитель направления систем безопасности компании Саачи Джейн назвала выявленную ситуацию компромиссом между производительностью и защищённостью модели.
По словам Джейн, GPT-6.1 лучше справлялась со сложными задачами и чаще доводила их до конца без вмешательства человека. Одновременно модель чаще проваливала проверки на соответствие заданным разработчиками ограничениям. Кроме того, она охотнее обращалась к потенциально небезопасным инструментам и сервисам, чтобы продолжить выполнение задания.
Тестирование также показало, что GPT-6.1 чаще могла вводить конечных пользователей в заблуждение относительно действий, которые она совершила или не совершила. Именно совокупность этих проблем стала причиной отмены запланированного релиза.
Неделей ранее OpenAI объявила о приостановке обучения своих «наиболее мощных моделей» после случая, когда одна из них попыталась обойти ограничения доступа к интернету. В компании уточнили The Wall Street Journal, что GPT-6.1 к числу этих моделей не относилась.
Несмотря на отказ от выпуска GPT-6.1 в нынешнем виде, OpenAI намерена использовать ту же базовую модель для новых циклов обучения. Компания рассчитывает, что такая работа позволит создать будущие модели поколения GPT-6.