В середине мая в Беркли, штат Калифорния, состоялось закрытое мероприятие, на которое съехались тридцать ведущих математиков мира. Целью встречи было состязание с новым чат-ботом, оснащенным искусственным интеллектом, чтобы проверить его способности к решению сложнейших математических задач. Ученые в течение двух дней предлагали нейросети проблемы профессорского уровня и были ошеломлены, когда обнаружили, что она способна справиться с некоторыми из самых трудных разрешимых задач в мире.
Чат-бот, который проходил тестирование, работает на базе модели o4-mini от компании OpenAI. Эта модель была специально обучена для выполнения сложных логических построений. По словам одного из участников встречи, математика из Университета Вирджинии Кена Оно, некоторые его коллеги заявили, что возможности таких моделей приближаются к уровню математического гения. В отличие от предыдущих версий, новые языковые модели, подобные o4-mini, обучаются на специализированных наборах данных с более сильным контролем со стороны человека, что позволяет им глубже вникать в сложные математические проблемы.
Показательным стал случай, описанный Кеном Оно. Он предложил нейросети открытую проблему из теории чисел, которую можно считать задачей уровня Ph.D. В течение следующих десяти минут математик в изумлении наблюдал, как бот в реальном времени разворачивал решение. Сначала искусственный интеллект за две минуты изучил всю необходимую научную литературу по теме. Затем он сообщил, что для начала решит упрощенную версию задачи, чтобы лучше понять суть. Через несколько минут ИИ заявил, что готов приступить к основному вопросу, и еще через пять минут представил правильное решение.
Как сообщает издание Scientific American, организаторы встречи из некоммерческой организации Epoch AI предложили вознаграждение в 7500 долларов за каждую задачу, которую нейросеть решить не сможет. Несмотря на впечатляющие способности искусственного интеллекта, по итогам двухдневной работы ученым все же удалось найти десять таких проблем. Тем не менее, участники были поражены прогрессом, достигнутым ИИ всего за один год. Некоторые сравнили работу с ботом с взаимодействием с «сильным коллегой» или даже с очень способным аспирантом, но при этом ИИ справлялся с работой за минуты, на что у человека ушли бы недели или месяцы.
Наряду с восхищением возможностями технологии, ученые выразили и обеспокоенность. Было отмечено, что нейросеть представляет свои решения с такой уверенностью, что возникает риск «доказательства путем устрашения», когда возможные ошибки могут быть просто не замечены из-за авторитетной подачи материала. Этот феномен требует особой бдительности при проверке результатов работы ИИ.
По итогам встречи математики начали обсуждать, как изменится их профессия в будущем. Если искусственный интеллект достигнет уровня, на котором сможет решать задачи, недоступные даже лучшим умам человечества, роль математиков может кардинально трансформироваться. Возможно, они переключатся с решения проблем на их постановку, направляя ИИ в поиске новых математических истин, подобно тому как научный руководитель работает с аспирантами. В связи с этим участники пришли к выводу, что ключевым направлением в высшем образовании станет развитие творческого мышления у будущих поколений ученых.