Генеральный директор OpenAI Сэм Альтман положительно отозвался о выходе новой модели искусственного интеллекта DeepSeek R1. В своем сообщении в социальной сети X поздно вечером в понедельник он высоко оценил достижения китайской компании.
Альтман особо отметил впечатляющие возможности новой модели, учитывая ее доступную стоимость. DeepSeek R1 действительно предлагает значительно более низкие затраты на обработку токенов по сравнению с моделями OpenAI, что делает ее более доступной для широкого круга пользователей.
Новая модель DeepSeek R1, выпущенная 20 января 2025 года, построена на архитектуре Mixture of Experts (MoE) и содержит 671 миллиард параметров, из которых только 37 миллиардов активируются при каждом прямом проходе. Это делает модель вычислительно эффективной и легко масштабируемой.
В отличие от традиционных языковых моделей, DeepSeek R1 использует подход, основанный на обучении с подкреплением, что позволяет ей самостоятельно развивать способности к рассуждениям и самопроверке. Модель показывает высокие результаты в решении задач по математике, программированию и логическому мышлению.
Признавая DeepSeek серьезным конкурентом, Альтман назвал ситуацию «бодрящей» и заявил, что OpenAI ускорит выпуск некоторых готовящихся продуктов, сообщает Bloomberg.