Одна из первых open-source рассуждающих языковых моделей, сравнимых с OpenAI o1
Год выпуска: 2024
Описание
Open-source рассуждающая языковая модель на основе DeepSeek-V3.
DeepSeek-R1 представляет собой рассуждающую модель, способную выстраивать развернутые логические цепочки для формирования более качественных итоговых ответов.
В основе DeepSeek-R1 лежит модель DeepSeek-V3 с 671 млрд параметров. Благодаря архитектуре Mixture of Experts, при генерации ответа используется только 5,5% от общего числа параметров, причем их набор динамически подбирается в зависимости от конкретного пользовательского запроса.
Обучение модели процессу рассуждений проводилось методом обучения с подкреплением, где для оценки правильности ответов использовались формальные критерии проверки.
DeepSeek-R1 стала первой рассуждающей моделью, методология обучения которой была опубликована в открытом доступе.
Примеры использования
Генерация ответов на сложные запросы, например, решение математических задач.
Нововведения
Количество параметров: 671B всего, 37B активных.
Документ вводит юридическое определение искусственного интеллекта, а также суверенной и национальной языковых моделей. Им придется проходить проверку на соответствие традиционным…
Генеративная поэзия появилась задолго до ChatGPT. Компьютеры генерируют стихи уже больше 60 лет, а сама мечта заставить машину рифмовать —…
Как специалисты по машинному обучению наводят порядок при работе с большими корпусами? Что нужно сделать, чтобы эксперимент был воспроизводимым, качество…