Модели

Kandinsky 2.1

Мультиязычная модель для генерации изображений по текстовому описанию

date_range

Год выпуска: 2023

assignment

Описание

Kandinsky – модель, способная генерировать изображения по текстовым описаниям на разных языках. Архитектурно модель похожа на DALL-E 2, однако в отличие от DALL-E 2, Kandinsky генерирует сначала векторное представление изображения, подобно Stable Diffusion, а затем декодирует изображение из полученного векторного представления. Поддержка нескольких языков была достигнута использованием мультиязычной версии модели CLIP. 

Примеры использования:

  • Генерация изображений
  • Дорисовка фрагментов изображения
  • Перенос стиль с одного изображения на другое
  • Генерация изображений по референсам

Нововведения

  • Поддержка текстовых описаний на нескольких языках
  • Использование более качественного автокодировщика, чем в Stable Diffusion

Количество параметров: 3.22B

Share

Recent Posts

В России принят первый закон об ИИ

Документ вводит юридическое определение искусственного интеллекта, а также суверенной и национальной языковых моделей. Им придется проходить проверку на соответствие традиционным…

27.07.2026

Муза с перфокартами: как компьютеры учились писать стихи за полвека до нейросетей

Генеративная поэзия появилась задолго до ChatGPT. Компьютеры генерируют стихи уже больше 60 лет, а сама мечта заставить машину рифмовать —…

24.07.2026

MLOps для работы с текстом: принципы и минимальный набор инструментов

Как специалисты по машинному обучению наводят порядок при работе с большими корпусами? Что нужно сделать, чтобы эксперимент был воспроизводимым, качество…

20.07.2026