Шоурил
NEW · Флагман

Kandinsky 6.0 Image Pro

Крупное обновление линейки Image — переход на архитектуру Mixture‑of‑Experts с фокусом на качество редактирования и скорость: более чем на 40% быстрее Kandinsky 5.0 благодаря более эффективной параллелизации вычислений и attention

  • Image RAG — извлекает релевантные референсные изображения из базы знаний для обогащения контекста при генерации и редактировании, включая русские культурные мотивы, персонажей и художественные стили
  • Расширенный тулкит редактирования — инпейнтинг, удаление объектов, перенос стиля, реставрация и колоризация фото, генерация дизайна интерьера/экстерьера
  • Конкурирует с Flux 2 Max и превосходит GPT Image 1.5 в прямых сравнениях
  • Редактирование по 3 референсам и точное управление кистью — сочетайте до трёх референсных изображений и рисуйте точно там, где нужно применить правку
Сгенерировано в Kandinsky 6.0 Image Pro
Предыдущий релиз

Предыдущее поколение — открытые модели генерации изображений из текста и редактирования по инструкциям, по‑прежнему доступны, документация — ниже

Image

6B · SOTA

Модель генерации изображений из текста в высоком разрешении, достигающая наилучшего визуального качества и следования запросу. Превосходит ведущие открытые модели, такие как FLUX.1[dev] и Qwen‑Image, по эстетическому реализму и композиционной точности

  • RL‑дообученная модель — обеспечивает наивысшую визуальную точность и реализм
  • SFT‑soup модель — превосходит в следовании запросу и общем визуальном качестве
  • Претрейн‑чекпоинт — для исследователей, желающих провести дальнейшую дообучение и эксперименты
  • Нативный рендеринг кириллицы — обучена на 10M+ изображениях, содержащих русский текст в разных начертаниях — от печатных до рукописных
текст‑в‑изображение ≤1024×1024

Image Editing

Instruct

Специализированный вариант базовой модели Image, дообученный на инструктивном датасете для точного, контекстно‑зависимого редактирования изображений — инпейнтинг, замена объектов, перенос стиля

  • Редактирование по инструкции из одного запроса + исходного изображения
  • Сохраняет идентичность и композицию за пределами редактируемой области
изображение‑в‑изображение редактирование по инструкции ≤1024×1024
Сгенерировано в Kandinsky Image 5.0
Создано для русского языка

Обучена на 10M+ изображениях, содержащих русский текст в самых разных начертаниях — от печатных до рукописных, что позволяет точно распознавать различные стили написания

Как проходило обучение

Предыдущие версии

Апр 2024

Kandinsky Flash / 3.1

Flash (11.9B) генерирует изображения всего за 4 шага — в 10 раз быстрее стандартной диффузии. 3.1 (15.5B) использует Flash как рефайнер для повышения качества и добавляет культурную осведомлённость для русскоязычных запросов

Ноя 2023

Kandinsky 3.0

11.9B параметров — генерация изображений высокой точности с улучшенным следованием тексту

Июл 2023

Kandinsky 2.2

4.8B параметров — фотореалистичные изображения в разрешении 1024×1024. Поддержка ControlNet и 4‑секундные видеоролики

2022–2023

Kandinsky 2.0 / 2.1

2B / 3.3B параметров — диффузионная генерация. Поддержка 101 языка. Инпейнтинг, аутпейнтинг и редактирование изображений в разрешении до 768×768