Kandinsky
Генеративная модель от Сбербанка для синтеза визуального контента из текстовых запросов на русском и английском. Процесс включает три фазы: создание набора вариантов, оценку качества посредством нейросети CLIP, увеличение разрешения с детализацией. В версии 5.0 реализованы компонент Image Lite для трансформации текста в изображение и его модификации, а также двухмодульная система видеопроизводства. Версия 3.1 повысила реалистичность фотографий и обработку высоких разрешений с гибкими соотношениями сторон. Построена на архитектуре латентной диффузии с параметризацией в 12 миллиардов элементов. Применяется в художественных работах, рекламных кампаниях, UI-дизайне, создании иллюстраций. Предоставляется через платформу FusionBrain без платежей. Входит в крупнейший европейский проект открытого кода по генеративным системам. Генерирует изображения многих художественных направлений: от абстрактной графики до технических рисунков.
Бесплатная версия
Есть
Бесплатный план с возможностью использования платформы, необходимо связаться с отделом продаж для деталей
API
Есть
Преимущества
- Поддерживает русский язык в промптах и генерирует изображения по описаниям на кириллице
- Доступна бесплатная версия через приложение СберБанк Онлайн и Telegram
- Включает модели для генерации видео и редактирования изображений
- Версия 3.1 обеспечивает фотореалистичность и поддерживает произвольные пропорции изображений
Недостатки
- Качество результатов уступает аналогам Midjourney и DALL-E 3
- Платные версии требуют подписку через российские платёжные системы
Тарифы
- Бесплатный: доступ через СберБанк Онлайн и Telegram с ограничениями на количество генераций
- Базовый: 499 рублей в месяц — 200 генераций изображений
- Стандартный: 2399 рублей в месяц — 1000 запросов для создания картинок и видео
- Дополнительно: API GigaChat доступен с оплатой по потребленным токенам
Доступность по платформам
-
Веб-приложение Нет
-
iOS приложение Нет
-
Telegram-бот Да
-
Android приложение Нет
-
Расширения Нет
Обзор Kandinsky
Kandinsky — генеративная нейросеть разработки Сбербанка, предназначенная для создания изображений на основе текстовых описаний на русском и английском языках. Сервис построен на архитектуре латентной диффузии и в крупной конфигурации содержит 12 миллиардов параметров. Платформа реализует трёхэтапный процесс: начальная генерация множества вариантов, ранжирование по качеству с помощью модели CLIP, затем финальный апскейлинг для повышения детализации. Kandinsky 5.0 представила модель Image Lite для текст-в-изображение преобразований и редактирования, а также две модели для генерации видео. Версия 3.1 улучшила фотореалистичность и поддержку высоких разрешений с гибкими пропорциями. Доступен через платформу FusionBrain с бесплатным и платными тарифами.Основные возможности
- Генерация изображений из текста — преобразование текстовых описаний в визуальный контент различных стилей: от абстрактной живописи и фотореалистичных композиций до технических схем и графических элементов.
- Создание персонажей — разработка уникальных персонажей для игр, комиксов, анимации и других творческих проектов на основе подробных описаний внешности и характеристик.
- Генерация видео — две встроенные модели для создания видеоконтента, что расширяет спектр применения сервиса за пределы статичных изображений.
- Редактирование изображений — возможность модификации и улучшения существующих изображений через текстовые инструкции, включая инпаинтинг и перепроектирование элементов.
- Колоризация фотографий — восстановление цветности чёрно-белых изображений с сохранением исторической достоверности или творческой интерпретацией.
- Создание логотипов и графических элементов — инструмент для разработки уникальных логотипов, иконок и декоративных элементов для брендинга и дизайна.