Что такое Кандинский 2.1 и чем он отличается от других версий
Кандинский 2.1 — это вторая крупная версия генеративной нейросети от Сбера, выпущенная в апреле 2023 года. Она стала наследницей более ранней модели ruDALL-E, обученной на миллиарде пар «текст — изображение». Для версии 2.1 датасет расширили до 170 миллионов пар, что позволило значительно улучшить качество генерации.
Основное отличие Кандинского 2.1 от предшественников — поддержка 101 языка для текстовых запросов и возможность не только создавать изображения с нуля, но и редактировать их: заменять фрагменты, дорисовывать части, объединять два изображения в одно. По сравнению с более поздними версиями (2.2, 3.0, 3.1), 2.1 считается базовой, но всё ещё актуальной для многих задач. Она уступает новым версиям в фотореализме, но остаётся стабильной и доступной.
Важно: Кандинский 2.1 — это не последняя версия. На момент написания статьи актуальны Kandinsky 3.1 и Kandinsky 6 Image Pro, но 2.1 по-прежнему работает и доступна на ряде платформ, включая Telegram-бота и сайт ruDALL-E.
Где можно использовать Кандинский 2.1 онлайн
У нейросети Кандинский 2.1 есть несколько официальных точек входа, каждая со своими особенностями.
Fusion Brain — основной сайт с полным функционалом. Здесь доступны генерация по тексту, редактирование, дорисовка, ластик, работа с референсами. Интерфейс полностью русскоязычный, интуитивно понятный. На момент публикации на Fusion Brain можно выбрать версию 3.1, 2.2 или 2.1 — для использования 2.1 нужно переключиться в меню выбора модели.
Сайт ruDALL-E — упрощённая версия с урезанным функционалом. Доступна только генерация по текстовому описанию, без редактирования и ластика. Подходит для быстрых экспериментов, но иногда работает нестабильно.
Telegram-бот Kandinsky by Sber AI — поддерживает версии 2.1, 2.2 и 3.1. В боте можно генерировать изображения, смешивать их, переносить стиль, создавать вариации и стикеры. Функция ластика недоступна. Бот удобен для оперативного создания картинок без привязки к браузеру.
Чат-бот ВКонтакте — позволяет генерировать изображения с выбором ориентации (1:1, 3:2, 2:3). Расширенные настройки отсутствуют. Версия нейросети в боте не всегда самая свежая, но для быстрых задач подходит.
Приложение «Салют» от Сбера — голосовой помощник. Достаточно сказать «Включи художника», и откроется интерфейс Кандинского. Функционал аналогичен веб-версии, но управление частично голосовое.
Как формулировать промпты для Кандинского 2.1
Качество результата напрямую зависит от того, как составлен запрос. Для Кандинского 2.1 действуют те же принципы, что и для большинства генеративных нейросетей.
Структура хорошего промпта:
- Главные объекты — что именно должно быть на картинке.
- Характеристики объектов — цвет, размер, текстура, материал.
- Действие — что делают объекты (бегут, сидят, летят).
- Место действия — комната, лес, космос, улица.
- Стилистика — если нужного стиля нет в меню, можно указать его текстом (например, «в стиле импрессионизма» или «как на фото Анселя Адамса»).
Примеры промптов:
- «Dodge Durango в горах, арт от Скотта Якобса» — короткий запрос с указанием объекта, локации и стиля.
- «Кошка в воде, в стиле реалистичного и детализированного рендера, зелёный и янтарный, реалистичное освещение» — длинный запрос с деталями.
- «Тупак Шакур, гетто, фотография в стиле сепия» — запрос с имитацией старой фотографии.
Чего избегать:
- Частицы «не» и других отрицаний — нейросеть их часто игнорирует. Вместо «не красный» лучше написать «синий».
- Слишком большого количества объектов с деталями — модель может запутаться.
- Двусмысленных формулировок — чем конкретнее, тем лучше.
Пользователи отмечают, что разницы в качестве между русскоязычными и англоязычными промптами нет. Можно использовать любой язык, который поддерживается (всего 101 язык).
Пошаговая инструкция по созданию изображения на Fusion Brain
Рассмотрим процесс генерации на примере сайта Fusion Brain, где доступен полный функционал Кандинского 2.1.
Шаг 1. Выбор версии и ориентации Зайдите на fusionbrain.ai. В меню выбора модели укажите Kandinsky 2.1. Затем выберите соотношение сторон: 1:1 (квадрат, 768×768 px по умолчанию), 3:2 (горизонталь) или 2:3 (вертикаль). Размер можно изменить позже с помощью рамки.
Шаг 2. Ввод промпта В поле под областью генерации напишите текстовый запрос. Нажмите «Создать». Первый результат появится через 10–30 секунд.
Шаг 3. Оценка и корректировка Изучите результат. Если что-то не устраивает, используйте поле «негативный промт» — укажите, чего быть не должно (например, «размытость, лишние руки»). Можно также дополнить основной промт недостающими деталями. Повторяйте до получения удовлетворительного результата.
Шаг 4. Скачивание Нажмите кнопку скачивания в правом верхнем углу. Изображения сохраняются только на время сеанса — после закрытия сайта они исчезают. Рекомендуется сразу сохранять удачные варианты.
Редактирование изображений: замена фрагментов и дорисовка
Кандинский 2.1 позволяет не только создавать новые картинки, но и редактировать уже существующие — как сгенерированные, так и загруженные пользователем.
Замена фрагментов (инструмент «Ластик») Выберите инструмент «Ластик» в меню слева. Закрасьте область, которую хотите заменить. Затем напишите текстовый запрос, описывающий, что должно появиться на этом месте. Нейросеть перерисует выделенный фрагмент в соответствии с запросом. Это удобно для удаления лишних объектов, исправления дефектов или замены фона.
Дорисовка изображения Если сгенерированная картинка имеет слишком крупный план или объект обрезан, можно дорисовать недостающие части. Для этого:
- Создайте изображение 768×768 px.
- Сдвиньте фиолетовую рамку в сторону, чтобы появилось пустое пространство.
- Напишите запрос, описывающий, что должно быть на пустом месте.
- Нейросеть заполнит область с учётом исходного сюжета.
Важный момент: для качественной дорисовки новая область должна пересекаться с исходным изображением. Чем больше пересечение, тем выше шанс, что продолжение будет гармоничным.
Смешивание двух изображений Загрузите два референса. Нейросеть заполнит пространство между ними по текстовому запросу, создавая плавный переход. Этот метод подходит для создания коллажей или объединения разных сцен.
Создание анимации и видео в Кандинском
Начиная с версии 2.2, а затем и в 3.0, Кандинский получил возможность генерировать анимацию и короткие видео. В версии 2.1 эта функция отсутствует, но если вы используете более свежие версии на Fusion Brain, она доступна.
Анимация Перейдите на вкладку «Видео» и выберите модель «Анимация». Определите количество сцен (обычно 1–4), для каждой напишите текстовый запрос. Можно указать направление движения камеры. Длительность каждой сцены — около 4 секунд. Чем больше сцен, тем дольше генерация.
Видео Генерация видео доступна в отдельной модели. В отличие от анимации, для всего ролика есть только одно окно для ввода запроса. Время генерации — около 4 минут. Качество видео пока уступает изображениям, но технология активно развивается.
Для генерации видео через Telegram существует отдельный бот Kandinsky Video by Sber AI, но для доступа к нему требуется подать заявку.
Сравнение Кандинского 2.1 с другими нейросетями
Кандинский 2.1 часто сравнивают с Midjourney, Stable Diffusion и другими генеративными моделями. Вот ключевые различия.
Midjourney — платный сервис (от 10 долларов в месяц). Даёт более фотореалистичные и детализированные результаты, особенно в версии 5 и выше. Однако не понимает русский язык так же хорошо, как Кандинский, и требует англоязычных промптов.
Stable Diffusion — бесплатная модель с открытым исходным кодом. Требует технических навыков для установки и настройки. Онлайн-версии часто имеют ограничения. Кандинский 2.1 проще в использовании для новичков.
Dream by Wombo — бесплатный онлайн-сервис с неограниченным количеством генераций, но ограниченным набором стилей. Качество уступает Кандинскому.
Starryai — ещё один онлайн-редактор, бесплатно доступно 5 изображений в день. Подходит для редкого использования.
Главное преимущество Кандинского 2.1 — полная бесплатность, отсутствие ограничений на количество генераций и отличное понимание русского языка. Недостаток — более низкое качество по сравнению с платными аналогами, особенно в фотореализме.
Ограничения и особенности использования
При работе с Кандинским 2.1 важно учитывать несколько моментов.
Лицензия на использование Согласно пользовательскому соглашению, изображения, созданные нейросетью, можно использовать только для некоммерческих целей. Если вы планируете продавать картинки или использовать их в коммерческих проектах, необходимо уточнять условия у Сбера.
Приватность Кандинский 2.1 не имеет ленты генераций других пользователей — ваши изображения видны только вам. Однако история генераций не сохраняется: после закрытия сайта или бота доступ к картинкам теряется.
Ограничения по размеру Максимальное разрешение для версии 2.1 — 768×768 px (квадрат). При дорисовке размер можно увеличить, но качество может снизиться. В более новых версиях доступно разрешение до 1024×1024 px.
Стабильность работы Сайт ruDALL-E иногда работает нестабильно — формы могут не отправляться. Fusion Brain более надёжен. Telegram-бот работает стабильно, но не поддерживает ластик.
Технические требования Для работы через браузер достаточно современного интернет-соединения. Для интеграции через API потребуются навыки программирования.
Практические советы для получения качественных результатов
Чтобы изображения Кандинского 2.1 получались максимально качественными, следуйте этим рекомендациям.
Используйте негативные промпты Это мощный инструмент для тонкой настройки. Если на картинке появляются лишние объекты или дефекты, укажите их в негативном промпте. Например: «размытость, искажённые лица, лишние конечности».
Экспериментируйте со стилями В меню стилей на Fusion Brain доступны десятки вариантов: от фотореализма до акварели и масляной живописи. Если нужного стиля нет, укажите его в промпте — нейросеть понимает названия художественных направлений и имена известных художников.
Используйте референсы Загрузка изображения-референса помогает задать направление. Нейросеть не копирует референс, но использует его как источник вдохновения. Лучше всего работают PNG с прозрачным фоном.
Не перегружайте запрос Оптимальная длина промпта — 1–3 предложения. Слишком длинные запросы с множеством деталей могут запутать модель.
Сохраняйте удачные варианты сразу Как уже упоминалось, история не сохраняется. Делайте скриншоты или скачивайте изображения сразу после генерации.
Пробуйте разные версии Если результат на 2.1 не устраивает, попробуйте ту же задачу на 2.2 или 3.0 — каждая версия имеет свои сильные стороны.
Будущее Кандинского: что дальше?
Кандинский 2.1 — это важная веха в развитии российской генеративной нейросети, но технология не стоит на месте. Уже сейчас доступны версии 3.0 и 3.1, которые значительно превосходят 2.1 по качеству и функционалу.
Версия 3.0, представленная в ноябре 2023 года, добавила поддержку русской культуры и фольклора: нейросеть научилась генерировать изображения в стиле гжели, жостовской росписи, а также узнавать персонажей русских сказок. Версия 3.1 улучшила фотореализм и скорость генерации.
В 2025–2026 годах команда Kandinsky Lab (совместный проект Сбера и AIRI) выпустила Kandinsky 5.0 и Kandinsky 6 Image Pro — модели с архитектурой Mixture-of-Experts, которые генерируют изображения высокого разрешения с точной передачей текста и деталей. Эти версии доступны на Fusion Brain и через API.
Таким образом, Кандинский 2.1 остаётся актуальным для базовых задач, но для профессионального использования рекомендуется переходить на более новые версии.
Вопросы и ответы
Кандинский 2.1 полностью бесплатен?
Да, нейросеть Кандинский 2.1 доступна полностью бесплатно. Нет ограничений на количество генераций, платных тарифов или подписок. Это одно из главных преимуществ перед зарубежными аналогами, такими как Midjourney.
Можно ли использовать изображения Кандинского в коммерческих целях?
Согласно пользовательскому соглашению, изображения, созданные нейросетью, предназначены только для некоммерческого использования. Если вы планируете продавать картинки или использовать их в коммерческих проектах, необходимо уточнить условия у правообладателя — Сбера.
Какой промпт лучше — на русском или английском?
Разницы в качестве между русскоязычными и англоязычными промптами нет. Кандинский 2.1 поддерживает 101 язык и одинаково хорошо понимает запросы на любом из них. Выбирайте тот язык, на котором вам удобнее формулировать.
Почему мои изображения не сохраняются после закрытия сайта?
Нейросеть Кандинский 2.1 на Fusion Brain сохраняет изображения только на время сеанса. После закрытия сайта или обновления страницы доступ к ним теряется. Рекомендуется сразу скачивать удачные варианты с помощью кнопки в правом верхнем углу.
Чем Кандинский 2.1 отличается от версии 3.0?
Кандинский 3.0, выпущенный в ноябре 2023 года, предлагает более высокое качество фотореализма, поддержку русской культуры и фольклора, а также возможность генерации анимации и видео. Версия 2.1 — более старая, но всё ещё стабильная и доступная для базовых задач.
Как удалить лишний объект на сгенерированном изображении?
Используйте инструмент «Ластик» на Fusion Brain. Закрасьте область с лишним объектом, затем напишите текстовый запрос, описывающий, что должно быть на этом месте. Нейросеть перерисует фрагмент. Этот инструмент доступен только в веб-версии, в Telegram-боте его нет.
Можно ли интегрировать Кандинский 2.1 в свой сайт или приложение?
Да, для разработчиков доступна интеграция через API Fusion Brain. Это позволяет подключить нейросеть к собственному проекту. Для использования API потребуются навыки программирования. Подробности можно найти на сайте Fusion Brain.