Kandinsky от Сбера: бесплатная нейросеть для генерации изображений и видео — возможности, инструкции и ограничения

Подробный обзор нейросети Kandinsky от Сбера: возможности генерации изображений, анимации и видео, способы доступа, инструкции по созданию промптов, сравнение с аналогами и ответы на частые вопросы.

Что такое Kandinsky и чем он отличается от других нейросетей

Kandinsky — это семейство генеративных нейросетей, разработанных Сбером для создания изображений, анимации и видео по текстовому описанию. Модель появилась как развитие первой российской нейросети ruDALL-E, представленной в ноябре 2021 года, и с тех пор прошла несколько крупных обновлений: от Kandinsky 2.0 до Kandinsky 6.0 Image и Kandinsky Video. Главное отличие от зарубежных аналогов — полная бесплатность и доступность на территории России без использования VPN и иностранных платёжных систем.

По качеству генерации Kandinsky находится примерно на одном уровне с Midjourney и Stable Diffusion, которые часто называют лучшими ИИ в этой области. Однако, в отличие от них, у Kandinsky нет платных тарифов — можно генерировать неограниченное количество изображений и анимаций. Модель понимает запросы более чем на 100 языках, включая русский, что делает её особенно удобной для русскоязычных пользователей. Кроме того, Kandinsky интегрирован в экосистему Сбера: доступ к нему есть через сайт Fusion Brain, приложение «СберБанк Онлайн», виртуального ассистента «Салют» и чат-ботов в Telegram и VK.

Как получить доступ к Kandinsky: все способы

Одно из главных преимуществ Kandinsky — множество точек входа. Пользователь может выбрать наиболее удобный способ:

  • Сайт Fusion Brain — основной веб-интерфейс, где доступны все функции: генерация картинок, анимации, видео, редактирование и смешивание изображений. Требуется регистрация через Сбер ID или GosKey.
  • Чат-бот в Telegram (@kandinsky21_bot) — позволяет генерировать изображения без регистрации, но с ограниченным функционалом: доступны только базовые генерации, соотношения сторон 1:1, 16:9 и 9:16, нет редактирования и видео.
  • Чат-бот в VK — аналогичен Telegram-боту, работает без регистрации.
  • Приложение «СберБанк Онлайн» — встроенный генератор изображений доступен в мобильном приложении банка.
  • Виртуальный ассистент «Салют» — в Android-приложении можно попросить ассистента нарисовать картинку.
  • «Салют ТВ» — на телевизорах с поддержкой ассистента можно активировать режим «Включи художника».
  • GigaChat — ИИ-помощник Сбера, в котором Kandinsky используется для генерации изображений по запросу в чате.

Для большинства пользователей оптимальным выбором является Fusion Brain, так как только там доступны все возможности модели, включая редактирование и генерацию видео. Telegram-бот подходит для быстрых экспериментов, когда не хочется создавать аккаунт.

Генерация изображений: возможности и настройки

Основная функция Kandinsky — создание изображений по текстовому описанию. Пользователь вводит промпт (текстовый запрос), выбирает стиль и соотношение сторон, после чего нейросеть генерирует четыре варианта изображения. Время генерации одной картинки в среднем составляет около 2 минут на сайте, хотя в Telegram-боте обещают результат примерно за 10 секунд.

Доступные соотношения сторон: 1:1, 16:9, 9:16, 3:2, 2:3. От выбранного соотношения зависит максимальное разрешение: при 1:1 модель создаёт изображение 1024×1024 пикселей, при 16:9 — 1024×576 пикселей. В более новых версиях, таких как Kandinsky 3.1 и 5.0, разрешение может достигать 2048×2048 пикселей.

Перед генерацией можно выбрать один из 17 стилей, включая фотореализм, цифровую живопись, акварель, скетч, аниме, 3D-рендер, киберпанк и другие. Вероятность того, что нейросеть отрисует изображение в выбранном стиле, очень высокая, но иногда случаются сбои — так называемые «галлюцинации» ИИ. В этом случае достаточно повторить генерацию.

Также поддерживаются негативные промпты — формулировки через отрицания, которые позволяют указать, чего не должно быть на картинке. Например, можно написать «без текста, без размытия, без искажений». Это особенно полезно при редактировании уже сгенерированных изображений.

Создание анимации и видео в Kandinsky

Kandinsky умеет создавать не только статичные изображения, но и анимацию и видео. Анимация состоит из нескольких сцен (максимум четыре), каждая длительностью 4 секунды. Пользователь может задать отдельный промпт для каждой сцены, выбрать направление камеры (зум, панорама, отдаление) и менять сцены местами. Время генерации анимации из четырёх сцен — около 10 минут. Соотношения сторон для анимации: 1:1, 9:16, 16:9, максимальное качество при 1:1 — 640×640 пикселей. Скачать результат можно только в формате MP4.

Kandinsky Video — отдельная модель для создания видео по текстовому описанию, бета-версия которой была представлена в ноябре 2023 года. Максимальная длительность видео — 5 секунд (в более новых версиях, например Kandinsky 5.0, до 10 секунд), качество ниже, чем у изображений, а время генерации — около 4 минут. Видео можно создавать как с нуля (text-to-video), так и оживляя статичные изображения (image-to-video). Например, можно загрузить портрет и получить видео, где персонаж моргает или слегка двигает головой.

Важно отметить, что негативные промпты не работают ни для анимации, ни для видео. Также нельзя отредактировать уже созданный ролик — только перегенерировать его с новым запросом.

Редактирование изображений: от простых правок до профессионального уровня

Kandinsky позволяет не только генерировать изображения с нуля, но и редактировать уже существующие. В версии Kandinsky 6.0 Image, представленной в 2026 году, появились инструменты профессионального уровня, доступные в ИИ-помощнике GigaChat. Основные возможности редактирования:

  • Детальное редактирование — пользователь может вручную обвести кистью область на изображении и указать, что с ней сделать: удалить объект, заменить его, добавить новый элемент. Это позволяет точечно вносить правки без необходимости описывать словами местоположение объекта.
  • Генерация по нескольким фотографиям — можно загрузить до трёх изображений и одним запросом собрать из них новое. Модель извлекает из каждого фото нужный элемент (стиль, персонажа, фон) и объединяет их в единую композицию.
  • Реставрация старых снимков — модель возвращает чёткость выцветшим и поцарапанным фотографиям.
  • Стилизация — превращает фото в иллюстрацию в стиле аниме, комикса или мультфильма.
  • Нейрофотосессия — на основе одной фотографии генерируется серия новых кадров с другим фоном, одеждой или локацией.
  • Автоподбор формата — модель сама определяет оптимальное соотношение сторон на основе содержания запроса: портрет даёт вертикальный кадр, панорама города — горизонтальный, обложка альбома — квадрат.

Эти функции делают Kandinsky полноценной заменой простым фоторедакторам и позволяют создавать профессиональный контент без навыков работы в Photoshop.

Как правильно составлять промпты для Kandinsky

Качество результата напрямую зависит от того, как сформулирован запрос. Хотя Kandinsky понимает обычный русский язык, соблюдение нескольких правил поможет получить более точные и красивые изображения:

  1. Выносите самое важное в начало. Сначала укажите, кто или что должно быть на картинке, затем — что происходит, и только потом — детали. Например: «Кот в костюме астронавта на фоне звёздного неба, фотореалистичный стиль».
  2. Добавляйте детали. Фон, время суток, освещение, настроение, крупность плана, технические характеристики — всё это помогает нейросети понять, что должно получиться. Не обязательно перечислять всё, но чем больше релевантных деталей, тем лучше.
  3. Упрощайте конструкции. Избегайте сложных предложений с деепричастными оборотами. Чем проще формулировка, тем выше вероятность, что модель считает запрос верно.
  4. Используйте прямые отсылки. Если указать художника, фильм или стиль, нейросеть сгенерирует изображение в этом стиле. Например, «Закат в стиле Малевича» или «Кот и собака в стиле „Криминального чтива“».
  5. Применяйте негативные промпты. Указывайте, чего не должно быть на картинке: «без текста, без размытия, без искажений». Это повышает точность результата.
  6. Экспериментируйте. Если результат не устроил, переформулируйте запрос, измените стиль или добавьте больше деталей. Kandinsky запоминает предыдущие запросы, что удобно для доработки.

Интересно, что Kandinsky умеет создавать симпатичные изображения даже по одному слову, например «Лошадь» или «Стол». Поэтому если точность не критична, можно дать нейросети свободу творчества.

Сравнение Kandinsky с Midjourney и Stable Diffusion

Kandinsky часто сравнивают с зарубежными нейросетями, и это сравнение в целом в пользу российского сервиса. Вот основные отличия:

  • Цена. Kandinsky полностью бесплатен, в то время как Midjourney требует подписки от $10 в месяц, а Stable Diffusion хотя и бесплатен, но требует технических навыков для установки и настройки.
  • Доступность. Kandinsky работает в России без VPN, тогда как Midjourney и DALL-E официально недоступны в РФ.
  • Язык. Kandinsky понимает русский язык без переводчиков, что ускоряет работу и повышает точность. Midjourney понимает только английский, а Stable Diffusion требует дополнительных моделей для работы с русским.
  • Качество. По степени реалистичности и детализированности Kandinsky находится примерно на одном уровне с Midjourney и Stable Diffusion. Однако у Midjourney больше художественных стилей, а Kandinsky может интерпретировать сложные запросы по-разному.
  • Функциональность. Kandinsky включает генерацию изображений, анимации и видео, а также редактирование. Midjourney фокусируется только на изображениях, а Stable Diffusion требует дополнительных модулей для видео.

Таким образом, Kandinsky — оптимальный выбор для русскоязычных пользователей, которым нужен бесплатный и доступный инструмент для работы с визуальным контентом.

Практические примеры использования Kandinsky

Kandinsky подходит для самых разных задач — от личного творчества до профессиональной работы. Вот несколько примеров:

  • Контент для соцсетей. SMM-специалисты используют Kandinsky для генерации уникальных визуалов под каждый пост. Например, можно создать изображение «Мопс в короне сидит на троне, картина в стиле Веласкеса» — и получить оригинальную иллюстрацию для блога.
  • Дизайн презентаций и образовательных материалов. Преподаватели создают визуалы для уроков: исторические сцены, научные концепции, географические объекты. Например, «Закат в пустыне, максимальный реализм» — отличная иллюстрация для урока географии.
  • Прототипирование и концепт-арт. Дизайнеры создают концепты персонажей, локаций, объектов для игр, фильмов, рекламы. Kandinsky ускоряет брейнштормы, позволяя быстро визуализировать идеи.
  • Маркетинг и реклама. Маркетологи генерируют изображения под каждую кампанию, не нуждаясь в стоковых фото. Например, «Рекламный баннер онлайн казино в конфетном стиле, яркие цвета, glossy design».
  • Электронная коммерция. Создание карточек товаров, продуктовых сцен и рекламных изображений без фотостудии. Можно загрузить фото товара и попросить нейросеть заменить фон или добавить элементы.
  • Личные проекты. Kandinsky позволяет создавать аватары, обложки, открытки и просто красивые картинки для удовольствия. Например, «Медвежонок в лесу днём, жизнерадостная картинка, яркие цвета» в стиле 3D-рендера.

Важно помнить, что для коммерческого использования сгенерированных изображений может потребоваться отдельное соглашение с SberAI. Личные и некоммерческие проекты не требуют согласования.

Ограничения и недостатки Kandinsky

Несмотря на все преимущества, у Kandinsky есть и ограничения, о которых стоит знать:

  • Качество видео. Видеоролики, создаваемые Kandinsky Video, имеют низкое разрешение (SD 768×512 или HD 1280×720) и максимальную длительность 5–10 секунд. Для длинных роликов потребуются другие инструменты.
  • Сложные запросы. Kandinsky может интерпретировать сложные многосоставные запросы по-разному, иногда выдавая неожиданные результаты. Например, при генерации двух героев нейросеть может дублировать одного персонажа или создать «близнецов».
  • Галлюцинации. Как и другие нейросети, Kandinsky иногда выдаёт ошибки: дублирует предыдущие генерации, рисует лишние объекты или искажает детали. В таких случаях нужно перезагружать страницу или повторять генерацию.
  • Негативные промпты не работают для видео и анимации. Это ограничение может быть существенным при создании роликов.
  • Реестр российского ПО. В марте 2026 года Минцифры отказало во включении Kandinsky в реестр российского ПО, что может ограничить его использование в государственных и корпоративных проектах, требующих сертифицированного ПО.
  • Коммерческое использование. Для коммерческого использования требуется отдельное соглашение с SberAI, хотя на практике многие пользователи игнорируют это требование.

Тем не менее, для большинства задач Kandinsky остаётся одним из лучших бесплатных инструментов для генерации изображений и видео.

Будущее Kandinsky: развитие и новые возможности

Сбер активно развивает линейку Kandinsky, выпуская новые версии с улучшенными характеристиками. В 2026 году была представлена модель Kandinsky 6.0 Image, основанная на архитектуре Mixture of Experts (MoE), которая стала стандартом для передовых нейросетей. Суть этой архитектуры — в специализации: вместо того чтобы задействовать всю модель на каждый запрос, система автоматически выбирает нужных «экспертов» — отдельные блоки внутри неё. Это позволяет работать быстрее и экономнее, а также упрощает улучшение модели.

Kandinsky 6.0 Image работает до двух раз быстрее предыдущих версий, лучше понимает сложные запросы и создаёт более детализированные изображения. Благодаря встроенному механизму поиска по изображениям (Image RAG) модель может генерировать точные изображения даже тех персонажей и объектов, которые появились после обучения модели. Это особенно полезно для создания изображений новых поп-персонажей или актуальных событий.

В планах Сбера — дальнейшее развитие видеомоделей. Пользователи ИИ-помощника GigaChat в ближайшее время получат новые возможности работы с видеоконтентом. Также компания заявляла о намерении открыть флагманские ИИ-модели GigaChat и Kandinsky, что может сделать их доступными для сторонних разработчиков.

Таким образом, Kandinsky продолжает эволюционировать, становясь всё более мощным и удобным инструментом для создания визуального контента.

Вопросы и ответы

Нужна ли регистрация для использования Kandinsky?

Нет, если вы пользуетесь через Telegram-бота или ВКонтакте — там регистрация не требуется. Однако для доступа к расширенным функциям (редактирование, генерация видео, сохранение истории) необходимо зарегистрироваться на сайте Fusion Brain. Вход осуществляется через Сбер ID или GosKey.

Можно ли использовать сгенерированные изображения в коммерческих проектах?

Для коммерческого использования требуется отдельное соглашение с SberAI. Личные и некоммерческие проекты не требуют согласования. На практике многие пользователи используют изображения в коммерческих целях без оформления соглашения, но это может нарушать условия использования сервиса.

В чём отличие Kandinsky от Midjourney и Stable Diffusion?

Kandinsky работает на русском языке, полностью бесплатен и доступен без VPN. Midjourney платный, требует подписку от $10 в месяц и понимает только английский. Stable Diffusion бесплатен, но требует технических навыков для установки. Kandinsky также включает генерацию видео и анимации, чего нет у Midjourney.

Как улучшить качество генерации в Kandinsky?

Подробно описывайте сцену: объекты, стиль, освещение, детали. Используйте негативные промпты — указывайте, чего не должно быть на картинке. Выбирайте подходящий стиль из списка. Если результат не устроил, меняйте формулировку и пробуйте снова. Экспериментируйте с запросами — Kandinsky запоминает предыдущие генерации, что удобно для доработки.

Сколько времени занимает генерация изображения или видео в Kandinsky?

Изображение генерируется в среднем за 2 минуты на сайте Fusion Brain, хотя в Telegram-боте обещают результат примерно за 10 секунд. Анимация из четырёх сцен занимает около 10 минут. Видео генерируется примерно за 4 минуты. Время может варьироваться в зависимости от загрузки серверов.

Какие форматы файлов поддерживает Kandinsky?

Изображения скачиваются в формате JPEG, за исключением изображений в стиле «3D рендер», которые сохраняются в PNG. Анимация и видео скачиваются в формате MP4. Поддерживаются соотношения сторон 1:1, 16:9, 9:16, 3:2, 2:3 для изображений и 1:1, 16:9, 9:16 для видео и анимации.

Можно ли редактировать уже сгенерированные изображения в Kandinsky?

Да, в Kandinsky 6.0 Image доступно детальное редактирование: можно обвести кистью нужную область и указать, что с ней сделать — удалить, заменить или добавить объект. Также можно загрузить до трёх фотографий и собрать из них новое изображение. Эти функции доступны в ИИ-помощнике GigaChat.