Что такое нейросеть Kandinsky от Сбера и кому она пригодится
Kandinsky — это нейросеть, разработанная командой SberAI для создания и редактирования изображений, анимации и коротких видео по текстовому описанию. Название выбрано в честь художника Василия Кандинского, что подчёркивает творческую направленность инструмента. В отличие от многих зарубежных аналогов, сервис полностью бесплатен, не требует VPN и понимает запросы на русском языке.
Инструмент будет полезен:
- Блогерам и SMM-специалистам — для создания уникальных обложек и визуалов под каждый пост.
- Маркетологам — для быстрого прототипирования рекламных макетов и иллюстраций к кампаниям.
- Дизайнерам — для генерации референсов и поиска идей на ранних этапах работы.
- Преподавателям — для иллюстрирования учебных материалов, исторических сцен или научных концепций.
- Всем, кто работает с контентом — для презентаций, открыток, постов и визуальных заметок.
Главное преимущество — доступность. Вы можете начать пользоваться нейросетью прямо сейчас без регистрации через Telegram-бота или ВКонтакте, а для расширенного функционала достаточно авторизоваться через Сбер ID на сайте Fusion Brain.
Какие версии Kandinsky существуют и чем они отличаются
Первая версия нейросети от Сбера, ruDALL-E, вышла в ноябре 2021 года. С тех пор модель прошла несколько этапов развития:
- Kandinsky 2.2 — стабильная версия, которая научилась создавать изображения по сложным запросам с хорошей детализацией.
- Kandinsky 3.0 и 3.1 — ускоренная генерация (до 30 секунд), улучшенное понимание русскоязычных промптов, поддержка разрешения до 2048×2048 пикселей.
- Kandinsky 5.0 — последняя на сегодняшний день версия, которая добавила генерацию HD-видео (1280×720) и более точную работу с текстовыми командами.
Каждое поколение модели заметно сокращало количество артефактов и делало изображения более реалистичными. При этом Kandinsky Video (ранее — отдельная модель для видео) теперь встроена в общий интерфейс и позволяет создавать ролики до 10 секунд длительностью.
Важно: если вы пользуетесь сервисом через Telegram-бота, там по умолчанию работает Kandinsky 3.1, а на сайте Fusion Brain доступна Kandinsky 5.0.
Как начать работу: пошаговая инструкция для первой генерации
Начать пользоваться нейросетью Сбера можно за пару минут без специальных знаний.
Шаг 1. Выберите платформу
- Самый полный функционал — на сайте fusionbrain.ai (ранее — Fusion Brain).
- Быстрый доступ без регистрации — через Telegram-бота
@kandinsky21_botили официальное сообщество ВКонтакте. - Мобильная версия доступна в приложении «СберБанк Онлайн» и через виртуального ассистента «Салют».
Шаг 2. Авторизуйтесь (если через сайт) Регистрация бесплатна: войдите через Сбер ID, Google-аккаунт или электронную почту. Это даёт доступ к редактированию изображений, генерации видео и истории запросов.
Шаг 3. Составьте промпт Опишите, что вы хотите увидеть, простыми словами на русском языке. Например: «Рыжий кот в костюме астронавта сидит на Марсе, на заднем плане голубая Земля, фотореалистичный стиль».
Шаг 4. Настройте параметры Выберите соотношение сторон (1:1, 16:9, 9:16, 3:2, 2:3), стиль из 17 доступных (например, «Детальное фото», «Акварель», «Аниме», «3D рендер») и, при необходимости, негативный промпт (чего на картинке быть не должно).
Шаг 5. Нажмите «Сгенерировать» Среднее время ожидания — от 10 до 30 секунд. Сервис создаёт сразу четыре варианта — вы можете выбрать лучший или повторить генерацию с изменённым описанием.
Шаг 6. Скачайте изображение Обычно файл сохраняется в формате JPEG, а для стиля «3D рендер» — в PNG.
Как составлять промпты, чтобы получать качественные картинки
Качество результата на 80% зависит от того, как составлен текстовый запрос (промпт). Понимание структуры промпта поможет получать предсказуемые и красивые изображения.
Формула эффективного промпта
- Объект — кто или что в центре композиции: «Молодая девушка блондинка».
- Действие или поза — что делает: «сидит у окна и пьёт кофе».
- Окружение — фон, время суток, погода: «вечер, мягкий боковой свет, за окном ночной город».
- Стиль — художественная манера: «фотореализм, cinematic light, глубина резкости».
- Дополнительные детали — цветовая палитра, настроение, ракурс: «тёплые тона, крупный план, естественный макияж».
Примеры сравнения
- Слабый: «Красивый пейзаж». Результат — случайный набор элементов.
- Хороший: «Горное озеро в Альпах на закате, отражение снежных вершин, тёплые оранжевые тона, фотореализм». Результат — конкретная картина.
Негативный промпт Это перечень того, чего не должно быть. Например: «без текста, без размытия, без искажений, без лишних конечностей». Особенно полезен для удаления нежелательных деталей из портретов (лишние пальцы, деформированные элементы).
Советы
- Выносите самое важное в начало описания.
- Избегайте метафор и сложных оборотов — пишите прямо.
- Длина 15–40 слов даёт наилучший баланс между контролем и креативностью.
- Сохраняйте удачные промпты — со временем у вас появится персональная библиотека «рецептов».
Расширенные возможности: редактирование, вариации, смешивание стилей
Помимо генерации с нуля, нейросеть Сбера предлагает несколько продвинутых функций, которые дают больше контроля.
Редактирование по тексту (Image-to-Image) Загрузите своё фото или сгенерированную картинку и напишите, что нужно изменить: «Замени фон на горный пейзаж», «Добавь солнечные очки» или «Сделай этот портрет в стиле акварели». Модель перерисует только указанные элементы, сохраняя общую композицию.
Инпейнтинг (замена фрагмента) Выделите область на изображении — нейросеть заполнит её новым содержимым по вашему запросу. Например, можно удалить ненужный объект и дорисовать текстуру вместо него.
Смешивание двух изображений Загрузите две картинки: первая определяет композицию, вторая — стиль и детали. Настройте ползунок влияния и получите уникальный визуал, сочетающий черты обоих референсов.
Расширение изображения (Outpainting) Если у вас есть прямоугольное фото и нужно добавить пространство по краям (например, превратить портрет в обложку), модель «додумает» недостающие области в том же стиле.
Анимация статичных картинок Функция оживления добавляет движение к портретам: глаза, мимика, лёгкое покачивание головы. Или вы можете создать анимацию по тексту, задав последовательность сцен.
Как генерировать видео и анимацию с помощью Kandinsky Video
Нейросеть Сбера умеет создавать не только статичные изображения, но и видеоролики. В вашем распоряжении два режима:
Text-to-Video Пишете текстовое описание (например: «Волны океана на закате, медленное движение камеры») — Kandinsky генерирует HD-видео до 10 секунд длительностью. Качество — 1280×720 пикселей, частота 24 кадра в секунду.
Image-to-Video Загружаете статичную картинку (например, портрет или пейзаж), и нейросеть «оживляет» её, добавляя плавные движения: мерцание света, шевеление листвы, мимику лица.
Анимация из нескольких сцен Можно создать анимацию до 4 сцен, каждая длится 4 секунды. Вы задаёте текст и направление камеры (зум, панорама слева направо или снизу вверх) для каждой сцены. После генерации сцены можно менять местами.
Ограничения
- Максимальное разрешение в режиме Lite — 768×512, в Pro — 1280×720.
- Негативные промпты для видео не работают.
- Время генерации — от 2 до 10 минут в зависимости от количества сцен.
Функция особенно полезна для рекламных роликов, анимированных презентаций и контента в социальные сети.
Преимущества и ограничения нейросети Сбера по сравнению с Midjourney и DALL-E
Kandinsky выгодно отличается от зарубежных аналогов несколькими ключевыми параметрами:
Бесплатность Midjourney требует подписки от 10 долларов в месяц, DALL-E — оплата токенов. Kandinsky не взимает плату ни за количество генераций, ни за доступ к функциям. Для коммерческого использования требуется отдельное соглашение с SberAI, но личные и некоммерческие проекты не ограничены.
Русский язык Промпты пишутся по-русски без перевода — модель обучена на русскоязычных данных. Midjourney лучше всего понимает английские запросы, и для точных результатов нужен перевод.
Доступ без VPN Сервис работает в России без ограничений, в отличие от Midjourney и DALL-E, которые могут быть недоступны без обходных средств.
Где Kandinsky уступает
- Детализация. Top-level модели (Midjourney v6, DALL-E 3) создают изображения с более точной анатомией, текстурами и освещением.
- Текст на картинках. Как и большинство генеративных нейросетей, Kandinsky плохо воспроизводит читаемые надписи.
- Контроль параметров. В профессиональных инструментах доступны seed-номера, управление шагами диффузии, маски и т.д. В Kandinsky таких настроек нет.
- Руки и пальцы. Хотя Kandinsky 5.0 исправил многие ошибки, странные анатомические детали всё ещё встречаются.
Общий вывод Для 70–90% задач контент-мейкера или дизайнера Kandinsky полностью закрывает потребности. Для высококачественной финальной продукции лучше использовать его как инструмент прототипирования, а итоговый рендер доверить платным аналогам.
Практические советы и типичные ошибки при работе с нейросетью
Даже при бесплатном доступе и простом интерфейсе у пользователей возникают типичные проблемы. Вот несколько советов, как их избежать.
Ошибка 1: слишком короткий промпт Промпт из одного слова («Лошадь») даёт хаотичную картинку. Добавьте хотя бы три-четыре элемента: объект, действие, окружение, стиль.
Ошибка 2: игнорирование негативного промпта Указывайте, чего не должно быть. Особенно это помогает в портретах: «деформированные пальцы, лишние руки, текст, водяные знаки».
Ошибка 3: копирование запросов из Midjourney Англоязычные промпты, полные технических терминов (octane render, 8k, photorealistic), могут не подойти. Пишите естественным русским языком.
Ошибка 4: неиспользование стилей Список из 17 стилей — мощный инструмент. Если вам нужен определённый эффект (киберпанк, масляная живопись, аниме), выберите его заранее, не описывая в тексте.
Лайфхаки
- Экспериментируйте с порядком слов: объект в начале промпта помогает модели сфокусироваться.
- Для сложных сцен с двумя персонажами прописывайте каждого подробно (костюм, цвет волос), иначе нейросеть создаст «близнецов».
- Если результат не устраивает, не меняйте промпт полностью — добавьте фразу «максимум деталей, реалистично» или уточните освещение («золотистый час», «мягкий боковой свет»).
- Сохраняйте историю удачных генераций: на сайте Fusion Brain она доступна авторизованным пользователям.
- При генерации баннеров или обложек сразу выбирайте соотношение сторон 16:9 или 3:2, чтобы не обрезать лишнее.
Где можно использовать сгенерированные изображения и какие есть юридические аспекты
Законодательство в области ИИ-контента в России ещё формируется, но действует несколько общих принципов.
Личное некоммерческое использование Вы можете свободно скачивать и использовать изображения для личных проектов: посты в соцсетях, аватары, презентации, открытки. Никаких лицензионных отчислений не требуется.
Коммерческое использование Если вы планируете продавать изображения, использовать их в рекламе или брендинге, рекомендуется получить отдельное соглашение с SberAI. На официальном сайте Kandinsky есть контакты для заключения соответствующего договора. Для большинства небольших бизнесов это не является критическим, но лучше уточнить условия.
Ограничения модерации Нейросеть блокирует запросы, нарушающие правила использования (насилие, экстремизм, порнография). Даже безобидный запрос может случайно попасть под фильтр — в таком случае попробуйте переформулировать описание более нейтрально.
Авторские права Сгенерированные изображения не защищены авторским правом в традиционном смысле, но и претензии третьих лиц (если модель воспроизвела узнаваемый стиль или персонажа) возможны. Будьте осторожны с промптами, содержащими имена брендов или известных персонажей.
Вопросы и ответы
Обязательна ли регистрация для использования Kandinsky?
Нет. Вы можете генерировать изображения без регистрации через Telegram-бота @kandinsky21_bot или сообщество ВКонтакте. Для доступа к расширенным функциям (редактирование, генерация видео, смешивание изображений, история запросов) потребуется авторизация на сайте Fusion Brain через Сбер ID или Google-аккаунт.
Почему нейросеть не понимает мой запрос или даёт неожиданный результат?
Скорее всего, проблема в промпте. Kandinsky лучше всего обрабатывает прямые и конкретные описания на русском языке. Избегайте метафор, абстрактных понятий и сложных грамматических конструкций. Разбейте запрос на элементы: объект, действие, окружение, стиль, детали. Добавьте негативный промпт (например, «без текста, без размытия») и при необходимости выберите один из 17 готовых стилей. Если результат всё равно не подходит — упростите задачу.
Можно ли использовать изображения из Kandinsky в коммерческих проектах?
Для личного и некоммерческого использования — да, без ограничений и оплаты. Для коммерческого использования (продажа, брендинг, реклама) рекомендуется заключить отдельное соглашение с SberAI через контакты на официальном сайте. В большинстве случаев для небольших бизнесов и стартапов это неформальность, но лучше уточнить условия лично.
В чём отличие Kandinsky от Midjourney и Stable Diffusion?
Главные отличия — цена и доступность. Midjourney платный (от 10 $/мес), работает только на английском и часто требует VPN в России. Stable Diffusion бесплатен, но требует мощного компьютера и технических навыков установки. Kandinsky полностью бесплатен, понимает русский язык и не требует VPN. По качеству изображений Kandinsky находится на одном уровне с Stable Diffusion, но уступает Midjourney в детализации художественных стилей. Для бытовых и контентных задач Kandinsky покрывает 70–90% потребностей.
Какое максимальное разрешение у сгенерированных изображений?
В версии Kandinsky 3.1 и 5.0 при соотношении сторон 1:1 максимальное разрешение до 2048×2048 пикселей. При соотношении 16:9 максимальное качество — 1024×576 (на сайте) или 1024×576 (в Telegram-боте). Файлы сохраняются в JPEG, для стиля «3D рендер» — в PNG.
Как удалить с картинки ненужный объект или изменить фон?
Используйте функцию инпейнтинг (замена фрагмента): загрузите изображение, выделите область, которую хотите заменить, и в отдельном поле напишите, что должно появиться вместо неё. Для замены всего фона выберите режим «Редактирование по тексту» и укажите «Замени фон на [описание]». Эти возможности доступны авторизованным пользователям на сайте Fusion Brain.
Есть ли лимиты на количество генераций и как долго ждать результат?
Для зарегистрированных пользователей лимитов на количество генераций нет. Через Telegram-бота — порядка 100 запросов в день. Среднее время генерации изображения — от 10 до 30 секунд. Видео и анимация требуют больше времени: от 2 минут (короткий ролик) до 10 минут (анимация из 4 сцен).