Что такое нейросеть Кандинский и чем она отличается от аналогов
Нейросеть Кандинский (Kandinsky) — это российская модель искусственного интеллекта для генерации изображений, анимации и видео, разработанная командой SberAI. Она появилась как продолжение первой нейросети Сбера ruDALL-E, запущенной в ноябре 2021 года. За несколько лет Кандинский прошёл путь от простой генерации картинок до полноценной экосистемы для творчества, включающей создание логотипов, обработку фотографий и генерацию коротких видеороликов.
Главное отличие Кандинского от зарубежных аналогов — полная бесплатность и доступность в России без использования VPN. Midjourney требует платной подписки от 10 долларов в месяц и понимает только английский язык. Stable Diffusion, хотя и бесплатен, требует технических навыков для установки и настройки. Кандинский же работает прямо в браузере, понимает русский язык без переводчиков и не имеет скрытых платежей.
На момент 2025 года доступны версии Kandinsky 3.1 и Kandinsky 5.0. Третья версия отличается повышенной скоростью генерации и точностью понимания сложных запросов. Пятая версия добавила возможность создавать HD-видео длительностью до 10 секунд. Модель обрабатывает запросы на 101 языке, но лучше всего понимает именно русский — это значит, что вам не нужно подбирать сложные англоязычные промпты, как в Midjourney.
По степени реалистичности и детализированности изображений Кандинский находится примерно на одном уровне с Midjourney и Stable Diffusion. Однако у него есть важное преимущество: нейросеть часто точнее выполняет конкретные указания. Например, если в запросе сказано «чёрный кот в парике», Кандинский, скорее всего, создаст именно чёрного кота в парике, а не другого кота в шляпе.
Где можно пользоваться Кандинским: все платформы и способы доступа
Одно из главных удобств Кандинского — возможность работать на разных платформах без привязки к одному устройству. Вот полный список мест, где доступна нейросеть:
- Сайт Fusion Brain — основная веб-версия с полным функционалом. Здесь доступны генерация картинок, анимации, видео, редактирование и смешивание изображений. Интерфейс интуитивный, есть подсказки и горячие клавиши.
- Telegram-бот (@kandinsky21_bot) — самый быстрый способ получить изображение без регистрации. Просто отправляете текстовый запрос и через 10–30 секунд получаете готовую картинку. Лимит — около 100 запросов в день, чего хватает для большинства задач.
- ВКонтакте — чат-бот в социальной сети, работает аналогично Telegram-боту, также не требует регистрации.
- Приложение СберБанк Онлайн — генерация изображений доступна прямо в мобильном банке.
- Виртуальный ассистент Салют — можно попросить нарисовать картинку голосом в Android-приложении.
- Салют ТВ — по команде «Включи художника» нейросеть создаст изображение на экране телевизора.
- GigaChat — интеграция с текстовой нейросетью Сбера: вы описываете задачу, GigaChat формирует промпт для Кандинского и сразу выдаёт готовое изображение.
Для доступа к расширенным функциям — редактированию, генерации видео, сохранению истории — потребуется регистрация на сайте Fusion Brain через Сбер ID или GosKey. Зарегистрированным пользователям доступны все версии модели: Kandinsky 2.2, 3.0, 3.1 и 5.0. Количество генераций для них не ограничено.
Как генерировать изображения в Кандинском: пошаговая инструкция
Процесс создания картинки в Кандинском максимально прост и не требует специальных навыков. Вот пошаговая инструкция для веб-версии на Fusion Brain:
- Выберите раздел «Картинки» на главной странице.
- Укажите соотношение сторон: доступны варианты 1:1, 16:9, 9:16, 3:2, 2:3. От соотношения зависит максимальное разрешение. Например, при 1:1 нейросеть генерирует изображение 1024×1024 пикселей, при 16:9 — 1024×576 пикселей. В версии Kandinsky 3.1 доступно разрешение до 2048×2048 пикселей.
- Составьте промпт — текстовое описание того, что вы хотите увидеть. Пишите обычным русским языком: «Кот в костюме астронавта на фоне звёздного неба, фотореалистичный стиль». Чем больше деталей, тем выше вероятность получить нужный результат.
- Выберите стиль из списка (необязательно). Доступно более 20 вариантов: фотореализм, цифровая живопись, акварель, скетч, аниме, 3D-рендер, киберпанк, масло, комикс, минимализм, барокко и другие. Если не выбрать стиль, нейросеть использует стандартный.
- Добавьте негативный промпт (необязательно) — укажите, чего не должно быть на картинке. Например: «без текста, без размытия, без искажений». Это повышает точность результата.
- Нажмите зелёную кнопку справа от окна промпта.
- Оцените результат. Нейросеть выдаёт четыре варианта на каждый запрос. Вы можете выбрать лучший, сгенерировать заново или доработать.
В Telegram-боте процесс ещё проще: отправляете текстовый запрос и получаете одно изображение. Соотношение сторон можно выбрать из трёх вариантов: 1:1, 16:9, 9:16. Стили и негативные промпты в боте не поддерживаются.
Время генерации одного изображения на сайте составляет около 2 минут, в Telegram-боте — 10–30 секунд. Разница объясняется тем, что бот использует упрощённую версию модели.
Создание анимации и видео: возможности и ограничения
Кандинский умеет создавать не только статичные изображения, но и анимацию, и видео. Эти функции доступны в разделе «Видео» на сайте Fusion Brain.
Анимация создаётся из нескольких сцен — от одной до четырёх. Длительность каждой сцены — 4 секунды. Для каждой сцены нужно написать отдельный промпт. Можно выбрать направление камеры: зум, отдаление, панорама слева направо или снизу вверх. Сцены можно менять местами. Соотношение сторон: 1:1, 9:16, 16:9. При 1:1 максимальное качество — 640×640 пикселей. Время генерации анимации из четырёх сцен — около 10 минут. Скачать результат можно только в формате MP4.
Видео (Kandinsky Video) — первая российская модель для генерации видео, бета-версия которой вышла в ноябре 2023 года. Доступны два режима:
- Text-to-video — создание видео по текстовому описанию.
- Image-to-video — оживление статичных изображений: загружаете портрет, и нейросеть добавляет движение глаз, мимику, лёгкое покачивание головы.
Максимальная длительность видео — 5 секунд в стандартной версии и до 10 секунд в Kandinsky Video Pro. Разрешение: SD (768×512) в версии Lite или HD (1280×720) в версии Pro. Частота кадров — 24 fps. Время генерации — 2–4 минуты.
Важные ограничения:
- Негативные промпты не работают ни для анимации, ни для видео.
- Отредактировать уже сгенерированное видео нельзя — только перегенерировать с новым промптом.
- Качество видео пока уступает качеству изображений: детализация ниже, возможны артефакты.
Несмотря на ограничения, эти функции подходят для создания динамичного контента для соцсетей, анимированных презентаций и коротких рекламных роликов.
Редактирование изображений: инпейнтинг, смешивание и ластик
Кандинский предлагает несколько инструментов для работы с уже готовыми изображениями, которые превращают его в полноценный графический редактор.
Инпейнтинг — замена части изображения по текстовой команде. Вы загружаете фото, выделяете область, которую хотите изменить, и пишете, что должно появиться на этом месте. Например: «Замени фон на горный пейзаж» или «Добавь солнечные очки». Нейросеть перерисовывает указанные элементы, сохраняя общую композицию, освещение и перспективу. Это работает точнее, чем простые фоторедакторы.
Ластик — удаление ненужных объектов. Выделяете область с объектом, который хотите убрать, и нейросеть заполняет пустое место подходящим содержимым. Например, можно удалить случайно попавшего в кадр человека или убрать логотип с фотографии.
Смешивание изображений — загружаете две картинки, и нейросеть объединяет их стили. Можно переносить палитру, композицию или отдельные элементы. Например, взять композицию с одной фотографии и цветовую гамму с другой.
Генерация на основе изображения — загружаете фото и получаете его перерисованную версию в выбранном стиле. Можно сделать из фотографии акварельный рисунок или 3D-рендер. Нейросеть может как точно повторить исходник, так и создать отдалённо похожую версию — это зависит от сложности запроса.
Все эти функции доступны зарегистрированным пользователям на сайте Fusion Brain. Для работы не требуются навыки Photoshop — всё делается через текст и простые визуальные инструменты.
Как правильно составлять промпты: советы и примеры
Качество результата в Кандинском напрямую зависит от того, как составлен промпт. Вот несколько проверенных правил, которые помогут получить желаемое изображение.
Выносите самое важное в начало. Первыми словами укажите, кто или что должно быть на картинке, затем — что герой делает, и только потом — детали. Например: «Супермен и Бэтмен сидят на скамейке и едят пиццу, на фоне небоскрёбы, общий план, яркие цвета». Такая последовательность помогает нейросети сфокусироваться на главном.
Добавляйте детали. Чем подробнее описание, тем точнее результат. Указывайте фон, время дня, погоду, цвета, настроение, крупность плана, стиль. Не обязательно перечислять всё, но ключевые элементы должны быть прописаны. Пример хорошего промпта: «Реалистичное фото, плёнка 35 мм, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей».
Упрощайте конструкции. Избегайте сложных предложений с деепричастными оборотами. Чем проще формулировка, тем выше вероятность, что нейросеть считает запрос верно. Вместо «Идущий по улице под дождём человек, который держит зонт» лучше написать «Человек идёт по улице под дождём, держит зонт».
Используйте прямые отсылки. Если хотите получить изображение в определённом стиле, укажите художника, фильм или направление. Например: «Закат в стиле Малевича», «Кот и собака в стиле Криминального чтива», «Портрет в стиле Веласкеса».
Применяйте негативные промпты. Если на сгенерированном изображении появились лишние детали, пропишите их в негативном промпте. Например: «Ночь, без текста, без размытия». Это особенно полезно при работе с несколькими объектами.
Экспериментируйте. Если результат не устроил, меняйте формулировку. Иногда достаточно заменить одно слово, чтобы получить совершенно другую картинку. Кандинский запоминает предыдущие запросы — удобно дорабатывать варианты.
Даже с простыми промптами Кандинский может создавать симпатичные изображения. Например, по одному слову «Лошадь» нейросеть сгенерирует полноценную картинку. Но для точного результата лучше потратить время на детальное описание.
Практические примеры: как решать сложные задачи с несколькими объектами
Одна из самых сложных задач для любой нейросети — создание изображения с двумя и более персонажами, где каждый должен выглядеть по-своему. Кандинский, как и другие модели, часто путается: дублирует одного героя, смешивает детали костюмов или рисует лишних персонажей. Вот как с этим работать.
Задача: получить изображение, на котором Супермен и Бэтмен сидят на скамейке и едят пиццу.
Попытка 1: промпт «Супермен и Бэтмен сидят на скамейке и едят пиццу, на фоне небоскрёбы, общий план, максимум деталей, яркие цвета». Результат: нейросеть создала двух близнецов — от одного героя взяла костюм, от другого шапочку.
Попытка 2: добавляем уточнение «Один супермен и один Бэтмен» и в негативном промпте указываем «Ночь». Результат: Кандинский создал день, заменил шапочку и лосины, но героев оставил прежними.
Попытка 3: максимально детализируем промпт: «Супермен в костюме Супермена и Бэтмен в костюме Бэтмена сидят на скамейке и едят пиццу, на фоне небоскребы, общий план, максимум деталей, яркие цвета». Результат улучшился, но всё ещё не идеален.
Попытка 4: используем ластик и инпейнтинг. Сначала генерируем изображение с одним Бэтменом: «Бэтмен сидит на скамейке и ест пиццу, на фоне небоскрёбы, общий план, максимум деталей, яркие цвета». Затем с помощью ластика удаляем часть изображения и через инпейнтинг добавляем Супермена: «Голова супермена». Этот метод позволяет контролировать каждый элемент.
Вывод: для сложных сцен с несколькими персонажами лучше использовать комбинацию генерации и редактирования. Сначала создайте базу с одним героем, затем добавляйте остальных через инпейнтинг. Это требует больше времени, но даёт точный результат.
Другой пример: генерация двух героев в анимации. В тесте с белкой, читающей книгу в лесу, Кандинский правильно понял, что персонаж должен быть один, и сохранял его внешность в разных сценах. Хотя белка появлялась чаще, чем предполагалось, и в некоторых сценах держала книгу, общий результат был релевантным.
Коммерческое использование и лицензирование
Вопрос коммерческого использования изображений, созданных нейросетью Кандинский, требует отдельного рассмотрения. По умолчанию все генерации доступны для личных и некоммерческих проектов без каких-либо ограничений. Вы можете использовать их для презентаций, образовательных материалов, постов в соцсетях, личных блогов.
Однако для коммерческого использования — в рекламе, на сайтах, в печатной продукции, в товарных знаках — требуется отдельное соглашение с SberAI. На официальном сайте нейросети есть контакты для связи по этому вопросу. Точные условия и стоимость коммерческой лицензии не публикуются в открытых источниках, поэтому их нужно уточнять индивидуально.
Важно понимать: даже если вы используете бесплатную версию, права на сгенерированные изображения принадлежат вам в рамках личного использования. Но при попытке заработать на них без согласования с правообладателем модели вы можете нарушить условия использования.
Для тех, кто хочет использовать Кандинский в бизнесе, есть вариант через Yandex Cloud. Там доступна подписка на коммерческое использование, тарифы рассчитываются по количеству входных и выходных токенов. Это официальный способ легально применять нейросеть в коммерческих проектах.
Если вам нужны изображения для бизнеса, но вы не готовы заключать отдельное соглашение, рассмотрите альтернативы: Stable Diffusion с открытой лицензией или сервисы, которые явно разрешают коммерческое использование. Всегда проверяйте лицензию конкретной модели перед началом коммерческой работы.
Ограничения и частые проблемы при работе с Кандинским
Несмотря на все достоинства, у Кандинского есть ряд ограничений, которые важно учитывать.
Галлюцинации и ошибки. Как и любая нейросеть, Кандинский иногда выдаёт неожиданные результаты. Например, может дублировать предыдущие генерации, игнорировать часть промпта или создавать лишние объекты. В таких случаях помогает перезагрузка страницы или повторный вход в аккаунт.
Проблемы с несколькими объектами. Нейросеть часто путается, когда нужно изобразить двух разных персонажей. Она может смешать их черты, создать близнецов или добавить лишнего героя. Решение — использовать ластик и инпейнтинг для пошагового создания сложных сцен.
Ограничения видео. Максимальная длительность — 10 секунд, качество ниже, чем у изображений, возможны артефакты. Негативные промпты не работают. Отредактировать готовое видео нельзя.
Ограничения анимации. Негативные промпты не поддерживаются. Максимум 4 сцены по 4 секунды. Качество при 1:1 — всего 640×640 пикселей. Время генерации может превышать заявленное (10 минут вместо 6).
Сбои в работе. На сайте Fusion Brain нейросеть может начать дублировать предыдущие генерации. Приходится перезагружать страницу или входить в кабинет заново. В Telegram-боте иногда возникают задержки.
Зависимость от интернета. Все функции работают только онлайн. Скачать нейросеть на компьютер нельзя — нет офлайн-версии.
Неполное понимание сложных запросов. Хотя Кандинский хорошо понимает русский язык, сложные метафоры, абстрактные понятия и многослойные описания могут интерпретироваться по-разному. Лучше использовать прямые формулировки.
Несмотря на эти ограничения, Кандинский остаётся одним из лучших бесплатных инструментов для генерации изображений, доступных в России. Большинство проблем решаются повторной генерацией или корректировкой промпта.
Вопросы и ответы
Нужна ли регистрация для использования нейросети Кандинский?
Нет, если вы пользуетесь через Telegram-бота (@kandinsky21_bot) или ВКонтакте. Для доступа к расширенным функциям — редактированию, генерации видео, сохранению истории — потребуется регистрация на сайте Fusion Brain через Сбер ID или GosKey. Зарегистрированным пользователям доступны все версии модели и неограниченное количество генераций.
Можно ли использовать сгенерированные изображения в коммерческих проектах?
Для личных и некоммерческих проектов ограничений нет. Для коммерческого использования (реклама, сайты, печатная продукция) требуется отдельное соглашение с SberAI. Контакты для связи есть на официальном сайте нейросети. Альтернативный вариант — подписка через Yandex Cloud, где тарифы рассчитываются по количеству токенов.
Чем Кандинский отличается от Midjourney и Stable Diffusion?
Кандинский полностью бесплатен, работает на русском языке и доступен в России без VPN. Midjourney платный (от $10/месяц), понимает только английский, требует подписки. Stable Diffusion бесплатен, но требует технических навыков для установки. Кандинский также точнее выполняет конкретные указания в промптах, но уступает Midjourney в разнообразии художественных стилей.
Какой максимальный размер изображения можно получить в Кандинском?
В версии Kandinsky 3.1 доступно разрешение до 2048×2048 пикселей. В стандартной версии при соотношении сторон 1:1 нейросеть генерирует изображение 1024×1024 пикселей, при 16:9 — 1024×576 пикселей. Формат скачивания — JPEG, для стиля «3D рендер» — PNG.
Почему нейросеть не понимает мой запрос или выдаёт не то, что я просил?
Основные причины: слишком сложная формулировка с метафорами, отсутствие ключевых деталей, противоречивые указания. Попробуйте упростить запрос, вынести главное в начало, добавить конкретные детали (фон, освещение, стиль). Используйте негативные промпты, чтобы убрать лишнее. Если результат не устраивает, измените формулировку и сгенерируйте заново.
Как увеличить длительность видео в Кандинском?
Максимальная длительность видео — 5 секунд в стандартной версии и до 10 секунд в Kandinsky Video Pro. Увеличить длительность нельзя — это ограничение модели. Для более длинных роликов потребуются другие инструменты. Анимация может состоять из нескольких сцен (до 4 по 4 секунды), что даёт до 16 секунд, но это именно анимация, а не видео.
Сколько времени занимает генерация изображения в Кандинском?
На сайте Fusion Brain генерация одного изображения занимает около 2 минут. В Telegram-боте — 10–30 секунд. Анимация из четырёх сцен создаётся примерно за 10 минут. Видео — 2–4 минуты. Время может варьироваться в зависимости загрузки серверов.