Что такое нейросеть Кандинский и чем она отличается от аналогов
Кандинский — это российская нейросеть для генерации изображений, анимации и видео, разработанная SberAI. Она доступна полностью бесплатно, без скрытых подписок и лимитов на количество генераций. В отличие от Midjourney и DALL-E, Кандинский не требует VPN, понимает русский язык и не блокируется в России. По качеству изображений нейросеть сопоставима с ведущими мировыми моделями, а по доступности значительно их превосходит.
Модель обучена на огромной базе визуальных образов и поддерживает более 100 языков, но лучше всего работает с русскоязычными запросами. Кандинский умеет создавать картинки с нуля, редактировать готовые изображения, смешивать стили двух картинок, генерировать анимацию из нескольких сцен и создавать короткие видеоролики. Версия Kandinsky 3.1 стала быстрее и точнее предшественников, а Kandinsky 5.0 добавила генерацию HD-видео.
Где и как пользоваться Кандинским: все платформы и способы доступа
Нейросеть Кандинский доступна на нескольких платформах, что делает её удобной для разных сценариев использования. Основные способы:
- Сайт Fusion Brain — основная веб-платформа с полным функционалом: генерация картинок, анимации, видео, редактирование, выбор стилей, негативные промпты. Требуется регистрация через Сбер ID или GosKey.
- Чат-бот в Telegram (@kandinsky21_bot) — не требует регистрации, можно генерировать изображения прямо в мессенджере. Лимит — около 100 запросов в день.
- Чат-бот ВКонтакте — аналогично Telegram, без регистрации.
- Приложение СберБанк Онлайн — встроенный доступ к генерации.
- Виртуальный ассистент Салют — голосовое управление на Android.
- Салют ТВ — команда «Включи художника».
- GigaChat — интеграция, позволяющая генерировать изображения прямо в чате с нейросетью.
Для быстрых задач достаточно Telegram-бота, для расширенных функций (редактирование, видео, история) лучше зарегистрироваться на Fusion Brain.
Как составить промпт для Кандинского: правила и примеры
Промпт — это текстовое описание того, что должна создать нейросеть. Кандинский понимает обычные формулировки на русском языке, но точность результата сильно зависит от детализации запроса.
Основные правила составления промпта:
- Выносите самое важное в начало. Сначала укажите, кто или что на картинке, затем действие, потом детали. Например: «Кот в костюме астронавта сидит на Луне, на фоне звёздного неба, фотореалистичный стиль».
- Добавляйте детали: фон, время суток, освещение, цвета, настроение, крупность плана, технические характеристики (например, «снято на плёнку 35 мм»).
- Упрощайте конструкции. Избегайте сложных оборотов и деепричастных конструкций — чем проще формулировка, тем выше вероятность правильного понимания.
- Используйте прямые отсылки. Можно указать имя художника, стиль, фильм или игру: «Закат в стиле Малевича», «Кот и собака в стиле „Криминального чтива“».
- Избегайте метафор — нейросеть воспринимает текст буквально.
Примеры промптов:
- «Реалистичное фото, плёнка 35 мм, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей».
- «Мопс в короне сидит на троне, картина в стиле Веласкеса, максимум деталей».
- «Сочный бургер, картошка фри и бутылка колы на столе, яркие цвета, максимум деталей».
Даже короткий запрос вроде «Лошадь» даст результат, но он будет менее предсказуемым.
Стили изображений и негативные промпты: как управлять результатом
Кандинский предлагает более 20 готовых стилей, которые можно выбрать перед генерацией. Это избавляет от необходимости описывать стилистику в тексте. Среди доступных стилей: фотореализм, цифровая живопись, акварель, скетч, аниме, 3D-рендер, масло, комикс, минимализм, барокко, киберпанк, рисунок карандашом, стиль Пикассо и другие. Вероятность, что нейросеть отрисует изображение в выбранном стиле, очень высокая, но сбои (галлюцинации) возможны — в этом случае стоит повторить генерацию.
Негативные промпты — это указание того, чего не должно быть на картинке. Например: «без текста, без размытия, без искажений». Они особенно полезны, когда нужно убрать нежелательные детали или исправить ошибки. Негативные промпты работают для изображений, но не поддерживаются для анимации и видео.
Также доступен ластик — инструмент для удаления ненужных объектов с уже сгенерированного изображения. После удаления можно прописать новый промпт для заполнения пустой области.
Генерация изображений: пошаговая инструкция и настройки
Процесс генерации изображения на сайте Fusion Brain:
- Выберите раздел «Картинки».
- Укажите соотношение сторон: 1:1, 16:9, 9:16, 3:2 или 2:3. От соотношения зависит максимальное разрешение: при 1:1 — 1024×1024 px, при 16:9 — 1024×576 px. В версии Kandinsky 3.1 доступно разрешение до 2048×2048 px.
- Составьте промпт. Чем больше деталей, тем выше вероятность получить релевантный результат.
- При необходимости укажите негативный промпт и выберите стиль.
- Нажмите зелёную кнопку генерации.
- Оцените результат. Если не устраивает — измените промпт или повторите генерацию.
Нейросеть выдаёт четыре варианта на каждый запрос — можно выбрать лучший или сгенерировать заново. Среднее время генерации — около 2 минут на сайте, в Telegram — примерно 10 секунд.
Стандартный формат скачивания — JPEG, для стиля «3D рендер» — PNG.
Создание анимации и видео в Кандинском
Кандинский поддерживает два режима генерации движущегося контента: анимация и видео.
Анимация создаётся из нескольких сцен (до четырёх), каждая длительностью 4 секунды. Можно выбрать направление камеры: зум, отдаление, панорама слева направо или снизу вверх. Сцены можно менять местами. Соотношение сторон: 1:1, 9:16, 16:9. При 1:1 максимальное качество — 640×640 px. Время генерации анимации из четырёх сцен — около 10 минут. Негативные промпты не работают. Скачивание — в MP4.
Видео (Kandinsky Video) — первая российская модель text-to-video, представленная в ноябре 2023 года. Максимальная длительность — 5 секунд (в версии 5.0 — до 10 секунд). Качество ниже, чем у изображений и анимации. Время генерации — около 4 минут. Соотношение сторон: 1:1, 9:16, 16:9. Негативные промпты не поддерживаются. Редактировать уже сгенерированное видео нельзя — только переписывать запрос.
Для создания видео достаточно описать сцену: «Молодой парень в белой футболке, джинсах и бейсболке едет на скейте по городу, на фоне парк аттракционов, снято на плёнку, кинематографичное видео».
Редактирование и смешивание изображений: расширенные возможности
Кандинский позволяет не только создавать изображения с нуля, но и редактировать готовые. Доступны следующие функции:
- Редактирование по текстовой инструкции. Загрузите фото и напишите, что нужно изменить: «Замени фон на горный пейзаж» или «Добавь солнечные очки». Нейросеть перерисовывает указанные элементы, сохраняя общую композицию.
- Инпейнтинг — выделите область и замените только её. Можно удалять объекты, менять цвета, добавлять детали. Работает точнее простых фоторедакторов, учитывает освещение и перспективу.
- Смешивание изображений. Загрузите две картинки, и нейросеть объединит их стили. Можно переносить палитру, композицию или отдельные элементы.
- Генерация на основе изображения. Загрузите фото и получите его нарисованную версию. Иногда результат очень похож на исходник, иногда — лишь отдалённо.
Эти функции не требуют навыков работы в Photoshop — всё делается через текст.
Ограничения, частые ошибки и как их избежать
Несмотря на высокое качество, Кандинский имеет ряд ограничений и может допускать ошибки. Вот основные:
- Дублирование предыдущих генераций. На сайте Fusion Brain нейросеть иногда начинает повторять предыдущие результаты. Решение — перезагрузить страницу или заново войти в кабинет.
- Проблемы с несколькими персонажами. Нейросеть может дублировать одного героя или рисовать лишнего. Рекомендуется максимально детализировать промпт, указывая уникальные признаки каждого персонажа, и использовать негативные промпты.
- Галлюцинации. ИИ может добавлять неожиданные детали или игнорировать часть запроса. В этом случае стоит упростить логику запроса или повторить генерацию.
- Ограничения анимации и видео. Негативные промпты не работают, качество видео ниже, чем у картинок, максимальная длина видео — 5–10 секунд.
- Коммерческое использование. Для коммерческих проектов требуется отдельное соглашение с SberAI. Личные и некоммерческие проекты не требуют согласования.
Чтобы минимизировать ошибки, экспериментируйте с формулировками, используйте негативные промпты и выбирайте подходящий стиль.
Практические сценарии использования Кандинского
Кандинский подходит для широкого круга задач:
- Контент для соцсетей и блогов. SMM-специалисты генерируют уникальные визуалы под каждый пост, не используя стоковые фото.
- Дизайн презентаций и образовательных материалов. Преподаватели создают иллюстрации для уроков: исторические сцены, научные концепции, географические объекты.
- Прототипирование и концепт-арт. Дизайнеры создают концепты персонажей, локаций, объектов для игр, фильмов, рекламы. Кандинский ускоряет брейнштормы.
- Маркетинг и реклама. Генерация уникальных визуалов под каждую кампанию, создание баннеров, обложек статей.
- Личное творчество. Эксперименты со стилями, создание артов, аватарок, открыток.
Благодаря бесплатному доступу и отсутствию лимитов, Кандинский может использоваться как основной инструмент для визуального контента.
Вопросы и ответы
Нужна ли регистрация для использования Кандинского?
Нет, если вы пользуетесь через Telegram-бота или ВКонтакте. Для доступа к расширенным функциям (редактирование, генерация видео, сохранение истории) требуется регистрация на сайте Fusion Brain через Сбер ID или GosKey.
Можно ли использовать сгенерированные изображения в коммерческих проектах?
Для коммерческого использования требуется отдельное соглашение с SberAI. Личные и некоммерческие проекты не требуют согласования. Контакты для связи указаны на официальном сайте.
В чём отличие Кандинского от Midjourney и Stable Diffusion?
Кандинский работает на русском языке, полностью бесплатен, доступен без VPN. Midjourney платный (от $10/месяц), понимает только английский. Stable Diffusion схож по архитектуре, но Кандинский оптимизирован под российскую аудиторию и культурный контекст.
Как улучшить качество изображения в Кандинском?
Подробно описывайте сцену: объекты, стиль, освещение, детали. Используйте негативные промпты, чтобы убрать нежелательные элементы. Выбирайте подходящий стиль из списка. Если результат не устроил, меняйте формулировку и пробуйте снова.
Какие форматы и разрешения поддерживает Кандинский?
Изображения: JPEG (PNG для стиля «3D рендер»), разрешение до 2048×2048 px. Анимация: MP4, до 640×640 px. Видео: MP4, HD (1280×720) в версии Pro. Соотношения сторон: 1:1, 16:9, 9:16, 3:2, 2:3.
Почему нейросеть иногда выдаёт не то, что я просил?
Это называется галлюцинацией ИИ. Причины: слишком сложный или метафоричный запрос, недостаток деталей, конфликтующие инструкции. Решение — упростить формулировку, добавить конкретики, использовать негативные промпты и повторить генерацию.
Сколько времени занимает генерация в Кандинском?
Изображение на сайте — около 2 минут, в Telegram — примерно 10 секунд. Анимация из четырёх сцен — до 10 минут. Видео — около 4 минут.