Как пользоваться нейросетью Кандинский 3.0: полное руководство по генерации изображений

Подробный гайд по работе с нейросетью Кандинский 3.0 от Сбера: регистрация, создание промптов, стили, обработка фото, анимация и видео. Разбираем все способы доступа и типичные ошибки.

Что такое нейросеть Кандинский 3.0 и чем она отличается от предыдущих версий

Кандинский 3.0 — это отечественная нейросеть от Сбера (SberDevices) для генерации изображений по текстовому описанию. Она обучена на миллионах пар «картинка — текст» и способна создавать полностью новые изображения, а не склеивать фрагменты чужих работ. В отличие от зарубежных аналогов, сервис полностью русифицирован и понимает запросы на русском языке без необходимости перевода.

Первая версия технологии появилась в ноябре 2021 года под названием ruDALL-E XL. Затем последовали версии 2.1 (апрель 2023) и 2.2 (июль 2023), каждая из которых улучшала качество фотореализма. Версия 3.0, представленная в ноябре 2023 года, стала значительным шагом вперёд: она лучше понимает сложные описания, точнее передаёт детали и знакома с русской культурой — от фольклора до советской архитектуры. Нейросеть может изобразить Бабу Ягу, персонажей русских сказок или элементы гжели и жостовской росписи без специальных уточнений в запросе.

Ключевое отличие 3.0 от 2.1 — качество на сложных сценах. Если простые запросы обе версии выполняют сопоставимо, то при описании многофигурных композиций, сложного освещения или специфических стилей разница становится заметной. Также в 3.0 улучшена обработка фото и появилась возможность создавать короткие видео и анимации.

Бесплатно ли это: тарифы, лимиты и способы доступа

Кандинский 3.0 — одна из немногих российских нейросетей, которая предоставляет бесплатный доступ к базовой генерации. Бесплатный тариф позволяет создавать до 100 изображений в сутки на одного пользователя. Этого объёма достаточно для большинства личных задач: иллюстрации к постам, аватарки, открытки, визуализация идей.

Для работы не требуется привязка банковской карты — достаточно регистрации через Сбер ID или номер телефона. Платные тарифы существуют, но они нужны в основном для коммерческого использования или при необходимости снять ограничения по количеству генераций.

Существует несколько способов доступа к нейросети:

  • Веб-интерфейс Fusion Brain (fusionbrain.ai) — основной канал с полным функционалом, включая редактор, стили, анимацию и видео.
  • Чат-бот в Telegram (@kandinsky_bot) — удобен для мобильных устройств, поддерживает генерацию по тексту и смешивание изображений.
  • Чат-бот ВКонтакте — позволяет быстро создавать картинки в трёх ориентациях (1:1, 3:2, 2:3), но без расширенных настроек.
  • Мобильное приложение «Салют» — раздел AI-рисования, доступен на смартфонах и умных устройствах Сбера.
  • API для разработчиков — интеграция в собственные проекты через Fusion Brain API.

Все способы работают из России без VPN и не требуют зарубежной платёжной системы. Оплата платных тарифов, если она понадобится, проходит через российские платёжные инструменты, включая карты МИР и СБП.

Регистрация и первый запуск: пошаговая инструкция

Начать работу с Кандинским 3.0 можно за несколько минут. Рассмотрим основной путь через сайт Fusion Brain, так как он предоставляет максимальные возможности.

Шаг 1. Откройте сайт. Перейдите на fusionbrain.ai в любом браузере. Вы увидите поле для ввода текста и область предпросмотра.

Шаг 2. Авторизуйтесь. Нажмите кнопку «Войти» в правом верхнем углу. Система предложит авторизацию через Сбер ID. Если у вас его нет, нажмите «Зарегистрироваться» и укажите номер телефона — придёт СМС с кодом подтверждения. Регистрация занимает меньше двух минут.

Шаг 3. Введите запрос. В поле в центре экрана напишите текстовое описание того, что хотите получить. Можно писать на русском языке, например: «кот в скафандре на фоне луны, цифровая иллюстрация».

Шаг 4. Создайте изображение. Нажмите кнопку «Создать». Через несколько секунд появится результат. Если он не понравился, нажмите «Сгенерировать ещё» — счётчик бесплатного лимита уменьшится на одну картинку.

Шаг 5. Сохраните результат. Понравившееся изображение можно скачать кнопкой «Скачать», поделиться ссылкой или продолжить работу над вариантами.

Альтернативный путь — Telegram-бот @kandinsky_bot. Зайдите в бота, нажмите /start, авторизуйтесь через тот же Сбер ID и отправляйте текстовые запросы. Этот способ особенно удобен на мобильных устройствах и работает практически без задержек даже при нестабильном интернет-соединении.

Как составлять эффективные промпты: базовые принципы

Качество результата напрямую зависит от того, как сформулирован запрос (промпт). Кандинский 3.0 понимает естественный русский язык, но для получения предсказуемых результатов стоит придерживаться нескольких правил.

Описывайте конкретику. Вместо «красивый пейзаж» напишите «горное озеро на закате, отражение вершин в воде, сосны на переднем плане». Чем больше деталей — тем точнее результат. Однако избегайте перегруженности: слишком длинные запросы могут запутать модель.

Указывайте стиль. Если вы хотите определённую художественную манеру, добавьте её в запрос: «масляная живопись», «акварель», «киберпанк», «фотореализм», «мультипликация», «скетч карандашом». Без указания стиля нейросеть выберет наиболее подходящий на основе содержания.

Используйте негативные промпты. В Fusion Brain есть специальное поле для указания того, чего на изображении быть НЕ должно. Например, если при генерации портрета появляются лишние пальцы или искажения, добавьте «без искажений, без лишних пальцев» в негативный промпт. Это значительно улучшает результат на сложных сценах.

Экспериментируйте с формулировками. Одно и то же описание, перефразированное разными словами, может дать разные результаты. Не бойтесь пробовать синонимы и менять порядок описания.

Пример хорошего промпта: «девушка в платье викторианской эпохи читает книгу в парке, масляная живопись, тёплый свет, размытый фон». Такой запрос даёт модели достаточно контекста для создания целостной композиции.

Генерация изображений: стили, размеры и ориентация

Кандинский 3.0 поддерживает несколько художественных стилей и форматов. Выбор стиля доступен прямо в интерфейсе Fusion Brain — нажмите на иконку палитры до генерации.

Основные стили:

  • Реализм — для фотореалистичных изображений, имитация фотографии.
  • Цифровая живопись — имитация масляных красок и кистей.
  • Киберпанк — футуристические, неоновые мотивы.
  • Мультипликация — в духе современных 3D-анимаций.
  • Скетч — наброски карандашом или тушью.

Максимальное разрешение изображения составляет 1024×1024 пикселя для квадратного формата. Доступны также ориентации 3:2 (горизонтальная) и 2:3 (вертикальная). Для обложек соцсетей, иллюстраций к статьям и личного использования этого достаточно. Если нужно большее разрешение, можно использовать платный апскейлинг в некоторых тарифах либо увеличить картинку в графическом редакторе — но качество при этом может пострадать.

При выборе ориентации учитывайте, где будет использоваться изображение: для поста в Instagram или VK лучше вертикальный формат, для обложки YouTube — горизонтальный, для аватарок — квадратный.

Обработка и редактирование фото: дорисовка, ластик, смешивание

Кандинский 3.0 — это не только генератор с нуля, но и мощный инструмент для редактирования изображений. В Fusion Brain доступны несколько режимов работы с уже существующими картинками.

Генерация на основе изображения. Вы можете загрузить фото и попросить нейросеть изменить его: заменить лицо на портрете, изменить внешний облик объекта, сохранив при этом основные детали и стиль исходной картинки. Это удобно для создания аватарок или примерки разных образов.

Дорисовка деталей. Если изображение сгенерировано хорошо, но основной объект обрезан или не дорисован, можно использовать инструмент «ластик» и область генерации. Передвиньте область в то место, где требуется дорисовка, и опишите запросом, что там должно быть. Важный момент: для качественной дорисовки новая область должна захватывать часть первого рисунка. Чем больше пересечение, тем выше шанс, что вторая картинка станет продолжением первой.

Смешивание изображений. В чат-ботах Telegram и ВКонтакте доступна функция смешивания двух изображений в одно. Это позволяет создавать гибридные образы или переносить стиль одного изображения на другое.

Стирание лишних деталей. Инструмент «ластик» в Fusion Brain позволяет удалять ненужные элементы с изображения. После стирания можно сгенерировать новое содержимое на освободившемся месте.

Все эти функции работают бесплатно и не требуют специальных навыков — интерфейс интуитивно понятен и снабжён подсказками.

Создание анимации и коротких видео

Начиная с версии 3.0, Кандинский умеет создавать не только статичные изображения, но и анимацию, и короткие видеоролики. Эта возможность доступна на вкладке «Видео» в Fusion Brain.

Анимация. В поле «Модель» выберите пункт «Анимация». Определите количество сцен, которые нужно сгенерировать, и напишите текстовый запрос для каждой из них. Дополнительной настройкой является указание направления камеры для каждой сцены. Каждая сцена длится около 4 секунд. Чем больше сцен описано, тем дольше будет идти генерация.

Видео. Генерация видео происходит сложнее, чем анимация. У неё пока нет расширенных настроек — для всего ролика имеется только одно окно для ввода текстового запроса. Время генерации видео в среднем составляет около 4 минут. Качество видео и соответствие результата запросу пока оставляют желать лучшего, но технология быстро развивается.

Чат-бот для видео. В Telegram существует отдельный бот Kandinsky Video by Sber AI. Для его использования необходимо оставить заявку — функция доступна не всем пользователям сразу. После одобрения заявки можно тестировать генерацию видео.

Стоит учитывать, что генерация видео — самая ресурсоёмкая операция, поэтому бесплатный лимит на неё может отличаться от лимита на изображения.

Сравнение с зарубежными сервисами: Midjourney, DALL-E, Stable Diffusion

Чтобы понять место Кандинского среди конкурентов, полезно сравнить его с популярными зарубежными генераторами.

Midjourney — признанный лидер по качеству изображений, особенно в фотореализме и художественных стилях. Однако сервис требует зарубежную карту для оплаты, не имеет официального веб-интерфейса (работает через Discord) и блокирует российские IP-адреса. Кандинский проигрывает Midjourney на сложных сценах, но выигрывает в доступности.

DALL-E (OpenAI) — мощный генератор, но также недоступен из России без VPN и не принимает российские карты. Кроме того, у DALL-E есть ограничения на контент, которые могут показаться излишне строгими.

Stable Diffusion — открытая модель, которую можно запустить локально на своём компьютере. Это даёт полный контроль и отсутствие лимитов, но требует мощного GPU и технических навыков. Для обычного пользователя это слишком сложно.

Кандинский 3.0 — единственный из перечисленных, кто работает из России без VPN, принимает оплату российскими картами и полностью понимает русский язык. Он уступает Midjourney в качестве на сложных сценах, но для большинства повседневных задач его возможностей достаточно.

Если вам нужно быстро создать иллюстрацию для поста, аватарку или визуализировать идею — Кандинский станет оптимальным выбором. Если же вы профессиональный дизайнер и вам нужно максимальное качество — возможно, стоит рассмотреть комбинацию инструментов.

Типичные ошибки и полезные советы при работе с Кандинским

Даже опытные пользователи иногда сталкиваются с проблемами при работе с нейросетью. Вот наиболее частые ошибки и способы их избежать.

Искажения и странные детали. Если на изображении появляются лишние пальцы, искажённые лица или другие артефакты, используйте негативный промпт. Добавьте «без искажений, без лишних пальцев, анатомически правильные руки» в соответствующее поле. Это значительно улучшит результат.

Слишком общий запрос. «Красивый пейзаж» даст непредсказуемый результат. Чем конкретнее описание, тем точнее картинка. Указывайте время суток, погоду, объекты, стиль.

Перегруженный промпт. Слишком длинные запросы могут запутать модель. Разбивайте сложные сцены на ключевые элементы и описывайте их по порядку.

Игнорирование стиля. Если вы не указали стиль, нейросеть выберет его сама — и результат может вас удивить. Всегда добавляйте желаемый стиль, если он важен.

Медленная загрузка сайта. Fusion Brain может медленнее загружаться через некоторых мобильных операторов. Решение — перейти на Wi-Fi или использовать Telegram-бота, который работает быстрее.

Сайт не отправляет форму. Иногда сайт ruDALL-E работает некорректно. В этом случае используйте Fusion Brain или чат-ботов — они более стабильны.

Полезный совет: сохраняйте удачные промпты в отдельный файл. Со временем у вас соберётся коллекция проверенных запросов, которые можно адаптировать под новые задачи.

Коммерческое использование и лицензионные ограничения

Важный вопрос для тех, кто планирует использовать сгенерированные изображения в бизнесе — лицензионные условия. Согласно пользовательскому соглашению Кандинского, изображения, созданные нейросетью, предназначены только для некоммерческого использования.

Это означает, что вы можете свободно использовать картинки для личных целей: аватарки, открытки, иллюстрации к личным постам в соцсетях, учебные материалы. Однако использовать их в коммерческих проектах — на сайте компании, в рекламе, в продаваемых товарах — без дополнительного разрешения нельзя.

Если вам нужно коммерческое использование, рассмотрите платные тарифы или обратитесь к правообладателю за разъяснениями. Также стоит учитывать, что нейросеть может генерировать изображения, похожие на существующие работы, поэтому для серьёзных коммерческих проектов рекомендуется проверять уникальность.

Для большинства пользователей — блогеров, студентов, дизайнеров-любителей — бесплатного тарифа с некоммерческой лицензией вполне достаточно. Если же вы планируете продавать созданные изображения или использовать их в рекламных кампаниях, обязательно изучите условия платных тарифов.

Вопросы и ответы

Можно ли использовать Кандинский 3.0 на телефоне?

Да, можно. Есть несколько способов: Telegram-бот @kandinsky_bot, чат-бот ВКонтакте и мобильное приложение «Салют» от Сбера. Telegram-бот наиболее удобен — он работает практически без задержек и не требует открытия браузера. Функционал в мобильных версиях несколько урезан по сравнению с веб-интерфейсом Fusion Brain, но базовые возможности — генерация по тексту, смешивание изображений — доступны.

Поддерживает ли Кандинский русский язык в промптах?

Да, это одно из главных преимуществ нейросети. Кандинский 3.0 полностью русифицирован: интерфейс на русском, и запросы можно писать на русском языке без перевода. Нейросеть специально обучалась на русскоязычных данных и знакома с русской культурой, фольклором и архитектурой. Вы можете написать «Баба Яга в ступе» — и получить соответствующий результат без дополнительных уточнений.

Можно ли использовать сгенерированные картинки в коммерческих целях?

Согласно пользовательскому соглашению, изображения, созданные Кандинским, предназначены только для некоммерческого использования. Для личных целей — аватарки, открытки, иллюстрации к личным постам — ограничений нет. Для коммерческого использования (на сайте компании, в рекламе, в продаваемых товарах) необходимо либо оформить платный тариф, либо обратиться к правообладателю за разъяснениями.

Чем Kandinsky 3.0 отличается от версии 2.1?

Основные отличия: 3.0 лучше понимает сложные описания и точнее передаёт детали, особенно на многофигурных композициях. Также в 3.0 появилась возможность создавать анимацию и короткие видео, улучшена обработка фото. Нейросеть 3.0 знакома с русской культурой — фольклором, персонажами сказок, народными промыслами. Для простых запросов разница может быть незаметна, но на сложных сценах 3.0 заметно выигрывает в качестве.

Как увеличить разрешение картинки, если 1024 пикселей мало?

Максимальное разрешение при бесплатной генерации — 1024×1024 пикселя для квадратного формата. Если нужно больше, есть два пути: использовать платный апскейлинг в некоторых тарифах Кандинского, либо увеличить картинку в графическом редакторе (Photoshop, GIMP или онлайн-сервисы). При увеличении в редакторе качество может пострадать — изображение станет менее чётким. Для большинства задач — соцсети, блоги, презентации — 1024 пикселей достаточно.

Почему при генерации иногда появляются искажения или странные детали?

Это распространённая проблема всех нейросетей, связанная с ограничениями модели. Чаще всего искажения появляются при генерации рук, пальцев, лиц и сложных анатомических деталей. Решение — использовать негативный промпт: добавьте в соответствующее поле «без искажений, без лишних пальцев, анатомически правильные руки». Также помогает уточнение запроса и генерация нескольких вариантов — среди них обычно находится удачный.