Что такое нейросеть Кандинский и как она работает
Нейросеть Kandinsky — это российская модель искусственного интеллекта для генерации изображений, анимации и видео по текстовым запросам, разработанная командой Сбера. Первая версия появилась в ноябре 2021 года под названием ruDALL-E XL. После нескольких обновлений модель получила имя Kandinsky, а в апреле 2023 года вышла версия 2.1, которая привлекла широкую аудиторию. В июле 2023 года появилась версия 2.2 с улучшенным фотореализмом, а в ноябре 2023 года на конференции AI Journey представили Kandinsky 3.0 и Kandinsky Video. По состоянию на 2026 год актуальной является версия 3.1, которая поддерживает генерацию изображений, анимации и коротких видео.
Kandinsky понимает запросы более чем на 100 языках, включая русский, и не имеет платных тарифов — все функции доступны бесплатно. Нейросеть способна создавать изображения с нуля, редактировать загруженные фото, дорисовывать детали, смешивать несколько картинок в одну и генерировать анимацию длительностью до 4 секунд на сцену. Качество результатов сопоставимо с зарубежными аналогами Midjourney и Stable Diffusion, при этом Kandinsky особенно силён в понимании русскоязычных запросов и культурных контекстов.
Как пользоваться нейросетью Кандинский через ВКонтакте
Один из самых удобных способов доступа к Kandinsky — через чат-бота ВКонтакте. Для начала работы найдите официального бота Kandinsky в поиске VK или перейдите по ссылке с сайта Сбера. Бот работает в режиме диалога: вы отправляете текстовый запрос, а нейросеть возвращает сгенерированное изображение. Доступны три соотношения сторон: 1:1 (квадрат), 16:9 (горизонталь) и 9:16 (вертикаль). Выбор ориентации влияет на разрешение: при 1:1 получается 1024×1024 пикселя, при 16:9 — 1024×576, при 9:16 — 576×1024.
Чат-бот ВКонтакте не поддерживает расширенные настройки, такие как выбор стиля, негативные промпты или загрузка собственных изображений. Однако он идеально подходит для быстрой визуализации идей, создания анонсов для постов или подбора иллюстраций. Версия Kandinsky в чат-ботах может быть не самой последней, поэтому качество иногда уступает генерациям на сайте Fusion Brain. Тем не менее, для оперативных задач это отличный инструмент, доступный прямо в социальной сети.
Другие способы доступа к нейросети Кандинский
Помимо ВКонтакте, Kandinsky доступен на нескольких платформах. Основной официальный портал — Fusion Brain, где можно использовать все функции: генерацию изображений, анимацию, видео, дорисовку, ластик и негативные промпты. Интерфейс полностью русскоязычный, с подсказками и горячими клавишами. Также существует сайт ruDALL-E, но его функционал урезан, и он иногда работает нестабильно.
Для пользователей Telegram доступны два бота: Kandinsky by Sber AI (для изображений и анимации) и Kandinsky Video by Sber AI (для видео). Бот в Telegram поддерживает несколько версий нейросети, включая 3.1, 2.2 и 2.1, а также дополнительные функции, такие как смешивание изображений, перенос стиля и создание стикеров. Для генерации видео через Telegram требуется предварительная заявка. Кроме того, Kandinsky интегрирован в виртуального ассистента «Салют» (команда «Включи художника») и приложение «СберБанк Онлайн». Разработчики могут подключить нейросеть через API к своим проектам.
Пошаговая инструкция по генерации изображений на Fusion Brain
Для создания качественной картинки на Fusion Brain выполните следующие шаги:
- Выберите соотношение сторон и качество. На сайте доступны форматы 1:1, 16:9, 9:16, 3:2 и 2:3. Разрешение автоматически подстраивается: для квадрата — 1024×1024 px, для 16:9 — 1024×576 px.
- Составьте промпт. Опишите, что должно быть на изображении. Начните с главного объекта, затем добавьте действия, фон, детали. Например: «Супермен и Бэтмен сидят на скамейке и едят пиццу, на фоне небоскрёбы, общий план, яркие цвета».
- Укажите негативный промпт (опционально). Напишите, чего быть не должно. Например, «ночь» или «размытый фон». Это помогает убрать нежелательные детали.
- Выберите стиль. Доступно 17 стилей: «Детальное фото», «Цифровая живопись», «3D рендер», «Аниме», «Киберпанк», «Пикассо» и другие. Выбор стиля повышает вероятность получения нужного результата.
- Нажмите «Создать». Генерация занимает около 2 минут. Если результат не устраивает, отредактируйте промпт или используйте ластик для удаления отдельных элементов, затем дорисуйте их с новым запросом.
Совет: при работе с двумя персонажами нейросеть может их дублировать. Уточняйте в промпте: «Один Супермен и один Бэтмен» или используйте негативный промпт, чтобы избежать лишних объектов.
Как создавать анимацию и видео в Кандинском
Kandinsky поддерживает два режима генерации движущегося контента: анимация и видео.
Анимация создаётся из нескольких сцен (до 4), каждая длительностью 4 секунды. Для каждой сцены нужно написать отдельный промпт и при желании указать направление камеры (зум, панорама, отдаление). Соотношение сторон: 1:1, 16:9, 9:16. Разрешение при 1:1 — 640×640 px. Время генерации анимации из 4 сцен — около 10 минут. Негативные промпты для анимации не работают. Сцены можно менять местами, а готовый файл скачивается в формате MP4.
Видео генерируется по одному текстовому запросу длительностью до 5 секунд. Качество видео пока уступает изображениям и анимации, а время генерации — около 4 минут. Доступны те же соотношения сторон. Негативные промпты не поддерживаются. Для использования видео-функции через Telegram необходимо оставить заявку и дождаться одобрения. На Fusion Brain видео доступно сразу после выбора модели «Видео».
Советы по составлению эффективных промптов
Качество результата напрямую зависит от того, как вы сформулируете запрос. Вот несколько практических рекомендаций:
- Начинайте с главного. Первым словом укажите основной объект: «Кот», «Девушка», «Пейзаж». Затем добавьте действия, окружение и детали.
- Будьте конкретны. Вместо «красивый закат» напишите «Закат в пустыне, оранжевое небо, силуэт кактуса на переднем плане, максимальный реализм».
- Используйте прямые отсылки. Упоминание художника, стиля или фильма помогает задать направление: «в стиле Ван Гога», «как в фильме „Бегущий по лезвию“».
- Избегайте метафор и сложных конструкций. Нейросеть лучше понимает простые предложения без деепричастных оборотов.
- Применяйте негативные промпты. Если на картинке появились лишние детали, пропишите их в негативном запросе. Например, «без деревьев» или «без текста».
- Экспериментируйте с длиной. Короткие промпты (одно слово) дают случайный, но часто красивый результат. Длинные промпты повышают точность.
Пример хорошего промпта: «Реалистичное фото, плёнка 35 мм, милая молодая девушка блондинка с длинными волосами ночью, большие глаза, пухлые губы, естественный макияж, белая майка, крупные серьги, ночные огни, портрет, максимум деталей».
Возможности редактирования: дорисовка, ластик и смешивание
Kandinsky предлагает несколько инструментов для работы с уже созданными или загруженными изображениями.
Дорисовка. Вы можете расширить картинку за её пределы. Для этого переместите область генерации на пустое место рядом с изображением и напишите, что должно быть дорисовано. Важно, чтобы новая область захватывала часть исходного рисунка — чем больше пересечение, тем лучше нейросеть продолжит стиль и детали.
Ластик. Инструмент позволяет удалить ненужные объекты с картинки. После стирания на пустом месте можно сгенерировать новый элемент с помощью промпта. Например, если на фото появился лишний персонаж, сотрите его и напишите «пустой фон» или «трава».
Смешивание изображений. Вы можете загрузить два фото и попросить нейросеть объединить их в одно. Результат может быть как очень похожим на исходники, так и отдалённо напоминающим их — это зависит от сложности запроса.
Генерация на основе изображения. Загрузите фото и получите его стилизованную версию. Например, превратите обычный портрет в рисунок акварелью или в 3D-рендер.
Ограничения и частые ошибки при работе с Кандинским
Несмотря на мощный функционал, у нейросети есть ряд ограничений, которые стоит учитывать.
- Дублирование генераций. На сайте Fusion Brain иногда возникает ошибка, когда нейросеть повторяет предыдущий результат вместо создания нового. В этом случае помогает перезагрузка страницы или повторный вход в аккаунт.
- Проблемы с несколькими персонажами. При генерации двух и более героев Kandinsky может их дублировать или смешивать черты. Решение — максимально детализировать промпт и использовать негативные запросы.
- Качество видео. Генерация видео пока уступает по реалистичности изображениям. Длительность ограничена 5 секундами, а соответствие запросу не всегда точное.
- Отсутствие истории генераций. Нейросеть не сохраняет историю ваших запросов, поэтому результаты нужно скачивать сразу.
- Лицензионные ограничения. Изображения, созданные в Kandinsky, можно использовать только для некоммерческих целей в соответствии с пользовательским соглашением.
- Негативные промпты для анимации и видео. В этих режимах негативные запросы не поддерживаются, поэтому убрать нежелательные детали не получится.
Зная эти особенности, вы сможете быстрее добиваться нужного результата и избегать типичных ошибок.
Примеры промптов и результатов для вдохновения
Чтобы лучше понять возможности нейросети, полезно изучить примеры удачных запросов.
- Портрет: «Реалистичное фото, молодая девушка с длинными розовыми волосами улыбается, пирсинг в носу, белая футболка, крупные серьги, фон размыт, портрет». Стиль: «Детальное фото».
- Животное: «Мопс в короне сидит на троне, картина в стиле Веласкеса, максимум деталей». Без стиля.
- Пейзаж: «Закат в пустыне, максимальный реализм». Стиль: «Детальное фото».
- Еда: «Сочный бургер, картошка фри и бутылка колы на столе, яркие цвета, максимум деталей». Стиль: «Детальное фото».
- Фэнтези: «Бульдог идёт по ночному городу». Стиль: «Киберпанк».
- Абстракция: «Натюрморт: банан, груша, яблоко. Яркий красный и жёлтый цвет». Стиль: «Пикассо».
- Простой запрос: «Лошадь». Без стиля — нейросеть сама выбирает композицию.
Эти примеры показывают, что Kandinsky одинаково хорошо справляется как с детализированными промптами, так и с краткими описаниями, если вам нужна случайная, но эстетичная картинка.
Часто задаваемые вопросы о нейросети Кандинский
Вопрос 1: Бесплатно ли пользоваться Kandinsky? Да, нейросеть полностью бесплатна. Нет платных тарифов или ограничений на количество генераций.
Вопрос 2: В чём разница между версиями 2.2 и 3.1? Версия 2.2 ориентирована на фотореализм и базовые функции. Версия 3.1 добавляет поддержку русской культуры, улучшенную детализацию, больше стилей и возможность генерации видео.
Вопрос 3: Можно ли использовать сгенерированные изображения в коммерческих проектах? Нет, согласно пользовательскому соглашению, изображения разрешены только для некоммерческого использования.
Вопрос 4: Как улучшить качество картинки? Выбирайте соотношение сторон 1:1 для максимального разрешения 1024×1024 px. Используйте стиль «Детальное фото» и добавляйте в промпт слова «максимум деталей», «реализм».
Вопрос 5: Почему нейросеть не понимает мой запрос? Упростите формулировку, избегайте метафор и сложных предложений. Убедитесь, что запрос на русском или английском языке — Kandinsky поддерживает более 100 языков.
Вопрос 6: Как удалить лишний объект с картинки? Используйте инструмент «ластик» на Fusion Brain. Сотрите ненужный элемент, затем напишите промпт для заполнения пустого места.
Вопрос 7: Сколько времени занимает генерация? Изображение — около 2 минут, анимация из 4 сцен — до 10 минут, видео — около 4 минут.
Вопросы и ответы
Как пользоваться нейросетью Кандинский через ВКонтакте?
Найдите официального чат-бота Kandinsky в VK, отправьте текстовый запрос и выберите соотношение сторон (1:1, 16:9 или 9:16). Бот сгенерирует изображение за несколько минут. Расширенные настройки, такие как стили и негативные промпты, в чат-боте недоступны.
Какие функции есть в Kandinsky 3.1?
Версия 3.1 поддерживает генерацию изображений по тексту, создание на основе загруженных фото, дорисовку, ластик, смешивание изображений, 17 стилей, анимацию (до 4 сцен по 4 секунды) и короткие видео (до 5 секунд). Все функции бесплатны.
Можно ли генерировать видео в Кандинском?
Да, через Fusion Brain или чат-бота Kandinsky Video в Telegram (требуется заявка). Видео длится до 5 секунд, качество пока уступает изображениям. Негативные промпты не поддерживаются.
Почему нейросеть дублирует персонажей?
При генерации нескольких героев Kandinsky может их смешивать или дублировать. Чтобы избежать этого, уточняйте в промпте: «Один Супермен и один Бэтмен», используйте негативные промпты или дорисовывайте ластиком.
Какой формат у скачиваемых изображений?
Стандартный формат — JPEG. Исключение: изображения в стиле «3D рендер» сохраняются в PNG. Анимация и видео скачиваются в MP4.