Нейросеть Кандинский от Сбера: версии, лимиты и чем её дополнить

Промпт
Wide editorial hero image, 16:9. Scene: deep near-black studio space with a soft violet gradient glow low at the horizon and gentle volumetric haze. Subject: a large abstract composition of bold geometric shapes — a circle, a triangle and crossing straight lines in the spirit of early-20th-century abstract painting — that on the right side dissolves into a fine grid of glowing violet pixels and thin data lines. Details: photoreal 3D render, matte black surfaces with subtle micro-texture, thin luminous violet strokes, muted steel-grey accents, soft rim light, shallow depth of field. Composition: left-to-right transformation from painted shapes to digital grid, eye-level, wide framing, generous negative space at the top, high contrast, quiet technical mood. Constraints: absolutely NO text, NO letters, NO logos, NO numbers, NO watermark, no brand marks, no people, no human figures, no faces. Palette: deep near-black background #0A0A0F with violet #7C3AFF accents, no other brand colors. Use: blog article cover about a Russian AI image and video generation model.
Главное:
- Кандинский — семейство моделей Сбера для картинок и видео, первая версия вышла в июне 2022 года.
- Актуальная линейка 5.0: Image Lite на 6 млрд параметров, Video Lite на 2 млрд и Video Pro на 19 млрд.
- Сильные места — русские промпты, кириллица в кадре и доступ через GigaChat без зарубежной карты.
- Потолок — разрешение 1K у картинок, 10 роликов в день в боте и тяжёлое железо при локальном запуске.
- Там, где Кандинский упирается, выручают модели каталога IskraGen с оплатой за генерацию в рублях.
Запрос «нейросеть Кандинский» приводит людей к одной из самых заметных российских разработок в генерации изображений — и почти всегда к путанице в версиях. В обзорах вперемешку упоминают 3.1, 5.0 и 6.0, смешивают саму модель, сайт и телеграм-бота, а про лимиты и потолок качества молчат. Ниже — карта версий по официальным публикациям Сбера, честный список мест, где модель проседает, и то, чем её достраивают, когда картинка нужна в работу, а не для пробы.
Что такое нейросеть Кандинский и кто за ней стоит
Кандинский — это линейка генеративных моделей Сбера для изображений и видео, названная в честь художника Василия Кандинского. Первая версия появилась в июне 2022 года, и с тех пор семейство сменило несколько поколений архитектуры.
Омоним тут мешает больше, чем кажется. Половина поисковой выдачи по фамилии — про живопись начала XX века, и это стоит держать в голове, когда ищете инструкции: нейросеть Кандинский и абстракционист Кандинский делят имя, но ничего больше.
Разработку ведёт команда Sber AI при участии института AIRI и SberDevices. Нейросеть Кандинский с самого начала строилась вокруг русского языка — это её главное отличие от западных генераторов, где русский промпт сначала переводится, а уже потом попадает в картинку.
Второе поколение, Kandinsky 2.0, вышло в ноябре 2022 года и перешло на латентную диффузию с поддержкой 101 языка. Третье, Kandinsky 3.0, появилось в ноябре 2023 года и собрано из трёх частей: текстового энкодера Flan-UL2 на 8,6 млрд параметров, диффузионной U-Net на 3 млрд и MoVQ-кодировщика на 267 млн. Лицензия у третьего поколения — Apache-2.0, то есть код и веса открыты.
Открытость здесь принципиальна. Нейросеть Кандинский не спрятана за проприетарным API: веса лежат на GitHub и HuggingFace, их можно скачать и запустить у себя. Именно поэтому модель регулярно всплывает в сравнениях с открытыми зарубежными генераторами, а не только с коммерческими сервисами.
Если вы только начинаете и хотите общую картину по рынку, рядом полезно прочитать разбор того, как устроена генерация изображений вообще: там про промпты, форматы и типичные ошибки без привязки к конкретной модели.
Версии Кандинского: от 3.1 до 5.0 и Image 6 Pro
Версий у нейросети много, и путаница в обзорах возникает потому, что номер модели и номер сервиса — разные вещи. Ниже — только то, что подтверждено публикациями самой команды.
Kandinsky 3.1 — доработка третьего поколения. В неё добавили улучшение промпта языковой моделью: короткий запрос пользователя автоматически расширяется до подробного описания. Обновили модель inpainting, то есть дорисовки выделенной области, и добавили поддержку IP-Adapter и ControlNet — механизмов, которые задают композицию по референсной картинке.
Вместе с 3.1 вышли два спутника. Kandinsky Flash — дистиллированная версия, которая генерирует за 4 шага обратного процесса и работает втрое быстрее базовой модели. KandiSuperRes — отдельная модель апскейла, поднимающая результат до 4K. Важная деталь: 4K здесь получается вторым проходом, а не сразу в генерации. Веб-демо этого поколения работало на fusionbrain.ai — отсюда и запросы про «кандинский нейросеть fusion brain».
Kandinsky 5.0 Сбер представил 28 ноября 2025 года на конференции AI Journey. Это уже не одна модель, а три линейки:
- Image Lite — 6 млрд параметров, генерация и редактирование изображений.
- Video Lite — 2 млрд параметров, текст в видео и оживление картинки.
- Video Pro — 19 млрд параметров, флагманская видеомодель.
Video Pro выдаёт ролики длительностью до 10 секунд в HD, разрешения — 1024×1024, 1408×640 и 1280×768. Внутри 60 блоков архитектуры CrossDiT с эмбеддингами размерности 4096. Image Lite работает в разрешении до 1K: 1280×768, 1024×1024 и близкие форматы.
Веса Kandinsky 5.0 опубликованы под лицензией MIT — она допускает коммерческое использование, что для открытых моделей встречается не всегда.
Kandinsky Image 6 Pro — то, что показывает сайт лаборатории Kandinsky Lab. Заявлено 6 млрд параметров с архитектурой Mixture-of-Experts, HD-картинки по русским и английским запросам и аккуратная отрисовка текста. Там же перечислены Kandinsky Video 5.0 Lite и Pro, автокодировщики K-VAE и модели Kandinsky WM 1.0 для робототехники и автономного вождения.

Карта версий Кандинского: что за чем вышло и чем отличается
Где работает нейросеть Кандинский и какие там лимиты
Нейросеть Кандинский открывается обычному пользователю через GigaChat: Telegram, мессенджер MAX, сайт и Android-приложение. Именно там линейка 5.0 доступна без установки чего-либо на свой компьютер.
Видео открыли раньше остального. Публичный доступ к Kandinsky Video дали 20 октября 2025 года в телеграм-ботах GigaChat и Kandinsky — пункт меню «Создать видео». Модель делает ролик по текстовому описанию или оживляет загруженную картинку.
Лимиты там названы прямо. Без авторизации бот даёт 10 пробных генераций видео. После входа в аккаунт — 10 роликов в день. За каждого приглашённого друга добавляют ещё 10 в сутки: два приглашения превращаются в 30 генераций.
Для пробы этого достаточно, для работы — нет. Суточный лимит устроен так, что упереться в него легко: половина попыток уходит на подбор промпта, и к моменту, когда описание наконец даёт нужный кадр, счётчик обнулился до завтра. Схема «сколько угодно, но по расписанию» плохо ложится на дедлайн.
Второй путь — запустить модель у себя. Веса открыты, но железо нужно серьёзное. Потребление видеопамяти Video Lite разработчики снизили с 65 ГБ до 42 ГБ за счёт выгрузки части данных в оперативную память ценой примерно 10 % скорости. В документации указано, что при включённом оффлоадинге генерация запускается на видеокартах от 12 ГБ, но это компромисс по времени и качеству, а не штатный режим.
Третий вариант — не выбирать между лимитом и своей видеокартой, а платить за факт генерации. В каталоге IskraGen модели работают именно так: кадр стоит фиксированную сумму в рублях, счётчика «на сегодня хватит» нет, оплата проходит российской картой. Нейросеть Кандинский в каталог не входит — это разработка Сбера со своей точкой входа, — но задачи, ради которых её открывают, в каталоге закрываются другими моделями.
Сильные стороны и потолок: где нейросеть Кандинский спотыкается
Главный козырь у модели ровно один, зато крупный: нейросеть Кандинский принимает русский язык на входе и отдаёт кириллицу на выходе. Все модели линейки 5.0 нативно принимают промпты на русском и английском и рисуют надписи кириллицей и латиницей.
Это не маркетинг, а следствие обучения. Kandinsky 5.0 учили в том числе на наборе «Русский культурный код» — 768 555 изображений и 229 504 видеосцены с написанными вручную русскими описаниями. Поэтому запрос про хрущёвку, коммунальную кухню или школьную линейку модель понимает буквально, а не через приблизительный перевод.
Вторая сильная сторона — доступ. Сервис российский, зарубежная карта и обход блокировок не нужны; подробнее о том, какие модели ещё работают напрямую, мы писали в обзоре нейросетей без VPN.
Теперь про потолок, о котором обзоры обычно молчат.
Разрешение. Как генератор картинок нейросеть Кандинский упирается в 1K — 1280×768 или 1024×1024. Для поста в соцсети хватает, для печати, крупного баннера или карточки товара с мелкими деталями — нет. Апскейл отдельной моделью частично спасает, но дорисовывает детали, которых в исходной генерации не было.
Соответствие промпту. По собственным замерам команды Video Lite обходит более крупные модели Wan 2.1 14B и Wan 2.2 14B по визуальному качеству, но по соответствию текстовому описанию идёт наравне, а не впереди. То есть картинка красивая, а вот выполнено ли ровно то, что вы просили, — вопрос отдельный.
Проверяемость. Независимого русскоязычного бенчмарка для генераторов картинок попросту нет: Artificial Analysis Image Arena ранжирует модели по слепым голосам людей и преимущественно на англоязычных промптах, без разбивки по языкам. Заявления о превосходстве на русском идут из анонсов самой команды и стороннего подтверждения пока не получили.
Контроль параметров. Тонкой настройки, к которой привыкли в коммерческих генераторах, нейросеть Кандинский через потребительский интерфейс почти не даёт: доступ к шагам семплирования, весам ControlNet и прочим рычагам открывается только при локальном запуске — с теми самыми требованиями к видеопамяти.

Шесть мест, где нейросеть Кандинский упирается в потолок
Чем дополнить нейросеть Кандинский: модели каталога IskraGen
Дополнять имеет смысл там, где упирается именно нейросеть Кандинский: разрешение, точный текст в кадре, предсказуемое следование промпту и работа без суточного счётчика. Ниже — модели каталога под каждую из этих задач, цены за генерацию в рублях.
Текст в кадре. Qwen Image 3.0 — Текст в картинку стоит от 5 ₽ и сделана вокруг аккуратной типографики: надписи на упаковке, вывеске, обложке. Когда в макете есть слова, которые обязаны читаться буква в букву, это первый кандидат.
Фотореализм и детализация. Seedream 5.0 Pro — Текст в картинку обойдётся от 7 ₽; это флагман ByteDance с упором на фотореализм и аккуратную типографику. Там, где генерация 1K рассыпается на мелочах, модель держит детали.
Точное следование промпту. GPT Image 2 — Text to Image стоит от 5 ₽ и отрабатывает длинные развёрнутые описания со множеством условий. Если промпт похож на техзадание, а не на пожелание, эта модель ближе к нужному результату.
Правки по референсу. GPT Image 2 — Image to Image идёт от 5 ₽ и меняет готовый кадр по словесной инструкции. Удобно, когда база уже сгенерирована в Кандинском, а поправить нужно фон, свет или одну деталь.
Художественный стиль. Midjourney стоит от 14 ₽ и отдаёт 4 варианта картинки за одну генерацию. Если задача — не документальная точность, а картинка с характером, перебор вариантов экономит время; чем ещё закрывают эту нишу, разобрано в материале про аналог Midjourney.
Видео. Kling 2.6 Text to Video стоит от 100 ₽ и снимает ролики с управляемой камерой и заметно большей длительностью, чем даёт суточный лимит бота. Это другой класс задач: не «оживить картинку на пять секунд», а собрать сцену.
Практичная связка выглядит так: черновую композицию и русскоязычные сюжеты быстро набрасывает нейросеть Кандинский, а финальный кадр — тот, что пойдёт в макет, карточку или ролик, — вы пересобираете моделью каталога под конкретное требование. Нейросеть Кандинский остаётся удобной точкой старта, а каталог снимает её потолок по разрешению, тексту и объёму работы.
Частые вопросы
Попробовать Qwen Image 3.0 — Текст в картинку в IskraGen
Генерация без VPN, оплата в рублях через СБП. Первые генерации — за минуту.
Похожие статьи

Аналог Nano Banana: какие модели редактируют фото словами
20 сентября 2026 · 9 мин чтения

Аналог Суно: чем заменить и где платить за музыку рублями
20 сентября 2026 · 9 мин чтения

Higgsfield: что за нейросеть для видео и чем её заменить
20 сентября 2026 · 10 мин чтения

Midjourney подписка: тарифы, оплата из России и цена кадра
20 сентября 2026 · 9 мин чтения

Промты для Шедеврума: как описать кадр, чтобы вышло красиво
20 сентября 2026 · 11 мин чтения