IskraGen

Нейросеть Кандинский от Сбера: версии, лимиты и чем её дополнить

Модели и цены14 сентября 20269 мин чтения
Абстрактная композиция из круга, треугольника и линий слева переходит в светящуюся фиолетовую пиксельную сетку справа
Сгенерировано в IskraGen · gpt-image-2-text-to-image
Промпт

Wide editorial hero image, 16:9. Scene: deep near-black studio space with a soft violet gradient glow low at the horizon and gentle volumetric haze. Subject: a large abstract composition of bold geometric shapes — a circle, a triangle and crossing straight lines in the spirit of early-20th-century abstract painting — that on the right side dissolves into a fine grid of glowing violet pixels and thin data lines. Details: photoreal 3D render, matte black surfaces with subtle micro-texture, thin luminous violet strokes, muted steel-grey accents, soft rim light, shallow depth of field. Composition: left-to-right transformation from painted shapes to digital grid, eye-level, wide framing, generous negative space at the top, high contrast, quiet technical mood. Constraints: absolutely NO text, NO letters, NO logos, NO numbers, NO watermark, no brand marks, no people, no human figures, no faces. Palette: deep near-black background #0A0A0F with violet #7C3AFF accents, no other brand colors. Use: blog article cover about a Russian AI image and video generation model.

Главное:

  • Кандинский — семейство моделей Сбера для картинок и видео, первая версия вышла в июне 2022 года.
  • Актуальная линейка 5.0: Image Lite на 6 млрд параметров, Video Lite на 2 млрд и Video Pro на 19 млрд.
  • Сильные места — русские промпты, кириллица в кадре и доступ через GigaChat без зарубежной карты.
  • Потолок — разрешение 1K у картинок, 10 роликов в день в боте и тяжёлое железо при локальном запуске.
  • Там, где Кандинский упирается, выручают модели каталога IskraGen с оплатой за генерацию в рублях.

Запрос «нейросеть Кандинский» приводит людей к одной из самых заметных российских разработок в генерации изображений — и почти всегда к путанице в версиях. В обзорах вперемешку упоминают 3.1, 5.0 и 6.0, смешивают саму модель, сайт и телеграм-бота, а про лимиты и потолок качества молчат. Ниже — карта версий по официальным публикациям Сбера, честный список мест, где модель проседает, и то, чем её достраивают, когда картинка нужна в работу, а не для пробы.

Что такое нейросеть Кандинский и кто за ней стоит

Кандинский — это линейка генеративных моделей Сбера для изображений и видео, названная в честь художника Василия Кандинского. Первая версия появилась в июне 2022 года, и с тех пор семейство сменило несколько поколений архитектуры.

Омоним тут мешает больше, чем кажется. Половина поисковой выдачи по фамилии — про живопись начала XX века, и это стоит держать в голове, когда ищете инструкции: нейросеть Кандинский и абстракционист Кандинский делят имя, но ничего больше.

Разработку ведёт команда Sber AI при участии института AIRI и SberDevices. Нейросеть Кандинский с самого начала строилась вокруг русского языка — это её главное отличие от западных генераторов, где русский промпт сначала переводится, а уже потом попадает в картинку.

Второе поколение, Kandinsky 2.0, вышло в ноябре 2022 года и перешло на латентную диффузию с поддержкой 101 языка. Третье, Kandinsky 3.0, появилось в ноябре 2023 года и собрано из трёх частей: текстового энкодера Flan-UL2 на 8,6 млрд параметров, диффузионной U-Net на 3 млрд и MoVQ-кодировщика на 267 млн. Лицензия у третьего поколения — Apache-2.0, то есть код и веса открыты.

Открытость здесь принципиальна. Нейросеть Кандинский не спрятана за проприетарным API: веса лежат на GitHub и HuggingFace, их можно скачать и запустить у себя. Именно поэтому модель регулярно всплывает в сравнениях с открытыми зарубежными генераторами, а не только с коммерческими сервисами.

Если вы только начинаете и хотите общую картину по рынку, рядом полезно прочитать разбор того, как устроена генерация изображений вообще: там про промпты, форматы и типичные ошибки без привязки к конкретной модели.

Версии Кандинского: от 3.1 до 5.0 и Image 6 Pro

Версий у нейросети много, и путаница в обзорах возникает потому, что номер модели и номер сервиса — разные вещи. Ниже — только то, что подтверждено публикациями самой команды.

Kandinsky 3.1 — доработка третьего поколения. В неё добавили улучшение промпта языковой моделью: короткий запрос пользователя автоматически расширяется до подробного описания. Обновили модель inpainting, то есть дорисовки выделенной области, и добавили поддержку IP-Adapter и ControlNet — механизмов, которые задают композицию по референсной картинке.

Вместе с 3.1 вышли два спутника. Kandinsky Flash — дистиллированная версия, которая генерирует за 4 шага обратного процесса и работает втрое быстрее базовой модели. KandiSuperRes — отдельная модель апскейла, поднимающая результат до 4K. Важная деталь: 4K здесь получается вторым проходом, а не сразу в генерации. Веб-демо этого поколения работало на fusionbrain.ai — отсюда и запросы про «кандинский нейросеть fusion brain».

Kandinsky 5.0 Сбер представил 28 ноября 2025 года на конференции AI Journey. Это уже не одна модель, а три линейки:

  • Image Lite — 6 млрд параметров, генерация и редактирование изображений.
  • Video Lite — 2 млрд параметров, текст в видео и оживление картинки.
  • Video Pro — 19 млрд параметров, флагманская видеомодель.

Video Pro выдаёт ролики длительностью до 10 секунд в HD, разрешения — 1024×1024, 1408×640 и 1280×768. Внутри 60 блоков архитектуры CrossDiT с эмбеддингами размерности 4096. Image Lite работает в разрешении до 1K: 1280×768, 1024×1024 и близкие форматы.

Веса Kandinsky 5.0 опубликованы под лицензией MIT — она допускает коммерческое использование, что для открытых моделей встречается не всегда.

Kandinsky Image 6 Pro — то, что показывает сайт лаборатории Kandinsky Lab. Заявлено 6 млрд параметров с архитектурой Mixture-of-Experts, HD-картинки по русским и английским запросам и аккуратная отрисовка текста. Там же перечислены Kandinsky Video 5.0 Lite и Pro, автокодировщики K-VAE и модели Kandinsky WM 1.0 для робототехники и автономного вождения.

Инфографика с перечнем версий Кандинского от 3.0 до Image 6 Pro и их параметрами

Карта версий Кандинского: что за чем вышло и чем отличается

Где работает нейросеть Кандинский и какие там лимиты

Нейросеть Кандинский открывается обычному пользователю через GigaChat: Telegram, мессенджер MAX, сайт и Android-приложение. Именно там линейка 5.0 доступна без установки чего-либо на свой компьютер.

Видео открыли раньше остального. Публичный доступ к Kandinsky Video дали 20 октября 2025 года в телеграм-ботах GigaChat и Kandinsky — пункт меню «Создать видео». Модель делает ролик по текстовому описанию или оживляет загруженную картинку.

Лимиты там названы прямо. Без авторизации бот даёт 10 пробных генераций видео. После входа в аккаунт — 10 роликов в день. За каждого приглашённого друга добавляют ещё 10 в сутки: два приглашения превращаются в 30 генераций.

Для пробы этого достаточно, для работы — нет. Суточный лимит устроен так, что упереться в него легко: половина попыток уходит на подбор промпта, и к моменту, когда описание наконец даёт нужный кадр, счётчик обнулился до завтра. Схема «сколько угодно, но по расписанию» плохо ложится на дедлайн.

Второй путь — запустить модель у себя. Веса открыты, но железо нужно серьёзное. Потребление видеопамяти Video Lite разработчики снизили с 65 ГБ до 42 ГБ за счёт выгрузки части данных в оперативную память ценой примерно 10 % скорости. В документации указано, что при включённом оффлоадинге генерация запускается на видеокартах от 12 ГБ, но это компромисс по времени и качеству, а не штатный режим.

Третий вариант — не выбирать между лимитом и своей видеокартой, а платить за факт генерации. В каталоге IskraGen модели работают именно так: кадр стоит фиксированную сумму в рублях, счётчика «на сегодня хватит» нет, оплата проходит российской картой. Нейросеть Кандинский в каталог не входит — это разработка Сбера со своей точкой входа, — но задачи, ради которых её открывают, в каталоге закрываются другими моделями.

Сильные стороны и потолок: где нейросеть Кандинский спотыкается

Главный козырь у модели ровно один, зато крупный: нейросеть Кандинский принимает русский язык на входе и отдаёт кириллицу на выходе. Все модели линейки 5.0 нативно принимают промпты на русском и английском и рисуют надписи кириллицей и латиницей.

Это не маркетинг, а следствие обучения. Kandinsky 5.0 учили в том числе на наборе «Русский культурный код» — 768 555 изображений и 229 504 видеосцены с написанными вручную русскими описаниями. Поэтому запрос про хрущёвку, коммунальную кухню или школьную линейку модель понимает буквально, а не через приблизительный перевод.

Вторая сильная сторона — доступ. Сервис российский, зарубежная карта и обход блокировок не нужны; подробнее о том, какие модели ещё работают напрямую, мы писали в обзоре нейросетей без VPN.

Теперь про потолок, о котором обзоры обычно молчат.

Разрешение. Как генератор картинок нейросеть Кандинский упирается в 1K — 1280×768 или 1024×1024. Для поста в соцсети хватает, для печати, крупного баннера или карточки товара с мелкими деталями — нет. Апскейл отдельной моделью частично спасает, но дорисовывает детали, которых в исходной генерации не было.

Соответствие промпту. По собственным замерам команды Video Lite обходит более крупные модели Wan 2.1 14B и Wan 2.2 14B по визуальному качеству, но по соответствию текстовому описанию идёт наравне, а не впереди. То есть картинка красивая, а вот выполнено ли ровно то, что вы просили, — вопрос отдельный.

Проверяемость. Независимого русскоязычного бенчмарка для генераторов картинок попросту нет: Artificial Analysis Image Arena ранжирует модели по слепым голосам людей и преимущественно на англоязычных промптах, без разбивки по языкам. Заявления о превосходстве на русском идут из анонсов самой команды и стороннего подтверждения пока не получили.

Контроль параметров. Тонкой настройки, к которой привыкли в коммерческих генераторах, нейросеть Кандинский через потребительский интерфейс почти не даёт: доступ к шагам семплирования, весам ControlNet и прочим рычагам открывается только при локальном запуске — с теми самыми требованиями к видеопамяти.

Инфографика со списком ограничений нейросети Кандинский: разрешение, лимиты, требования к железу

Шесть мест, где нейросеть Кандинский упирается в потолок

Чем дополнить нейросеть Кандинский: модели каталога IskraGen

Дополнять имеет смысл там, где упирается именно нейросеть Кандинский: разрешение, точный текст в кадре, предсказуемое следование промпту и работа без суточного счётчика. Ниже — модели каталога под каждую из этих задач, цены за генерацию в рублях.

Текст в кадре. Qwen Image 3.0 — Текст в картинку стоит от 5 ₽ и сделана вокруг аккуратной типографики: надписи на упаковке, вывеске, обложке. Когда в макете есть слова, которые обязаны читаться буква в букву, это первый кандидат.

Фотореализм и детализация. Seedream 5.0 Pro — Текст в картинку обойдётся от 7 ₽; это флагман ByteDance с упором на фотореализм и аккуратную типографику. Там, где генерация 1K рассыпается на мелочах, модель держит детали.

Точное следование промпту. GPT Image 2 — Text to Image стоит от 5 ₽ и отрабатывает длинные развёрнутые описания со множеством условий. Если промпт похож на техзадание, а не на пожелание, эта модель ближе к нужному результату.

Правки по референсу. GPT Image 2 — Image to Image идёт от 5 ₽ и меняет готовый кадр по словесной инструкции. Удобно, когда база уже сгенерирована в Кандинском, а поправить нужно фон, свет или одну деталь.

Художественный стиль. Midjourney стоит от 14 ₽ и отдаёт 4 варианта картинки за одну генерацию. Если задача — не документальная точность, а картинка с характером, перебор вариантов экономит время; чем ещё закрывают эту нишу, разобрано в материале про аналог Midjourney.

Видео. Kling 2.6 Text to Video стоит от 100 ₽ и снимает ролики с управляемой камерой и заметно большей длительностью, чем даёт суточный лимит бота. Это другой класс задач: не «оживить картинку на пять секунд», а собрать сцену.

Практичная связка выглядит так: черновую композицию и русскоязычные сюжеты быстро набрасывает нейросеть Кандинский, а финальный кадр — тот, что пойдёт в макет, карточку или ролик, — вы пересобираете моделью каталога под конкретное требование. Нейросеть Кандинский остаётся удобной точкой старта, а каталог снимает её потолок по разрешению, тексту и объёму работы.

Частые вопросы

Попробовать Qwen Image 3.0 — Текст в картинку в IskraGen

Генерация без VPN, оплата в рублях через СБП. Первые генерации — за минуту.

Похожие статьи