Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → kandinsky

«Сбер» представил ИИ-генератор картинок Kandinsky 6 Image — он умеет восстанавливать фото и не только

«Сбер» сообщил о выходе обновлённой модели искусственного интеллекта Kandinsky 6 Image, предназначенной для генерации и редактирования изображений. Помимо создания картинок, она умеет восстанавливать и преобразовывать снимки.

 Источник изображений: sberbank.ru

Источник изображений: sberbank.ru

Предназначенная для работы с изображениями обновлённая ИИ-модель Kandinsky 6 Image работает на платформе ИИ-помощника «Сбер GigaChat» — ей можно пользоваться бесплатно без ограничений на число задач. Она стала вдвое быстрее предшественницы, повысилось качество обработки сложных запросов, картинки стали более детализированными.

Помимо создания изображений по текстовым запросам, Kandinsky 6 Image получила расширенные функции редактирования: реставрацию старых фотографий, стилизацию снимков, возможность менять одежду людей и фон картинки, проводить ретуширование и наносить макияж. Число ошибок при генерации изображений сократилось, локальные изменения стали более точными.

Важным нововведением стала встроенная функция поиска по изображениям: если модель не знает, как выглядит запрошенный пользователем персонаж, она может самостоятельно найти образец. Для оптимизации работы модели использована архитектура Mixture of Experts (MoE): при запросе используется не весь объём нейросети, а только необходимый фрагмент. Созданные Kandinsky 6 Image изображения можно сразу анимировать — для этого в ИИ-помощнике GigaChat есть дополнительная ИИ-модель Kandinsky Video.

«Сбер» представил ИИ-модели Kandinsky 5.0 для генерации картинок и видео в HD

Инженеры «Сбера» представили обновлённое семейство моделей искусственного интеллекта Kandinsky 5.0. Оно представлено четырьмя моделями: одна предназначена для генерации, а вторая — для редактирования статических изображений; ещё две генерируют видео. Компания открыла веса всех четырёх нейросетей.

 Источник изображений: «Сбер»

Источник изображений: «Сбер»

Модель Kandinsky 5.0 Image Lite генерирует изображения высокого разрешения, в том числе 1280 × 768 и 1024 × 1024 пикселей. Image Editing предназначается для редактирования картинок высокого разрешения. Video Pro создаёт ролики длиной до 10 секунд в разрешении 1280 × 768 пикселей с частотой 24 кадра в секунду. Video Lite генерирует видео стандартного разрешения (768 × 512 пикселей) с той же частотой и может запускаться на бытовых видеокартах с 12 Гбайт памяти. В качестве запросов все модели принимают как изображения, так и текстовые описания.

Важнейшее преимущество моделей «Сбера» в семействе Kandinsky 5.0 — их способность свободно ориентироваться в российском культурном контексте; они могут создавать надписи на кириллице и латинице. Нейросети нового поколения понимают физические процессы и кинематографические приёмы — они поддерживают повороты и вращения камеры, а также умеют «оживлять» статические фотографии. Высокого качества изображений и видео у моделей Kandinsky 5.0 разработчики «Сбера» добились, обучая их на тщательно подобранных материалах с выверенной композицией.

Опробовать нейросети «Сбера» Kandinsky 5.0 Image Lite, Video Lite и Video Pro можно в приложении GigaChat для Android-устройств, на сайте giga.chat, а также в мессенджерах Telegram и Max. Все они доступны бесплатно.

«Сбер» представил нейросеть Kandinsky 4.1 Video для генерации 10-секундных HD-видео

«Сбер» в рамках технологической конференции GigaConf анонсировал генеративную нейросеть Kandinsky 4.1 Video, которая позволяет создавать 10-секундные видео в формате HD по текстовому описанию или изображению. На данный момент опробовать новый алгоритм уже смогли участники конференции и профессиональные дизайнеры.

 Источник изображения: Steve Johnson / Unsplash

Источник изображения: Steve Johnson / Unsplash

«Kandinsky 4.1 Video обеспечивает качественно новый уровень генеративного видео. Модель стала в разы лучше по всем параметрам: по соответствию промпту, визуальному качеству, качеству генерации движений, а также способности моделировать физику мира. Такие разработки открывают беспрецедентные возможности как для дизайнеров, маркетологов, так и для представителей любых других креативных индустрий, работающих над созданием высококачественного видеоконтента», — рассказал старший вице-президент «Сбербанка» Андрей Белевцев.

Согласно имеющимся данным, Kandinsky 4.1 Video генерирует видеоряд продолжительностью до 10 секунд в разрешении SD (720×576 пикселей) или HD (1280×720 пикселей). Разработчики дообучили новую архитектуру диффузионного трансформера на данных, подготовленных более чем 100 профессиональными фотографами и художниками. Особое внимание уделялось оптимизации вычислительных процессов. За счёт применения методов дистилляции и ускорения удалось более чем втрое сократить время генерации по сравнению с моделью предыдущего поколения.

Kandinsky 1.4 Video поддерживает создание роликов с произвольным соотношением сторон, за счёт чего генерируемый контент можно адаптировать под разные платформы и маркетинговые задачи. Для всех желающих новая версия алгоритма станет доступна в ближайшее время.

«Сбер» представил собственный ИИ-генератор видео по текстовому описанию Kandinsky 4.0 Video

На проходящей на этой неделе конференции AI Journey «Сбер» представил бета-версию нейросети Kandinsky 4.0 Video, которая позволяет генерировать реалистичные видео на основе текстового описания или стартового кадра. Алгоритм может быть полезен не только обычным пользователям, но также дизайнерам, маркетологам и мультипликаторам, так как с его помощью можно создавать различные видео: от анимированных роликов с поздравлениями для близких до трейлеров и клипов.

 Источник изображения: fusionbrain.ai

Источник изображения: fusionbrain.ai

В компании отметили, что с момента релиза первой версии Kandinsky Video в прошлом году разработчики значительно улучшили многие характеристики алгоритма, включая качество создаваемых роликов и скорость генерации. Обновлённая нейросеть способна создавать ролики продолжительностью до 12 секунд с разрешением 1280 × 720 пикселей на основе текстового описания или изображения. Также поддерживается создание роликов с различным соотношением сторон. Улучшилось визуальное качество: повысились контрастность и чёткость кадров, композиция стала более выверенной, а движения объектов в кадре — реалистичными.

В дополнение к этому разработчики анонсировали ускоренную версию нейросети — Kandinsky 4.0 Video Flash, которая способна генерировать ролики продолжительностью до 12 секунд с разрешением 720 × 480 пикселей всего за 15 секунд. На начальном этапе доступ к новой версии Kandinsky Video получат представители креативных индустрий, включая художников, дизайнеров и кинематографистов через портал fusionbrain.ai. Для обычных пользователей алгоритм станет доступен в первом квартале следующего года.


window-new
Soft
Hard
Тренды 🔥
Google начала навязывать ИИ-режим в поиске — некоторые развёрнутые ответы от ИИ теперь показываются автоматически 59 мин.
Календарь релизов — 31 августа – 6 сентября: The Blood of Dawnwalker, Onimusha и Serious Sam 2 ч.
Балканизация виртуализации: VMware теряет клиентов из-за стратегии Broadcom, но та не собирается ничего менять 2 ч.
Недавнее обновление для Windows 11 сломало курсор и обои рабочего стола 2 ч.
OpenClaw обновился до версии 2.0 — запуск ИИ-агентов стал проще, а управлять ими теперь могут сразу несколько человек 4 ч.
DLSS 5 заработала на видеокартах GeForce RTX 2000 и RTX 3000, но очень медленно 7 ч.
ЕС поставил ChatGPT в один ряд с крупнейшими онлайн-платформами — ответственность OpenAI возрастёт 7 ч.
ИИ-направление принесло Cloud.ru более половины выручки в I полугодии 2026 года 8 ч.
Instagram объявила войну ИИ-аккаунтам, выдающим себя за реальных людей 8 ч.
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 8 ч.
Новая статья: 10 флагманских процессоров Intel за 10 лет 38 мин.
AOC выпустила 27-дюймовый игровой монитор Agon AGP277KXM с подсветкой Mini-LED и двумя режимами: 5K@180 Гц и 1440p@360 Гц 40 мин.
Apple потеряла ключевого руководителя накануне смены гендира: Фил Шиллер оставил пост главы App Store 2 ч.
Meta внедряет роботов в ЦОД для замены людей, но пока процесс идёт очень медленно 6 ч.
CXMT запустила пробное производство памяти HBM3E 6 ч.
В недрах Марса обнаружилась массивная «тепловая аномалия» — возможно, это результат древнего космического ДТП 7 ч.
Никому ни слова: операторы ЦОД в США всё чаще заключают тайные соглашения в властями, прикрываясь NDA 8 ч.
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 9 ч.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 9 ч.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 11 ч.