Ушки на бёдрах: откуда берутся и как от них избавиться?
8 мая, 12:00
Названы города-рекордсмены, где чаще всего штрафуют за самовыгул собак
9 мая, 18:05
Толкали гирю и отжимались: в Улан-Удэ установили новый "Рекорд Победы" 
9 мая, 17:16
Парад Победы в Улан-Удэ: как это было
9 мая, 17:03
Россия вошла в топ-5 стран с дешевым бензином
9 мая, 16:25
Клещи убегут с воплями, если посадите на даче один милый цветочек
9 мая, 16:05
Ветераны ВОВ получают юбилейные выплаты
9 мая, 13:05
Магаданская область присоединилась к акции "Бессмертный полк России"
9 мая, 12:20
Битва с лесными пожарами в Бурятии продолжается
9 мая, 12:00
Волонтеры из Бурятии раздали Георгиевскую ленту в Улан-Баторе
9 мая, 10:49
Майнинг в Бурятии запретят полностью
9 мая, 09:38
Вахта Победы: На площади Свободы хабаровчане празднуют День Победы!
9 мая, 08:10
Чимит Бальжинимаев: Мы всегда должны чтить память погибших
9 мая, 08:00
Вахта Победы: фашисты разгромлены — Советский Сахалин ликует
9 мая, 08:00
Игорь Шутенков: Этот праздник— священный для каждого из нас
9 мая, 07:00
Вахта Победы: Репортаж из 9 мая 1945 года - как Улан-Удэ встретил тот День Победы
9 мая, 02:18

Камера, мотор, начали! Сбер представил нейросеть генерации полноценного видео

Kandinsky Video создаёт видеоролики с разрешением 512 х 512 пикселей
Сбер. Офис Сбера в Иркутске Наталия Раткевич, ИА IrkutskMedia
Сбер. Офис Сбера в Иркутске
Фото: Наталия Раткевич, ИА IrkutskMedia
Бизнес

Сбер представил нейросеть Kandinsky Video (12+) —  первую в России генеративную модель для создания полноценных видеороликов по текстовому описанию. Модель генерирует видеоряд продолжительностью до восьми секунд с частотой 30 кадров в секунду. Об этом в ходе международной конференции AI Journey (18+) рассказал первый заместитель председателя правления Сбербанка Александр Ведяхин, пишет ИА IrkutskMedia со ссылкой на пресс-службу банка. 

Архитектура Kandinsky Video состоит из двух ключевых блоков: первый отвечает за создание ключевых кадров, из которых складывается структура сюжета видео, а второй — за генерацию интерполяционных кадров, которые позволяют достичь плавности движений в финальном видео. В основе двух блоков лежит новая модель синтеза изображений по текстовым описаниям Kandinsky 3.0.

Формат сгенерированного видео представляет собой непрерывную сцену с движением как объекта, так и фона. Именно это отличает видеоролики, синтезированные моделью Kandinsky Video, от анимационных видеороликов, в которых динамика достигается за счёт моделирования пролёта камеры относительно статичной сцены. Нейросеть создаёт видеоролики с разрешением 512 х 512 пикселей и различным соотношением сторон. Модель обучена на датасете из более чем 300 тыс. пар "текст — видео". Генерация видео занимает до трёх минут.

"Недавно мы обучили Kandinsky создавать анимационные видео по текстовому описанию, а уже сегодня представляем модель совершенно другого уровня — первую в России модель по генерации полноценных видеороликов по тексту. Это важный вклад в развитие российских генеративных нейросетей. У пользователей появится ещё больше возможностей для креатива и реализации своих творческих задумок любой направленности. Люди смогут создавать уникальные видеоролики абсолютно бесплатно. Наша модель, как и большинство других в линейке Сбера, будет доступна в open source. Мы верим, что искусственный интеллект сможет открыть перед людьми новые супервозможности и создать инструменты, которыми они будут пользоваться для решения своих задач", — сказал первый заместитель председателя правления Сбербанка Александр Ведяхин.

Ранее у активных пользователей Kandinsky 2.2 в тестовом режиме появилась возможность создания анимационных видеороликов. По одному запросу можно создать видео длиной в четыре секунды с выбранным эффектом анимации, с частотой 24 кадра в секунду и разрешением 640 х 640 пикселей. Пользователи нейросети Kandinsky 3.0 также могут создавать видеоролики по текстовому описанию в режиме анимации.

Оценить возможности нейросети Kandinsky Video можно на платформе fusionbrain.ai (18+) и в Telegram-боте (18+), где можно оставить заявку на доступ.

Нейросеть разработали и обучили исследователи Sber AI при партнёрской поддержке учёных из Института искусственного интеллекта AIRI на объединённом датасете Sber AI и компании SberDevices. В апреле 2023 года сервис на базе нейросети Kandinsky 2.1, стал самым быстрорастущим в мире. Он набрал один миллион уникальных пользователей всего за четыре дня после выхода.

Услуги предоставляются ПАО "Сбербанк" (ОГРН 1027700132195. Юридический адрес: Москва, ул. Вавилова, 19). 

190699
48
57