Сбер представил новейшую модель Kandinsky 6.0 Video
Сбер представил новейшую модель Kandinsky 6.0 Video, которая дозволяет юзерам GigaChat создавать недлинные видео со звуком по текстовому описанию либо загруженному первому кадру.
Антон Фролов, старший вице-президент, управляющий блока «Развитие генеративного ИИ» Сбера:
Мы желаем, чтоб генеративный ИИ стал таковым же естественным инвентарем креатора, как сейчас текстовый редактор либо камера телефона.
Модель может генерировать речь, музыку и звуки окружающей среды, надлежащие содержанию видео. Юзеру довольно задать текстовый запрос либо загрузить изображение, на базе которого нейросеть создаст ролик со звуком. Но из-за значимых вычислительных издержек ролик больше 5 секунд сгенерировать не получится, но с течением времени создатели планируют ее прирастить.
В новейшей версии Kandinsky стала лучше передача физики настоящего мира. Движения людей, звериных и предметов в кадре должны смотреться наиболее естественно, а сами сцены – правдоподобнее.
Напомним, в сентябре Сбер представил новейшую модель GigaChat 3.5 Reasoning с режимом рассуждений. Компания позиционирует новинку как единственную российскую открытую модель с режимом рассуждений.