Компания Google решила не отставать от тренда, касающегося нейросетей. Её новая система под названием Imagen Video создаёт видео по текстовому описанию, причём в довольно высоком качестве.
Система может создавать ролики длительностью до 5 секунд в разрешении 1280 на 768 пикселей. компания пока не публикует исходные коды системы и не открывает доступ к ней, чтобы избежать появления шокирующего или непристойного контента.
По данным источника, новая система умеет работать в разных стилях. В частности, она умеет имитировать стили художников и создавать вращающиеся 3D-объекты, причём их форма сохраняется по мере вращения.
Нейросеть обучали на десятках миллионов фотографий, видео и текстовых описаний. При подаче текстового запроса система генерирует исходный прототип видео из 16 кадров с разрешением 24×48 пикселей и частотой 3 кадра в секунду. После этого другая система увеличивает разрешение до 1280 на 768 пикселей и 5 секунд.
Результаты работы доступны на сайте проекта. А ранее разработчики из компании Meta* представили новую нейросеть под названием Make-A-Video, которая тоже умеет создавать видео по текстовому описанию.
* Meta признана экстремистской организацией на территории РФ
Sony Xperia 10 VIII с экраном без вырезов, слотом microSD и аудиоразъемом показали на живых фото сразу после презентации
Xiaomi представила мощный торшер без бликов: 11 000 лм при весе 8,5 кг и высоте 1,3 м
CXL и петабайт на двух накопителях: как индустрия хранения данных адаптируется под запросы ИИ
Philips выпустила бюджетный монитор с VA-матрицей и частотой 120 Гц всего за 63 доллара
Илон Маск прокачает нейросеть Grok с помощью платформы Nvidia Vera Rubin
TP-Link, Keenetic и Huawei: в «М.Видео» назвали самые популярные роутеры у россиян
Анонсирован Lava Virat V1 Pro 5G: дисплей 120 Гц, защита IP64, камера 50 Мп и Android 16 всего за $165
Как расширить память SSD с 256 до 320 ГБ без паяльника и лишних усилий