Китайские разработчики создали нейронную сеть под названием CogVideo, которая умеет генерировать короткие видеоролики по текстовому описанию. CogVideo умеет создавать видео с относительно высокой частотой кадров — на 4 секунды видео приходится 32 кадра.
На данный момент нейросеть уже может создавать видео по запросам «лев, пьющий воду», «женщина верхом на лошади в море», «мужчина ест пиццу» и так далее. Что касается принципа работы, то он похож на то, что задействовано в нейросетях DALL-E 2 и Imagine, которые создают изображения по текстовому описанию.
Утверждается, что по качеству работы даже предварительная версия CogVideo превосходит все общедоступные модели нейросетей. Пока что авторы не предствили ни исходных кодов программы, ни моделей для обучения собственных нейросетей.
А ранее учёные сообщили, что нейросеть в процессе работы создала свой язык, при этом специалисты не могут его расшифровать.
Intel научилась выпускать гигантские чипы: в 24 раза больше фотошаблона
CXMT из Китая начала подготовку к выпуску оперативной памяти LPDDR6
Марсоход Perseverance обнаружил на Марсе редкий гидротермальный минерал, благоприятный для зарождения жизни
Китай создал беспилотники с лазерной «заправкой» для бесконечного полета
Xiaomi выпустила выносливые кондиционеры Mijia Giant Power Saving Pro, работающие при температурах от -35 до +65 °C
США могут отменить экологические проверки ради упрощения космических запусков
Motorola Watch Ultra на рендерах: стальной корпус, IP68, LTE и вызов Samsung Galaxy Watch Ultra
Windows 11 перестанет потреблять много оперативной памяти: Microsoft готовит масштабное обновление