Китайские разработчики создали нейронную сеть под названием CogVideo, которая умеет генерировать короткие видеоролики по текстовому описанию. CogVideo умеет создавать видео с относительно высокой частотой кадров — на 4 секунды видео приходится 32 кадра.
На данный момент нейросеть уже может создавать видео по запросам «лев, пьющий воду», «женщина верхом на лошади в море», «мужчина ест пиццу» и так далее. Что касается принципа работы, то он похож на то, что задействовано в нейросетях DALL-E 2 и Imagine, которые создают изображения по текстовому описанию.
Утверждается, что по качеству работы даже предварительная версия CogVideo превосходит все общедоступные модели нейросетей. Пока что авторы не предствили ни исходных кодов программы, ни моделей для обучения собственных нейросетей.
А ранее учёные сообщили, что нейросеть в процессе работы создала свой язык, при этом специалисты не могут его расшифровать.
LG Electronics впервые продала установку прямой лазерной литографии с точностью 1,5 мкм, работающую без фотомасок
22 вылета, 30 часов в воздухе и пять прерванных взлетов: новейший российский Ил-114-300 успешно выдержал проверку экстремальной жарой
В Сеть до анонса утекли изображения Sony WH-1000XM4C — обновленной версии популярных наушников
Неанонсированный флагманский процессор Dimensity 9600 Pro появился на китайской барахолке всего за $30
Тонкий Vivo V80 Lite 5G с аккумулятором на 10 000 мАч и камерой 50 Мп показали на официальных изображениях
Из молекулярных слоев тоньше нанометра создали действующую электронику
Корпоративные SSD подорожали в 6,5 раза за год: накопитель на 30 ТБ теперь стоит как новый автомобиль
Не просто «Корова»: развертывание и боевая настройка MailCow в продакшене