Microsoft разработала ИИ-систему для создания изображений по текстовым описаниям
Корпорация Microsoft сообщила о разработке системы на основе искусственного интеллекта (ИИ), которая способна формировать изображения по текстовому описанию.

Программный бот использует так называемую технологию GAN — Generative Adversarial Network. Она содержит две модели машинного обучения, одна из которых генерирует изображения по текстовому описанию, а другая отвечает за оценку их достоверности.
Учёные также разработали специальный алгоритм AttnGAN, который позволяет не обрабатывать предложение целиком, а разбивать его на отдельные слова. За счёт этого технология более точно выбирает область для размещения каждой детали изображения.
В качестве примера Microsoft приводит создание изображения птицы. В текстовом описании сказано лишь, что она имеет оперение жёлтого цвета, чёрные крылья и короткий клюв. Результат (см. иллюстрацию) впечатляет.

Любопытно, что система способна дорисовывать объекты, которые подходят к композиции по смыслу. К примеру, на большинстве фотографий птицы изображены сидящими на ветвях деревьев. Технология может добавить этот элемент, даже если он не прописан в задании.
Технология преобразования текста в изображения может применяться для помощи дизайнерам и художникам в создании эскизов. По мнению разработчиков, при возможности использования больших вычислительных мощностей, алгоритм сможет также создавать анимационные фильмы по тексту сценария.
Источник: 3DNews
Как перевезти личные вещи на небольшое расстояние: транспорт, упаковка и организация переезда
Продажи товаров для настольного тенниса в М.Видео выросли почти в пять раз
Число продавцов на маркетплейсе М.Видео превысило 12 тысяч
Доступный ветрогенератор для каждого: представлена модель Ventyra R1 мощностью 50 Вт за $180
Russ запустил цифровой суперформат на фасаде ВТБ Арены
Фандом Фест ВКонтакте назвал хедлайнеров 2026 года
Huawei привезла в Европу сверхбыструю зарядку на 720 кВт: 200 км запаса хода за 5 минут
Где списать долги: рейтинг компаний