Компания Nvidia представила ускоритель H100 NVL, который, судя по всему, создан специально для обучения языковых моделей. Как сказано на сайте Nvidia, cерверы, оснащенные графическими процессорами H100 NVL, повышают производительность модели GPT-175B до 12 раз по сравнению с системами DGX A100, сохраняя при этом низкую задержку в средах центров обработки данных с ограниченным энергопотреблением.
Фактически H100 NVL представляет собой пару H100 на одной плате. Речь идёт о двух GPU, объединённых интерфейсом NVLink, благодаря чему Nvidia говорит о 68 TFLOPS при вычислениях с двойной точностью (FP64), 143 TFLOPS (Tensor Core FP64), 7916 TOPS (IN8), 188 ГБ памяти с пропускной способностью 7,8 ТБ/с. Всё это позволяет обрабатывать до 175 млрд параметров ChatGPT в режиме реального времени.
Также Nvidia анонсировала запуск платформ логического вывода для больших языковых моделей и генеративных рабочих нагрузок ИИ. Речь сразу о четырёх платформах логического вывода, оптимизированных для разнообразного набора быстро развивающихся приложений генеративного ИИ.
Каждая платформа сочетает в себе полный стек ПО для логических выводов, новейшие графические процессоры компании, причём как игровые Ada Lovelace, так и специализированные Hopper, а также Grace Hopper Superchip.
Анонсирован флагманский 4K-проектор Dangbei X9 Max с лазером QuaLas42 и яркостью 5000 ISO люмен
MSI представила первую материнскую плату на чипсете AMD B650E спустя четыре года после его анонса
Видеокарты GeForce RTX 5090 стремительно исчезают из продажи, а их начальные цены в США подскочили до $6500
Aoostar анонсировала компактный ПК NEX495S с поддержкой до 192 ГБ оперативной памяти
Главная уязвимость российской микроэлектроники: 84% материалов свои, но 90% из них производятся на зарубежном сырье
У 16-контактного разъема питания GeForce RTX 5090 проплавилась дыра
Эволюция советского кодинга: от «Агата» до «Микроши». Часть 1
Т2 стер границы: абоненты из разных регионов объединяются для получения скидок