Компания Nvidia представила ускоритель H100 NVL, который, судя по всему, создан специально для обучения языковых моделей. Как сказано на сайте Nvidia, cерверы, оснащенные графическими процессорами H100 NVL, повышают производительность модели GPT-175B до 12 раз по сравнению с системами DGX A100, сохраняя при этом низкую задержку в средах центров обработки данных с ограниченным энергопотреблением.
Фактически H100 NVL представляет собой пару H100 на одной плате. Речь идёт о двух GPU, объединённых интерфейсом NVLink, благодаря чему Nvidia говорит о 68 TFLOPS при вычислениях с двойной точностью (FP64), 143 TFLOPS (Tensor Core FP64), 7916 TOPS (IN8), 188 ГБ памяти с пропускной способностью 7,8 ТБ/с. Всё это позволяет обрабатывать до 175 млрд параметров ChatGPT в режиме реального времени.
Также Nvidia анонсировала запуск платформ логического вывода для больших языковых моделей и генеративных рабочих нагрузок ИИ. Речь сразу о четырёх платформах логического вывода, оптимизированных для разнообразного набора быстро развивающихся приложений генеративного ИИ.
Каждая платформа сочетает в себе полный стек ПО для логических выводов, новейшие графические процессоры компании, причём как игровые Ada Lovelace, так и специализированные Hopper, а также Grace Hopper Superchip.
В Москве всего за 14 месяцев возвели гигафабрику аккумуляторов
Барахолка под Валенсией: консоль Sony MSX, Raspberry Pi и другие сокровища октября
Timetta 2026.1 прошла проверку совместимости с Astra Linux 1.7 и 1.8
Ростех улучшил очки Blue Sky Pro для нормализации сна
Производитель систем охлаждения раскрыл характеристики AMD Epyc Verano: новый сокет, до 72 ядер Zen 6 и частота до 5 ГГц
Портативный Kubernetes: строим частное ARM64-облако своими руками
130 отделений «Лавки» подключили к доставке роботами Яндекса
Рынок резервного копирования в России достиг 5,8 млрд рублей за полугодие