Облачный провайдер CoreWeave запустил в своей инфраструктуре систему Nvidia Vera Rubin NVL72. Первым клиентом, который перенёс на неё производственные ИИ-нагрузки, стала компания Cognition. Об этом сообщает iXBT.com со ссылкой на блог Nvidia.[1]
Результаты работы системы приводятся по данным блога Nvidia. В задаче вывода SWE-2 общая пропускная способность по токенам оказалась до 4,8 раза выше, чем у GB200 NVL72. В сценариях обучения с подкреплением пропускная способность на один GPU выросла в 3,8 раза. В тесте DeepSeek-R1 новая система показала в 10 раз большую пропускную способность токенов на мегаватт, чем GB200 NVL72.[2][3][4]
В стойке установлены 36 процессоров Vera и 72 GPU Rubin, охлаждение полностью жидкостное. Стойки собраны из модулей. По заявленным данным, отдельный лоток теперь устанавливают примерно за пять минут, а раньше на это уходило около двух часов.[5][6]
Процессоры Vera CoreWeave предлагает и отдельно от GPU. В одну стойку помещается до 128 таких процессоров, это 11 264 ядра. На них можно одновременно запускать более 11 000 изолированных сред. Агентские песочницы, по данным компании, на них стартуют более чем в 3 раза быстрее, чем на процессорах с архитектурой x86.[7][8]
Стоимость аренды новой системы и сроки, когда она станет доступна другим клиентам, пока неизвестны.
Облачный провайдер CoreWeave запустил в своей инфраструктуре систему Nvidia Vera Rubin NVL72, а компания Cognition стала первым клиентом, разместившим на ней производственные ИИ-нагрузки.
В тесте DeepSeek-R1 система Vera Rubin NVL72 продемонстрировала в 10 раз большую пропускную способность токенов на мегаватт по сравнению с GB200 NVL72.
В одной стойке можно разместить до 128 таких процессоров, суммарно получая 11 264 ядра и возможность одновременно запускать более 11 000 изолированных сред.