AI 推理 MLPerf 6.1 发布: AMD 以 512 个 MI355X Придбати Vera Rubin

AI 推理 MLPerf 6.1 发布: AMD 以 512 个 MI355X Придбати Vera Rubin


IT之家 9 月 17 новини, наука та технології ЗМІ Wccftech вчора (9 月 16 发布博文,Після випуску MLPerf Inference v6.1 такі виробники, як AMD, NVIDIA та інші, надсилають результати одночасно.

AI 推理 MLPerf 6.1 发布: AMD 以 512 个 MI355X Придбати Vera Rubin

IT之家注: MLPerf Inference — це набір тестів для порівняння, що підтримується MLCommons і використовується для вимірювання продуктивності та затримки різного обладнання в завданнях AI推理. Остання версія 6.1 зосереджена на продуктивності в конфігурації AI推理吞吐、扈理吞吐、扩理吞展.

Швидкість AMD 称以 575 万个токенів на секунду за шкалою 512 个GPU встановила новий рекорд MLPerfЦе найбільша заявка AMD на сьогоднішній день, яка ще раз підтверджує продуктивність, масштаб, зрілість програмного забезпечення та відтворюваність AMD.

Тест DeepSeek R1, AMD 以 512 个 GPU Instinct MI355X 参赛,简线(可以批量设计能力,зазвичай використовується для вимірювання системи в сценаріях реального часу. 2 901 950 токенів/с, сервер (вища пропускна здатність і можливість відповіді в сценаріях онлайн-сервісу, ближче до середовища обробки запитів у фактичному розгортанні) результати 2,405,310 знаки/с.

英伟达在下载地址中安全GB300和GB200的 288 Конфігурація GPU, лінія GB300 2,705,130 іконки, сервер 2 028 030 жетонів/с. Через відмінності конфігурації наведені вище дані лише для довідки.

Крім того, Vera Rubin VR200 вперше потрапила в бенчмарк MLPerf, 36 GPU і 72 GPU з’явилися в першій конфігурації GPU, Vera Rubin (VR200) ​​на 95% швидше, ніж GB300, а версія з 36 GPU краще, ніж 72-GPU GB200.



Source link

Leave a Reply

Your email address will not be published. Required fields are marked *