NVIDIA Vera Rubin NVL72 levert topprestaties bij debuut in MLPerf Inference v6.1
Systeemprestaties, efficiënte infrastructuurschaling en continue software-optimalisatie zijn de belangrijkste hefbomen die de economie van AI-inferentie bepalen. Hogere systeemprestaties betekenen meer gegenereerde tokens en dus hogere omzet. Efficiënte schaling betekent dat de doorvoer evenredig meegroeit naarmate er hardware wordt toegevoegd, waardoor er minder middelen nodig zijn om gebruikers op schaal te bedienen. Continue optimalisatie betekent meer waarde halen uit infrastructuurinvesteringen. […]
🔗 lees originele bron