NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
Artikelbild eller återanvändbart omslag för NVIDIA
NVIDIA presenterar sin nya Vera Rubin NVL72-system som visar kraftig prestandaökning i MLPerf Inference v6.1-testerna.
Systemet levererar upp till 3,7 gånger högre genomströmning än föregångaren GB300 NVL72 på benchmarken Qwen3-VL, och 2,5 gånger högre på DeepSeek-R1. När fyra GB300 NVL72-rack skalades upp tillsammans uppnåddes 99 procents skalningseffektivitet — genomströmningen växte nästan linjärt när fler GPU:er lades till. NVIDIA uppnådde också prestandaförbättringar genom mjukvaruoptimering: versionen 6.1 var upp till 1,6 gånger snabbare än 6.0. För AI-agenter som löser komplexa flerstegsproblem levererade Vera Rubin 30 gånger bättre prestanda än GB300 i testning.
Sammanfattningen har tagits fram med AI av Vibekollen utifrån källans publicering. Innehållet tillhör NVIDIA.
Mer att läsa
Server-Side Code Execution Tools for AI Agents, Compared
OpenRouter för 10 tim sedan
v0.40.0
Ollama för 11 tim sedan
Google froze its open source bug bounty program due to a ‘significant rise’ in AI submissions
TechCrunch AI för 14 tim sedan
Can ‘super intelligence’ and a non-binding safety pact solve AI’s image problem?
TechCrunch AI för 14 tim sedan