NVIDIA heeft de quad-die variant van de Rubin Ultra GPU geannuleerd en kiest voor een dual-GPU-ontwerp. De oorspronkelijke vier-die configuratie bleek te complex voor productie.
De Rubin Ultra is NVIDIA’s aankomende high-end GPU voor AI-rekensystemen. De wijziging van een quad-die naar een dual-GPU-ontwerp betekent dat NVIDIA inlevert op maximale rekenkracht per chip, maar wel een productiebaarder product aflevert. Productieproblemen werden als reden voor de aanpassing genoemd.
De verandering komt op een moment waarop de vraag naar AI-rekenkracht onverminderd groot is. NVIDIA’s H100-huurprijzen stegen recent met 40 procent, en cloudproviders draaien op volle capaciteit. Een vertraging of herontwerp van Rubin Ultra zou de toevoerlijn kunnen raken.
NVIDIA’s keuze voor een simpeler ontwerp past bij een bredere trend in de chipindustrie: complexiteit verlagen om opbrengst en leveringszekerheid te verhogen. De prestaties per afzonderlijke GPU blijven vergelijkbaar, maar de schaalbaarheid per eenheid verandert.