Η NVIDIA Vera Rubin εμφανίζει έως 30× υψηλότερη ρυθμαπόδοση ανά watt από τη Blackwell σε δοκιμές agentic AI
Τα νούμερα της Vera Rubin
Στα φορτία AgentX, η NVIDIA Vera Rubin NVL72 πέτυχε έως 30× υψηλότερη ρυθμαπόδοση ανά megawatt από τη GB300 NVL72, στο μοντέλο DeepSeek-v4-Pro 1.6T. Σύμφωνα με το δημοσίευμα του Wccftech που παρουσιάζει αναλυτικά τα στοιχεία της NVIDIA, η Vera Rubin έφτασε περίπου τα 160 tokens ανά δευτερόλεπτο ανά χρήστη σε όρους διαδραστικότητας, με αιχμή έως περίπου 280 tokens/δευτερόλεπτο ανά χρήστη, ενώ η Blackwell σταματούσε κάτω από τα 180 tokens/δευτερόλεπτο ανά χρήστη στο ίδιο σενάριο. Το ίδιο δημοσίευμα αναφέρει ότι η Vera Rubin προσφέρει έως 35 φορές χαμηλότερο κόστος ανά εκατομμύριο tokens σε agentic coding φορτία σε σχέση με την Blackwell. Μέρος της βελτίωσης αποδίδεται στην τεχνολογία διαχείρισης ισχύος DSX MaxLPS, που επιτρέπει, μεταξύ άλλων, έως 40% περισσότερες GPU εντός του ίδιου ενεργειακού περιθωρίου.
Η Blackwell έναντι της προηγούμενης γενιάς
Τα ίδια στοιχεία της NVIDIA δείχνουν ότι η GB300 NVL72 επέκτεινε το δικό της, ήδη μεγάλο, προβάδισμα σε ρυθμαπόδοση ανά megawatt έναντι της H200 NVL8, φτάνοντας έως 80 φορές μεγαλύτερη απόδοση σε μεγάλα μοντέλα τύπου mixture-of-experts όπως το Kimi K3 2.8T. Κατά το Wccftech, στο συγκεκριμένο σενάριο η Blackwell διατήρησε 215 tokens ανά δευτερόλεπτο ανά χρήστη σε διαδραστικότητα, ενώ στο DeepSeek-v4-Pro 1.6T προσέφερε 10 φορές χαμηλότερο κόστος ανά εκατομμύριο tokens σε σχέση με την Hopper. Οι βελτιώσεις αυτές αποδίδονται, σύμφωνα με τη NVIDIA, σε βελτιστοποιήσεις σε επίπεδο συστήματος, όπως οι μηχανές εξυπηρέτησης MoE (SGLang, TensorRT-LLM, vLLM), πυρήνες βασισμένοι σε DeepGEMM, μορφές μειωμένης ακρίβειας (MXFP4, MXFP8), η στοίβα εξυπηρέτησης NVIDIA Dynamo και η υποδομή διασύνδεσης NVLink που συνδέει 72 GPU.
Τι δεν καλύπτουν ακόμα οι μετρήσεις
Πρόκειται για στοιχεία που δημοσίευσε η ίδια η NVIDIA, χωρίς ανεξάρτητη επιβεβαίωση από τρίτο εργαστήριο δοκιμών. Το Wccftech σημειώνει ότι οι μετρήσεις δεν περιλαμβάνουν ακόμα την απόδοση του Vera CPU σε κλήσεις εργαλείων (tool calling) και αφορούν μόνο τα τσιπ Rubin, όχι το πλήρες πλατφόρμα «Extreme Codesign» των επτά τσιπ. Σε σχετικό υλικό της NVIDIA για την αρχιτεκτονική του Rubin GPU αναφέρεται μικρότερη βελτίωση, της τάξης του 10× σε ρυθμαπόδοση ανά μονάδα ενέργειας σε επίπεδο μεμονωμένου GPU έναντι της Blackwell, γεγονός που δείχνει ότι το 30× αφορά συνδυασμό υλικού και λογισμικού σε επίπεδο ολόκληρου rack (NVL72) και όχι απλή σύγκριση τσιπ προς τσιπ. Για τους αναγνώστες, η εξέλιξη έχει πρακτική σημασία στο βαθμό που το κόστος ανά token επηρεάζει άμεσα την τιμολόγηση υπηρεσιών AI και τη ζήτηση για υποδομές, GPU και μνήμη υψηλής χωρητικότητας τα επόμενα τρίμηνα.
Πηγές
Wccftech: NVIDIA Vera Rubin Records A Massive 30× Increase In Throughput Per Watt Than Blackwell NVIDIA Technical Blog: NVIDIA Vera Rubin and Blackwell Set a New Standard for Agentic AI Performance per Watt NVIDIA Technical Blog: Inside NVIDIA Rubin GPU Architecture
194
