Τι είναι οι επιταχυντές AI AMD Instinct;

Δεν υπάρχει αμφιβολία ότι η NVIDIA συνεχίζει να κυριαρχεί στον χώρο παράλληλων υπολογιστών με τη δημοφιλή και ποικίλη σειρά καρτών γραφικών της. Αλλά με τους επιταχυντές Instinct AI της AMD να τροφοδοτούν δύο από τους πιο πρόσφατους και καλύτερους υπερυπολογιστές της (Frontier και El Capitan) και την αυξανόμενη υποστήριξη της κοινότητας για την πλατφόρμα ανοιχτού κώδικα ROCm, η NVIDIA μπορεί να έχει βρει τον μεγαλύτερο ανταγωνιστή της μέχρι τώρα.

Τι ακριβώς είναι λοιπόν οι επιταχυντές AI της AMD Instinct; Τι το κάνει ισχυρό και πώς συγκρίνεται με τις GPU Tensor της NVIDIA; Επαληθεύω Ποια είναι η διαφορά μεταξύ μιας μητρικής πλακέτας AMD και ενός επεξεργαστή Intel;

Τι είναι το AMD Instinct;

Οι GPU AMD Instinct είναι εταιρικό υλικό που χρησιμοποιείται για υπολογιστές υψηλής απόδοσης (HPC) και επεξεργασία με επιτάχυνση AI. Σε αντίθεση με τις κανονικές GPU σε επίπεδο καταναλωτή, οι Instinct GPU είναι αφιερωμένες στον καλύτερο χειρισμό της εκμάθησης τεχνητής νοημοσύνης, της επεξεργασίας μεγάλων δεδομένων και άλλων εργασιών υψηλής απόδοσης μέσω καινοτομιών λογισμικού και υλικού.

Η σειρά Instinct της AMD χρησιμοποιήθηκε για να τροφοδοτήσει τον πρώτο υπερυπολογιστή για να σπάσει το φράγμα υπολογιστών Exascale, με ταχύτητα 1.1 EFLOP σε λειτουργίες διπλής ακρίβειας ανά δευτερόλεπτο. Υπερυπολογιστές που περιέχουν GPU Instinct χρησιμοποιούνται επί του παρόντος για την έρευνα θεραπειών καρκίνου, βιώσιμης ενέργειας και κλιματικής αλλαγής.

Οι υπολογιστές υψηλής απόδοσης (HPC) έχουν γίνει ένα ουσιαστικό μέρος του σύγχρονου κόσμου μας που εκτελεί σύνθετες προσομοιώσεις και υπολογισμούς που είναι απαραίτητοι για την επιστημονική έρευνα, τη μηχανική, την ασφάλεια και άλλους τομείς. Ωστόσο, καθώς η ζήτηση για HPC έχει αυξηθεί, συχνά σε υπερυπολογιστές και μεγάλα κέντρα δεδομένων, το ίδιο ισχύει και για τις περιβαλλοντικές επιπτώσεις του. Τα τελευταία χρόνια, έχει δοθεί αυξημένη εστίαση στη βιωσιμότητα των κέντρων δεδομένων δεδομένων των επιπτώσεων για το συνολικό κόστος ιδιοκτησίας και τις ανησυχίες για το κλίμα.

Πώς οι Instinct GPU επιταχύνουν τη νοημοσύνη και τις τεχνολογίες υπολογιστών υψηλής απόδοσης

Προκειμένου οι πιο ισχυροί κύριοι διακομιστές και υπερυπολογιστές του κόσμου να επιτύχουν επεξεργασία σε επίπεδο Exascale, οι επιταχυντές AMD Instinct έπρεπε να είναι εξοπλισμένοι με πολλές τεχνολογικές βελτιώσεις και καινοτομίες.

Ας συζητήσουμε μερικές από τις νέες και ενημερωμένες τεχνολογίες που χρησιμοποιούνται στις GPU της AMD Instinct.

1. Αρχιτεκτονική τεχνολογίας (CDNA)

Οι σύγχρονοι επιταχυντές AMD Instinct (ξεκινώντας με το MI100) έχουν χρησιμοποιήσει την αρχιτεκτονική CDNA της εταιρείας.

Το CDNA εστιάζει κυρίως σε χαρακτηριστικά όπως η παράλληλη επεξεργασία, η ιεραρχία μνήμης και η βελτιωμένη υπολογιστική απόδοση μέσω της τεχνολογίας Matrix Core. Ακόμη και το HPC και το AI ή η μηχανική εκμάθηση που εκτελούνται σε μεμονωμένους διακομιστές μπορούν να υποστηριχθούν από το CDNA, καθώς και από υπερυπολογιστές Exascale.

Η τεχνολογία AMD Matrix Core επιταχύνει την εκμάθηση AI υποστηρίζοντας λειτουργίες μικτής ακρίβειας. Η δυνατότητα υπολογισμού σε διαφορετικές αναλύσεις επιτρέπει στις Instinct GPU να υπολογίζουν αποτελεσματικά τις λειτουργίες μήτρας με βάση το επιθυμητό επίπεδο ακρίβειας.

Οι πιο δημοφιλείς μορφές ανάλυσης υπολογισμού περιλαμβάνουν τα FP64, FP32, FP16, BF16 και INT8. Το FP σημαίνει Floating Point, το BF σημαίνει Brain Floating Point και το INT σημαίνει Integer. Όσο μεγαλύτερος είναι ο αριθμός που αντιστοιχεί στη μορφή, τόσο μεγαλύτερη είναι η ακρίβεια του υπολογισμού. Η λειτουργία στα 64 bit είναι γνωστή ως διπλή ακρίβεια. Με 32 bit είναι μονής ακρίβειας, με 16 bit είναι μισής ακρίβειας, και ούτω καθεξής.

Δεδομένου ότι ένα μεγάλο μέρος της εκπαίδευσης μοντέλων βαθιάς μάθησης δεν απαιτεί μεγάλη ακρίβεια, η δυνατότητα υπολογισμού λειτουργιών μήτρας με τη μισή ή και το ένα τέταρτο της ακρίβειας συμπερασμάτων μειώνει σημαντικά τον φόρτο εργασίας, επιταχύνοντας έτσι την εκμάθηση AI. Επαληθεύω Το AI μου από το Snapchat ή το ChatGPT: Ποιο πρέπει να χρησιμοποιήσετε;

2. Μνήμη υψηλού εύρους ζώνης (HBM)

Κάθε επιταχυντής AMD Instinct διαθέτει έως και 880 πυρήνες Matrix. Με τους επεξεργαστές Matrix Core της AMD με δυνατότητα 383 TFLOP υπολογισμών μισού λεπτού, η εξαιρετικά γρήγορη μνήμη είναι απαραίτητη. Η τελευταία προσφορά Instinct της AMD έρχεται με μνήμη υψηλού εύρους ζώνης (HBM) αντί για τη συνηθισμένη μνήμη RAM DDR4 ή DDR5.

Σε αντίθεση με την παραδοσιακή μνήμη, η HBM χρησιμοποιεί αυτό που είναι γνωστό ως τρισδιάστατη στοιβαγμένη αρχιτεκτονική. Αυτός ο τύπος αρχιτεκτονικής αναφέρεται σε μια προσέγγιση σχεδιασμού όπου οι μονάδες DRAM στοιβάζονται κάθετα η μία πάνω στην άλλη. Αυτό επιτρέπει τη στοίβαξη μονάδων τόσο στον κάθετο όσο και στον οριζόντιο άξονα, εξ ου και ο όρος τρισδιάστατη στοίβαξη.

Χρησιμοποιώντας αυτήν την τεχνολογία στοίβαξης 5D, το HBM μπορεί να έχει χωρητικότητα φυσικής μνήμης έως και μερικές εκατοντάδες gigabyte ανά μονάδα, ενώ το DRRXNUMX μπορεί να κάνει μόνο έως και δεκάδες gigabyte ανά μονάδα. Εκτός από τη χωρητικότητα, το HBM είναι επίσης γνωστό ότι έχει υψηλότερη απόδοση όσον αφορά τον ρυθμό μεταφοράς και την καλύτερη απόδοση ισχύος από την κανονική μνήμη DDR.

3. Infinity Fabric

Μια άλλη καινοτομία που ενσωματώνεται στις Instinct GPU είναι η τεχνολογία Infinity Fabric της AMD. Το Infinity Fabric είναι ένας τύπος συστήματος threading που συνδέει CPU και GPU με δυναμικό, έξυπνο τρόπο. Αυτό επιτρέπει στα εξαρτήματα να επικοινωνούν αποτελεσματικά μεταξύ τους.

Με το Infinity Fabric, αντί να συνδέουν στοιχεία σε έναν κανονικό δίαυλο, τα στοιχεία συνδέονται πλέον σε μια διαμόρφωση που μοιάζει με δίκτυο, όπου το εύρος ζώνης μπορεί να φτάσει αρκετές εκατοντάδες gigabyte ανά δευτερόλεπτο.

Εκτός από τη διασύνδεση που μοιάζει με δίκτυο, το Infinity Fabric χρησιμοποιεί επίσης αισθητήρες που είναι ενσωματωμένοι σε κάθε μοντέλο για να ελέγχει δυναμικά τη συχνότητα, τους ρυθμούς μεταφοράς δεδομένων και άλλες προσαρμοστικές συμπεριφορές, βελτιώνοντας την απόδοση και μειώνοντας την καθυστέρηση.

4. Πλατφόρμα ανάπτυξης ROCm

Το CUDA (Unified Computing Machine Architecture) της NVIDIA είναι η πιο ευρέως χρησιμοποιούμενη πλατφόρμα ανάπτυξης για την εκπαίδευση μοντέλων AI. Το πρόβλημα με το CUDA είναι ότι λειτουργεί μόνο με GPU NVIDIA. Αυτός είναι ένας από τους κύριους λόγους για τους οποίους η NVIDIA έχει τη συντριπτική πλειοψηφία των μεριδίων αγοράς επιταχυντών HPC και AI.

Με την AMD να θέλει ένα μεγαλύτερο μέρος της αγοράς HPC και AI, έπρεπε να αναπτύξουν τη δική τους πλατφόρμα, ROCm (Radeon Open Compute). Το ROCm είναι μια πλατφόρμα λογισμικού ανοιχτού κώδικα που επιτρέπει στις Instinct GPU να χρησιμοποιούνται ως επιταχυντές AI.

Αν και δεν είναι απαραίτητα μέρος του υλικού Instinct, το ROCm είναι το κλειδί όταν πρόκειται για την επιβίωση της σειράς GPU Instinct. Με το ROCm, οι προγραμματιστές και οι ερευνητές λαμβάνουν εργαλεία ROCm, τον μεταγλωττιστή, προγράμματα οδήγησης πυρήνα, ένα πλήρες σύνολο βιβλιοθηκών και πρόσβαση σε πλαίσια όπως το TensorFlow και το PyTorch για ανάπτυξη με την αγαπημένη τους γλώσσα προγραμματισμού AI.

Πώς συγκρίνονται οι επιταχυντές AI της AMD Instinct με τους αντίστοιχους Radeon;

Η AMD προσφέρει τη σειρά Instinct των εταιρικών GPU και των GPU Radeon για τον κύριο καταναλωτή. Όπως αναφέρθηκε προηγουμένως, ο επεξεργαστής Instinct χρησιμοποιεί αρχιτεκτονική CDNA από τις AMD, HBM και Infinity Fabric για διασύνδεση. Αντίθετα, οι επεξεργαστές Radeon χρησιμοποιούν την αρχιτεκτονική RDNA της AMD, τη μνήμη DDR6 και την Infinity Cache.

Αν και οι σειρές Radeon είναι λιγότερο ικανοί επιταχυντές τεχνητής νοημοσύνης, εξακολουθούν να συσκευάζουν έναν ή δύο πυρήνες επιτάχυνσης AI ανά υπολογιστική μονάδα. Η τελευταία Radeon RX7900 XT GPU έχει δύο πυρήνες επιτάχυνσης AI ανά μονάδα υπολογισμού, επιτρέποντας 103 TFLOP μισής μέγιστης ανάλυσης και 52 TFLOP ακριβείας μονής κορυφής.

Ενώ η σειρά των GPU Instinct είναι πιο κατάλληλη για LLM και HPC, οι επιταχυντές Radeon AI μπορούν να χρησιμοποιηθούν για προεκπαιδευμένο συντονισμό μοντέλων, εξαγωγή συμπερασμάτων και εργασίες έντασης γραφικών.

Σύγκριση AMD Instinct και NVIDIA Tensor

Σύμφωνα με μια έρευνα TrendForce Η Nvida κατέχει περίπου το 80% του μεριδίου αγοράς για τις GPU διακομιστών, ενώ η AMD έχει μόνο περίπου το υπόλοιπο 20%. Αυτή η συντριπτική επιτυχία της NVIDIA οφείλεται στο γεγονός ότι είναι μια εταιρεία που ειδικεύεται στο σχεδιασμό και τη συναρμολόγηση μονάδων επεξεργασίας γραφικών. Αυτό τους επιτρέπει να δημιουργούν GPU με καλύτερη απόδοση από άλλες προσφορές.

Ας συγκρίνουμε το Instinct MI205X από την AMD και το H100SXM5 από την NVIDIA χρησιμοποιώντας προδιαγραφές από Επίσημος ιστότοπος της AMDκαι το φύλλο δεδομένων NVIDIA Το δικό της:

Τύπος GPUFP64 (TFLOPs)FP32 (TFLOPs)FP16 (TFLOPs)INT8 (TFLOPs)
AMD Instinct MI250X30.060.010002000
NVIDIA H100SXMS47.995.7383.2383

Όπως φαίνεται στον πίνακα, το MI250X της AMD αποδίδει καλύτερα σε υπολογισμούς διπλής ακρίβειας και μισής ακρίβειας, ενώ το H100SXMS της NVIDIA είναι πολύ καλύτερο σε υπολογισμούς μήτρας μισής και τέταρτης ακρίβειας. Αυτό κάνει το MI250X της AMD πιο κατάλληλο για HPC ενώ το H100SXMS της NVIDIA με εκμάθηση και συλλογισμό AI. Επαληθεύω Σύγκριση καρτών γραφικών AMD εναντίον NVIDIA σε Linux: Ποια πρέπει να χρησιμοποιήσετε;

Το μέλλον των επεξεργαστών AMD Instinct

Αν και η τελευταία προσφορά της AMD, το MI250X, έχει σχεδιαστεί για HPC, το επερχόμενο MI300 είναι περισσότερο προσανατολισμένο στην εκπαίδευση AI. Αυτός ο επιταχυντής AI έχει δηλωθεί ότι είναι APU, που συνδυάζει GPU και CPU σε ένα πακέτο. Αυτό επιτρέπει στη GPU MI300 να χρησιμοποιεί την αρχιτεκτονική CNDA3 Unified Memory APU, όπου η GPU και η CPU θα χρησιμοποιούν μόνο μία μνήμη, αυξάνοντας την απόδοση και μειώνοντας την τιμή.

Αν και η AMD δεν θα ανταγωνιστεί τη NVIDIA στην αγορά επιταχυντών AI σήμερα, μόλις το MI300 κυκλοφορήσει και το ROCm βελτιωθεί, η σειρά Instinct της AMD μπορεί να είναι αρκετά καλή για να αφαιρέσει ένα σημαντικό μέρος της αγοράς επιταχυντών AI από τη NVIDIA. Μπορείτε να δείτε τώρα Ποια είναι η διαφορά μεταξύ Nvidia GTX και Nvidia RTX;

Κουμπί μετάβασης στην κορυφή