Ένα νέο σύστημα υπολογιστικής επιτάχυνσης για εφαρμογές τεχνητής νοημοσύνης παρουσίασε η Cerebras Systems, υποστηρίζοντας ότι το CS-4 μπορεί να προσφέρει έως και 30 φορές υψηλότερη ταχύτητα από λύσεις που βασίζονται σε GPU σε συγκεκριμένες δοκιμές.
Το CS-4 είναι ένα σύστημα κλίμακας rack που συνδυάζει τρεις επεξεργαστές Wafer Scale Engine 3 Turbo. Αντί να κόβει ένα wafer πυριτίου σε εκατοντάδες μικρά chips, η αρχιτεκτονική της Cerebras αξιοποιεί έναν ενιαίο, εξαιρετικά μεγάλο επεξεργαστή. Στόχος είναι να μειωθούν οι καθυστερήσεις και τα σημεία συμφόρησης που δημιουργούνται όταν μεγάλα μοντέλα πρέπει να μοιράζονται σε πολλούς επιταχυντές.
Σύμφωνα με τα τεχνικά στοιχεία της εταιρείας, το CS-4 αποδίδει 750 petaflops υπολογιστικής ισχύος για AI, διαθέτει 7,2 terabits ανά δευτερόλεπτο σε διασυνδέσεις εισόδου και εξόδου και φθάνει τα 129,6 petabytes ανά δευτερόλεπτο σε εύρος ζώνης μνήμης. Η Cerebras αναφέρει επίσης ότι η νέα πλατφόρμα μπορεί να υποστηρίξει συστοιχίες για μοντέλα άνω των 50 τρισ. παραμέτρων.
Η εταιρεία δημοσίευσε συγκριτική μέτρηση στο μοντέλο GPT-OSS-120B, όπου το CS-4 φέρεται να ξεπερνά τα 4.400 tokens ανά δευτερόλεπτο για κάθε χρήστη. Πρόκειται για ισχυρισμούς του κατασκευαστή και η πραγματική απόδοση θα πρέπει να αξιολογηθεί ανεξάρτητα σε διαφορετικά μοντέλα, φορτία και συνθήκες λειτουργίας.
Η ταχύτητα στην παραγωγή απαντήσεων αποκτά ιδιαίτερη σημασία για συστήματα πρακτόρων τεχνητής νοημοσύνης. Όσο μειώνεται ο χρόνος κάθε υπολογιστικού βήματος, τόσο περισσότερος χώρος υπάρχει για επαλήθευση, χρήση εργαλείων και σύνθετη συλλογιστική χωρίς μεγάλες καθυστερήσεις για τον τελικό χρήστη.
Το CS-4 εισέρχεται σε μια αγορά όπου η Nvidia παραμένει κυρίαρχη, ενώ πολλοί κατασκευαστές αναζητούν εναλλακτικές αρχιτεκτονικές για να αντιμετωπίσουν το κόστος και την ενεργειακή κατανάλωση των μεγάλων μοντέλων. Η εμπορική επιτυχία θα εξαρτηθεί όχι μόνο από τις κορυφαίες επιδόσεις, αλλά και από τη διαθεσιμότητα, το λογισμικό, την αξιοπιστία και το συνολικό κόστος λειτουργίας.



