Το μυστικό τσιπ της DeepSeek που τρομάζει την Nvidia

Η κινεζική startup που «τίναξε» τη Wall Street το 2025 φτιάχνει τώρα δικό της επεξεργαστή τεχνητής νοημοσύνης, στοχεύοντας στην πλήρη ανεξαρτησία από Nvidia και Huawei

Το μυστικό τσιπ της DeepSeek που τρομάζει την Nvidia

Υπάρχει ένα σενάριο που δεν θα ήθελε να δει κανένα στέλεχος της Nvidia να επαληθεύεται, κι όμως αρχίζει να παίρνει σάρκα και οστά. Για χρόνια, η ιστορία της κινεζικής τεχνητής νοημοσύνης είχε πάντα ένα κοινό χαρακτηριστικό: όσο εντυπωσιακά κι αν ήταν τα μοντέλα, όσο κι αν ξάφνιαζαν τους αναλυτές, στο τέλος όλα κατέληγαν στην ίδια εξάρτηση —τα τσιπ της Nvidia. Ένας εξαγωγικός περιορισμός μακριά από την κατάρρευση, θα έλεγε κανείς. Αυτό όμως το «αστεράκι» δίπλα σε κάθε κινεζική επιτυχία μοιάζει να ετοιμάζεται να εξαφανιστεί, και η εταιρεία που το επιχειρεί δεν είναι κάποιος κρατικός κολοσσός, αλλά η DeepSeek —η ίδια startup που τον Ιανουάριο του 2025 προκάλεσε απώλειες ενός τρισεκατομμυρίου δολαρίων στις αμερικανικές μετοχές τεχνολογίας με ένα μοντέλο πολύ φθηνότερο από αυτά της OpenAI.

σχετικά άρθρα

What Is Nvidia? What Does Nvidia Do?| Built In

Σύμφωνα με δημοσίευμα του Reuters, που επικαλείται τρεις πηγές με γνώση του θέματος, η DeepSeek δουλεύει εδώ και περίπου έναν χρόνο, εντελώς αθόρυβα, στο δικό της τσιπ τεχνητής νοημοσύνης. Χωρίς δημόσιες αγγελίες, χωρίς παρουσιάσεις, με μια ομάδα μηχανικών σχεδίασης τσιπ που συγκροτήθηκε προσεκτικά, μακριά από τα φώτα της δημοσιότητας, ενώ όλος ο κόσμος παρακολουθούσε τις επιδόσεις των chatbot της. Όταν η είδηση βγήκε στη δημοσιότητα στις 7 Ιουλίου, η αγορά αντέδρασε άμεσα: η μετοχή της Nvidia υποχώρησε περίπου 1,6% στο πρωινό συναλλαγών. Ένα ποσοστό που μπορεί να ακούγεται μικρό, αλλά για μια εταιρεία αποτίμησης τρισεκατομμυρίων δολαρίων μεταφράζεται σε δισεκατομμύρια που εξανεμίστηκαν μέσα σε λίγα λεπτά.

Γιατί «inference» και όχι «training»

Το ενδιαφέρον στοιχείο είναι πως η DeepSeek δεν επιχειρεί να φτιάξει ένα τσιπ ικανό να εκπαιδεύσει τεράστια μοντέλα από την αρχή —κάτι που θα ήταν σχεδόν ακατόρθωτο λόγω των περιορισμών στον πιο προηγμένο εξοπλισμό κατασκευής ημιαγωγών. Αντ’ αυτού, στοχεύει σε κάτι πιο έξυπνο: ένα τσιπ inference, δηλαδή για τη φάση όπου το μοντέλο χρησιμοποιείται καθημερινά από εκατομμύρια χρήστες.

Κάθε μοντέλο τεχνητής νοημοσύνης περνά από δύο φάσεις. Η πρώτη είναι η εκπαίδευση (training), μια εξαιρετικά ακριβή διαδικασία που απαιτεί τα ισχυρότερα τσιπ του πλανήτη να λειτουργούν επί εβδομάδες ή μήνες. Εκεί η Nvidia έχει χτίσει μια σχεδόν απροσπέλαστη αυτοκρατορία, κυρίως χάρη στο CUDA, το λογισμικό οικοσύστημα στο οποίο έχουν εκπαιδευτεί σχεδόν όλοι οι ερευνητές τεχνητής νοημοσύνης παγκοσμίως. Η δεύτερη φάση είναι το inference —αυτό που συμβαίνει κάθε φορά που κάποιος πληκτρολογεί μια ερώτηση σε ένα chatbot και λαμβάνει απάντηση. Δεν χρειάζεται την ίδια ωμή ισχύ με το training, αλλά αποδοτικότητα σε μεγάλη κλίμακα, χωρίς να καίει περιουσίες σε ρεύμα και υλικό.

CUDA - Wikipedia

Το inference, μάλιστα, μεγαλώνει ραγδαία: όσο περισσότεροι χρήστες στρέφονται σε chatbot, βοηθούς κώδικα και αυτόνομους πράκτορες, τόσο γίνεται η μεγαλύτερη πηγή ζήτησης υπολογιστικής ισχύος στη βιομηχανία της τεχνητής νοημοσύνης. Δεν είναι το κομμάτι που κάνει τίτλους όταν κυκλοφορεί ένα νέο μοντέλο, αλλά είναι αυτό που κοστίζει χρήματα καθημερινά, για πάντα, όσο οι χρήστες παραμένουν ενεργοί. Και η DeepSeek, που εξυπηρετεί ήδη εκατομμύρια χρήστες, γνωρίζει καλύτερα από τον καθένα πόσο ακριβό είναι αυτό.

Μια στρατηγική που «παίζει εκεί που κερδίζει»

Αντί λοιπόν να προσπαθήσει να ξεπεράσει τη Nvidia στο πιο δύσκολο κομμάτι της αγοράς, η DeepSeek επιλέγει το πεδίο όπου η κινεζική βιομηχανία ημιαγωγών μπορεί πραγματικά να ανταγωνιστεί. Τα τσιπ inference δεν χρειάζονται τις πιο προηγμένες διαδικασίες κατασκευής· μπορούν να παραχθούν σε πιο ώριμους κόμβους παραγωγής, τους οποίους τα κινεζικά εργοστάσια μπορούν να διαχειριστούν χωρίς να χρειάζονται απαγορευμένο εξοπλισμό, όπως αυτόν της ολλανδικής ASML.

Η ιστορία πίσω από αυτή την κίνηση είναι εξίσου ενδιαφέρουσα. Το πρώτο μεγάλο μοντέλο της DeepSeek, το R1, είχε εκπαιδευτεί πάνω σε τσιπ H800 της Nvidia —μια «κινεζική» έκδοση φτιαγμένη ειδικά για να παρακάμπτει τους τότε περιορισμούς. Όταν και αυτό το τσιπ απαγορεύτηκε πλήρως από την Ουάσιγκτον, η εταιρεία στράφηκε στα τσιπ Ascend της Huawei, προσαρμόζοντας το μοντέλο V4 ειδικά γι’ αυτά. Η στροφή αυτή ήταν τόσο σημαντική που οδήγησε κινεζικές cloud εταιρείες να σπεύσουν να παραγγείλουν τσιπ Ascend 950, φοβούμενες ελλείψεις.

Το πρόβλημα είναι πως η Huawei ελέγχει ήδη περίπου το μισό της εγχώριας αγοράς τσιπ τεχνητής νοημοσύνης στην Κίνα —μια κυριαρχία που σημαίνει μόχλευση, και άρα κίνδυνο για όποιον εξαρτάται αποκλειστικά από αυτήν. Για μια εταιρεία σαν τη DeepSeek, που έχτισε τη φήμη της κάνοντας περισσότερα με λιγότερα, το να αντικαταστήσει μία εξάρτηση (Nvidia) με μία άλλη (Huawei) δεν αρκεί. Το επόμενο λογικό βήμα είναι η πλήρης ανεξαρτησία: μοντέλο και τσιπ σχεδιασμένα από την ίδια εταιρεία, βελτιστοποιημένα το ένα για το άλλο.

Ολόκληρη η κινεζική βιομηχανία κινείται προς την ίδια κατεύθυνση

Η DeepSeek δεν είναι μόνη σε αυτή την πορεία. Η Alibaba και η Baidu αναπτύσσουν ήδη δικά τους τσιπ και κερδίζουν έδαφος στην εγχώρια αγορά. Παράλληλα, πριν από λίγες εβδομάδες, η Z.ai (πρώην Zippu) ολοκλήρωσε την κατασκευή ενός γιγαντιαίου κέντρου δεδομένων ισχύος 1 gigawatt, το οποίο θα λειτουργεί αποκλειστικά με κινεζικά τσιπ —ούτε ένας επεξεργαστής Nvidia στο εσωτερικό του. Στο World AI Conference της Σαγκάης, το κυρίαρχο θέμα δεν ήταν πλέον το πώς θα φτάσουν την ισχύ ενός μεμονωμένου τσιπ Nvidia, αλλά οι λεγόμενοι «supernodes»: χιλιάδες εγχώριοι επεξεργαστές συνδεδεμένοι μεταξύ τους σε τεράστια συστήματα, ώστε ο περιορισμός στην ισχύ ενός μεμονωμένου τσιπ να γίνεται σχεδόν ασήμαντος.

Η Alibaba θα δαπανήσει 431 εκατ. δολάρια για την προώθηση της ΑΙ - Financial Report

Η λογική είναι απλή: αφού δεν μπορούν να κερδίσουν στη μάχη της ωμής ισχύος λόγω των περιορισμών, τη μεταφέρουν σε ένα άλλο πεδίο —αυτό της κλίμακας και της μηχανικής συστημάτων— όπου οι εξαγωγικοί περιορισμοί έχουν πολύ μικρότερη σημασία.

Οι επιφυλάξεις και οι αναλυτές

Δεν λείπουν όμως και οι σκεπτικιστές. Ο Richard Windsor, αναλυτής της Radio Free Mobile, σημειώνει πως ακόμη κι αν η DeepSeek καταφέρει να ολοκληρώσει το τσιπ inference, δύσκολα θα αποτελέσει σοβαρή απειλή για τη Nvidia σε παγκόσμιο επίπεδο, καθώς η εταιρεία θα δυσκολευτεί να προσελκύσει σημαντικούς πελάτες εκτός Κίνας. Η κυριαρχία της Nvidia δεν στηρίζεται μόνο στην ακατέργαστη ισχύ των τσιπ της, αλλά και σε ολόκληρο το οικοσύστημα CUDA και στην εμπιστοσύνη χιλιάδων προγραμματιστών που έχουν επενδύσει χρόνια σε αυτό.

Επιπλέον, η πραγματικότητα στο εσωτερικό της DeepSeek φαίνεται πιο σύνθετη: σύμφωνα με ορισμένα δημοσιεύματα, η εταιρεία συνεχίζει να χρησιμοποιεί τσιπ της Huawei για την εκπαίδευση μικρότερων μοντέλων, ενώ παράλληλα εξακολουθεί να στηρίζεται στη Nvidia για τα πιο ισχυρά της συστήματα. Δεν πρόκειται δηλαδή για μια απότομη ρήξη με την αμερικανική τεχνολογία, αλλά για μια σταδιακή, προσεκτική μείωση της εξάρτησης.

Αξίζει να σημειωθεί πως η τάση αυτή δεν αφορά μόνο την Κίνα. Η OpenAI παρουσίασε πρόσφατα το δικό της τσιπ inference, σε συνεργασία με τη Broadcom, ενώ ακόμη και η Anthropic φέρεται να έχει διερευνήσει την κατασκευή δικών της επεξεργαστών. Amazon και Google κάνουν το ίδιο. Κάθε μεγάλο εργαστήριο τεχνητής νοημοσύνης, αμερικανικό ή κινεζικό, επιδιώκει να ελέγξει μεγαλύτερο μέρος της υλικοτεχνικής υποδομής του, γιατί η πλήρης εξάρτηση από τη Nvidia σημαίνει ότι η ίδια ελέγχει το κόστος, την προσφορά και τελικά το ταβάνι ανάπτυξης κάθε ανταγωνιστή της.

Το διακύβευμα για τις αμερικανικές κυρώσεις

Αν η DeepSeek καταφέρει τελικά να παρουσιάσει ένα λειτουργικό τσιπ inference σε κλίμακα, έστω και ανταγωνιστικό μόνο εντός των κινεζικών συνόρων, αλλάζει ο υπολογισμός πίσω από όλη τη στρατηγική εξαγωγικών περιορισμών της Ουάσιγκτον. Ο στόχος αυτών των περιορισμών ήταν να δημιουργήσουν ένα σημείο συμφόρησης που θα ανάγκαζε τις κινεζικές εταιρείες είτε να μείνουν πίσω είτε να σπαταλούν πόρους αναζητώντας παρακάμψεις. Αν όμως εταιρείες όπως η DeepSeek, η Alibaba, η Baidu και η Huawei καταφέρουν να χτίσουν ένα αυτάρκες οικοσύστημα inference, το φύλλο πίεσης που είχε υπολογίσει η Ουάσιγκτον αρχίζει να διαβρώνεται —χωρίς αυτό να σημαίνει ότι η Κίνα κερδίζει τη μάχη του training, όπου η υπεροχή της Nvidia παραμένει, προς το παρόν, σταθερή.

Είναι ενδεικτικό πως η DeepSeek, μια εταιρεία που για χρόνια απέρριπτε κάθε εξωτερική χρηματοδότηση, φέρεται να ετοιμάζει τον πρώτο της γύρο άντλησης κεφαλαίων ύψους 7 δισεκατομμυρίων δολαρίων, με αποτίμηση μεταξύ 52 και 59 δισεκατομμυρίων δολαρίων. Η κατασκευή δικής της γραμμής τσιπ δεν είναι φθηνή υπόθεση —απαιτεί συνεργασίες με εργοστάσια κατασκευής, προμηθευτές μνήμης και σχεδιαστές τσιπ, κάτι που ξεπερνά κατά πολύ τους πόρους μιας «λιτής» startup.

Το συμπέρασμα

Η υπόθεση DeepSeek δεν αφορά ένα μεμονωμένο τσιπ που θα αλλάξει τα πάντα από τη μια μέρα στην άλλη. Αφορά μια ευρύτερη μετατόπιση νοοτροπίας σε ολόκληρη την κινεζική βιομηχανία τεχνολογίας: αντί να παλεύουν να νικήσουν τις ΗΠΑ στο δικό τους παιχνίδι, οι κινεζικές εταιρείες επιχειρούν να φτιάξουν ένα διαφορετικό παιχνίδι, όπου οι παλιοί κανόνες δεν έχουν την ίδια σημασία. Η Nvidia διατηρεί, προς το παρόν, ένα τεράστιο προβάδισμα στο training και στο λογισμικό της —ένα «χαντάκι» που καμία εταιρεία δεν μπορεί να διασχίσει μέσα σε μια νύχτα. Το έδαφος, όμως, φαίνεται να μετατοπίζεται σε μια αγορά εξίσου —αν όχι περισσότερο— σημαντική μακροπρόθεσμα: αυτή του inference. Και είναι ακριβώς αυτή η συσσώρευση μικρών, φαινομενικά διαχειρίσιμων κινήσεων που, μαζεμένες, αρχίζουν να μοιάζουν με κάτι πολύ πιο μεγάλο: ανεξαρτησία.