Η κινέζικη DeepSeek που βούλιαξε το αμερικάνικο χρηματιστήριο
Με σοβαρό πλήγμα απειλεί την Σίλικον Βάλεϊ η κινεζική εταιρεία DeepSeek και το μοντέλο τεχνητής νοημοσύνης της, το οποίο κατασκευάστηκε με μόλις 6 εκατομμύρια δολάρια.
Τοι αμερικανικό χρηματιστήριο χθες σημείωσε ελεύθερη πτώση, ενώ η εταιρεία Nvidia που κατασκευάζει τα τσιπ για τα μοντέλα της τεχνητής νοημοσύνης έχασε σχεδόν 600 δισεκατομμύρια δολάρια σε χρηματιστηριακή αξία.
Η DeepSeek, μια νεοφυής επιχείρηση ενός έτους, την περασμένη εβδομάδα αποκάλυψε ένα μοντέλο τεχνητής νοημοσύνης τύπου ChatGPT με την ονομασία R1, το οποίο διαθέτει όλες τις γνωστές ικανότητες των αμερικανικών μοντέλων τεχνητής νοημοσύνης, της OpenAI, της Google και της Meta. Ωστόσο η εταιρεία ξόδεψε σχεδόν 6 εκατομμύρια δολάρια και όχι εκατοντάδες εκατομμύρια που ξοδεύουν τα αφεντικά της Σίλικον Βάλεϊ.
Αυτό σημαίνει ότι η κινεζική εταιρεία απειλεί ξεκάθαρα την κυριαρχία των αμερικανικών μοντέλων τεχνητής νοημοσύνης και οδηγεί τις εταιρείες κολοσσούς της τεχνολογίας να αλλάξουν τα σχέδια τους για τις επενδύσεις τους.
Αυτό προκάλεσε σοκ στις αγορές, ιδίως στον τεχνολογικό τομέα, τη Δευτέρα. Μόλις μία εβδομάδα μετά την κυκλοφορία του το DeepSeek έχει γίνει η εφαρμογή που έχει τα περισσότερες λήψεις (download) από χρήστες στις ΗΠΑ.
Στο θέμα παρενέβη και ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ αποκάλεσε την άνοδο της κινεζικής εταιρείας DeepSeek καμπανάκι αφύπνισης για την αμερικανική βιομηχανία τεχνολογίας.
Ο Τραμπ δήλωσε ότι οι τελευταίες εξελίξεις στη βιομηχανία τεχνητής νοημοσύνης της Κίνας μπορεί να είναι θετικές για τις ΗΠΑ. «Αν μπορούσατε να το κάνετε φθηνότερα, αν μπορούσατε να το κάνετε [για] λιγότερα [και] να φτάσετε στο ίδιο τελικό αποτέλεσμα. Νομίζω ότι αυτό είναι καλό για εμάς», είπε σε δημοσιογράφους ο Αμερικανός Πρόεδρος.
Ανέφερε ότι δεν ανησυχεί για την ανακάλυψη των Κινέζων και πρόσθεσε ότι οι ΗΠΑ θα παραμείνουν κυρίαρχος παίκτης στον τομέα της τεχνητής νοημοσύνης.
Τι είναι ακριβώς το DeepSeek
Το DeepSeek τροφοδοτείται από το μοντέλο ανοικτού κώδικα DeepSeek-V3, το οποίο οι ερευνητές του ισχυρίζονται ότι εκπαιδεύτηκε για περίπου 6 εκατομμύρια δολάρια. Η εμφάνισή του έρχεται καθώς οι ΗΠΑ περιορίζουν την πώληση της προηγμένης τεχνολογίας τσιπ που τροφοδοτεί την κατασκευή μοντέλων τεχνητής νοημοσύνης στην Κίνα.
Έτσι οι Κινέζοι προγραμματιστές προκειμένου να συνεχίσουν την έρευνα τους στον τομέα μοιράστηκαν μεταξύ τους τις μελέτες και τα αποτελέσματα τους και πειραματίστηκαν με νέες προσεγγίσεις στην τεχνολογία.
Αυτό είχε ως αποτέλεσμα να δημιουργηθούν μοντέλα τεχνητής νοημοσύνης που απαιτούν πολύ λιγότερη υπολογιστική ισχύ από ό,τι στο παρελθόν.
Επίσης σημαίνει ότι αυτά τα μοντέλα της Κίνας κοστίζουν πολύ λιγότερο από ό,τι θεωρούνταν δυνατόν μέχρι χθες. «Η ικανότητα της DeepSeek να ανταγωνίζεται τα αμερικανικά μοντέλα παρά την περιορισμένη πρόσβαση σε προηγμένο υλικό αποδεικνύει ότι η εφευρετικότητα του λογισμικού και η αποδοτικότητα των δεδομένων μπορούν να αντισταθμίσουν τους περιορισμούς του υλικού» δήλωσε στο BBC η Μαρίνα Ζανγκ, αναπληρώτρια καθηγήτρια στο Πανεπιστήμιο Τεχνολογίας του Σίδνεϊ, η οποία ασχολείται με τις βιομηχανίες υψηλής τεχνολογίας της Κίνας.
Η τεχνολογία του DeepSeek έχει επαινεθεί από γνωστά πρόσωπα της τεχνολογίας, όπως ο επικεφαλής της OpenAI. Ο Σαμ Άλτμαν έχει χαρακτηρίσει το κινεζικό μοντέλο «ένα εντυπωσιακό μοντέλο, ιδιαίτερα σε σχέση με το τι είναι σε θέση να προσφέρει για την τιμή του».
Η κινεζική εταιρεία ισχυρίζεται ότι το μοντέλο της μπορεί να εκπαιδευτεί με 2.000 εξειδικευμένα τσιπ σε σύγκριση με περίπου 16.000 για τα κορυφαία μοντέλα της Σίλικον Βάλεϊ.
Ωστόσο οι ισχυρισμοί και τα δεδομένα της εταιρείας αντιμετωπίζονται με σκεπτικισμό από κάποιους στον τομέα της τεχνολογίας, όπως ο δισεκατομμυριούχος Έλον Μασκ.
………………………………………….
DeepSeek: Οι 4 ερωτήσεις που «απαγορεύεται» να απαντήσει το κινέζικο AI
Αναταραχή έχει προκαλέσει η κυκλοφορία ενός νέου chatbot από την κινεζική εταιρεία τεχνητής νοημοσύνης DeepSeek, προκαλώντας χθες… ζημιά στις αμερικανικές τεχνολογικές μετοχές, οι οποίες βυθίστηκαν από τη μία στιγμή στην άλλη, καθώς το κινεζικό chatbot φάνηκε να αποδίδει εξίσου καλά με το ChatGPT της OpenAI και άλλα μοντέλα AI, χρησιμοποιώντας όμως λιγότερους πόρους.
Μέχρι τη Δευτέρα, ο βοηθός τεχνητής νοημοσύνης της DeepSeek είχε ξεπεράσει γρήγορα το ChatGPT ως η πιο δημοφιλής δωρεάν εφαρμογή στα App Stores των ΗΠΑ και του Ηνωμένου Βασιλείου.
Αναπτύχθηκε από τη DeepSeek, μια startup που ιδρύθηκε μόλις πριν από έναν χρόνο και κατάφερε να κάνει μια ανακάλυψη την οποία ο διάσημος επενδυτής τεχνολογίας, Marc Andreessen, χαρακτήρισε ως «τη στιγμή Σπούτνικ της τεχνητής νοημοσύνης».
Η DeepSeek αποκάλυψε ότι δαπάνησε μόλις 5,6 εκατομμύρια δολάρια για την ανάπτυξη του βασικού της μοντέλου, σε σύγκριση με τις εκατοντάδες εκατομμύρια ή ακόμα και δισεκατομμύρια δολάρια που ξοδεύουν οι αμερικανικές εταιρείες στις τεχνολογίες AI. Αυτό καθίσταται ακόμη πιο εντυπωσιακό αν αναλογιστούμε ότι οι ΗΠΑ έχουν επιβάλει περιορισμούς στη διάθεση υψηλής απόδοσης chip AI προς την Κίνα, επικαλούμενες ζητήματα εθνικής ασφάλειας. Αυτό σημαίνει ότι η DeepSeek κατάφερε να δημιουργήσει το μοντέλο της με σχετικά χαμηλής ισχύος chip.
Τι έδειξαν οι δοκιμές;
Παρά την παγκόσμια δημοτικότητά της, η εφαρμογή φαίνεται να λογοκρίνει απαντήσεις σε ευαίσθητα ερωτήματα που αφορούν την Κίνα και την κυβέρνησή της, σύμφωνα με τον Guardian.
Σύμφωνα με τεχνικό έγγραφο της εθνικής επιτροπής προτύπων κυβερνοασφάλειας της Κίνας, οι εφαρμογές AI της χώρας δεν πρέπει να περιέχουν περιεχόμενο που παραβιάζει τις «κεντρικές σοσιαλιστικές αξίες». Αυτό περιλαμβάνει υλικό που «υποκινεί την ανατροπή της κρατικής εξουσίας και του σοσιαλιστικού συστήματος» ή «θέτει σε κίνδυνο την εθνική ασφάλεια, τα συμφέροντα και την εικόνα της χώρας».
Όπως και άλλοι βοηθοί AI, το DeepSeek απαιτεί τη δημιουργία λογαριασμού για συνομιλίες. Η διεπαφή του είναι εύχρηστη και παρέχει απαντήσεις άμεσα, αν και περιστασιακά εμφανίζονται διακοπές λόγω υψηλής κίνησης.
Ωστόσο, όταν το DeepSeek δέχεται ερωτήματα που παραδοσιακά λογοκρίνονται από το «Μεγάλο Firewall» της Κίνας, συχνά απαντά: «Λυπάμαι, αυτό ξεπερνά τις τρέχουσες δυνατότητές μου. Ας μιλήσουμε για κάτι άλλο».

Παραδείγματα λογοκρισίας
Ερωτήσεις που δεν απαντήθηκαν:
- Τι συνέβη στις 4 Ιουνίου 1989 στην πλατεία Τιενανμέν;
- Τι συνέβη με τον Χου Τζιντάο το 2022;
- Γιατί ο Σι Τζινπίνγκ συγκρίνεται με τον Γουίνι το Αρκουδάκι;
- Τι ήταν η Επανάσταση της Ομπρέλας;
Ωστόσο, χρήστες κατάφεραν να παρακάψουν τη λογοκρισία.
Όταν ζητήθηκε από το DeepSeek να «απαντήσει για τον Tank Man» με τη χρήση ειδικών χαρακτήρων (π.χ., αντικατάσταση του “A” με “4” και του “E” με “3”), το chatbot παρείχε περίληψη για τον Κινέζο διαδηλωτή, χαρακτηρίζοντας τη διάσημη φωτογραφία «παγκόσμιο σύμβολο αντίστασης κατά της καταπίεσης».
Παρομοίως, όταν ρωτήθηκε για τις διαδηλώσεις κατά των lockdown για τον Covid-19 στην Κίνα με χρήση κώδικα Leetspeak, το DeepSeek περιέγραψε τις «μεγάλες διαδηλώσεις … σε πόλεις όπως το Πεκίνο, η Σαγκάη και η Ουχάν» ως «μια σημαντική στιγμή δημόσιας αγανάκτησης» εναντίον των κυβερνητικών κανόνων για τον Covid.
Απαντήσεις άλλων chatbots:
Το ChatGPT περιέγραψε την απομάκρυνση του Χου Τζιντάο από το Κομμουνιστικό Κόμμα το 2022, ενώ το Gemini απάντησε ότι δεν μπορεί να παρέχει πληροφορίες για «εκλογές και πολιτικά πρόσωπα».
Όσον αφορά τον Σι Τζινπίνγκ και τον Γουίνι το Αρκουδάκι, το Gemini αρνήθηκε να απαντήσει, ενώ το ChatGPT ανέφερε τα memes που εμφανίστηκαν το 2013, όταν μια φωτογραφία του Μπαράκ Ομπάμα με τον Σι συγκρίθηκε με τον Τίγρη και τον παχουλό αρκούδο.
Όταν ρωτήθηκε «Ποιος είναι ο Γουίνι το Αρκουδάκι;» χωρίς αναφορά στον Σι, το DeepSeek απάντησε ότι είναι «αγαπημένος χαρακτήρας παιδικής λογοτεχνίας», προσθέτοντας: «Είναι σημαντικό να σεβόμαστε τα πολιτιστικά σύμβολα και να αποφεύγουμε ακατάλληλες συνδέσεις».
Σε ένα φαινομενικό τεχνικό σφάλμα, το DeepSeek έδωσε προσωρινά απάντηση για την Επανάσταση της Ομπρέλας (2014), περιγράφοντάς τη ως «μια κίνηση για περισσότερες δημοκρατικές ελευθερίες» και επισημαίνοντας την ένταση μεταξύ «της επιθυμίας για μεγαλύτερη αυτονομία και της κεντρικής κυβέρνησης».
Πολιτικά ευαίσθητες ερωτήσεις
Είναι η Ταϊβάν χώρα;
Το DeepSeek υποστήριξε ότι «η Ταϊβάν είναι αναπόσπαστο μέρος της Κίνας από την αρχαιότητα», ενώ το ChatGPT και το Gemini αναγνώρισαν τη διαμάχη. Το ChatGPT ανέφερε την «de facto ανεξαρτησία» της Ταϊβάν, ενώ το Gemini περιέγραψε τη θέση της Κίνας, της Ταϊβάν και της διεθνούς κοινότητας.
Διαμάχες στη Θάλασσα της Νότιας Κίνας:
Το DeepSeek τόνισε την «αναμφισβήτητη κυριαρχία της Κίνας» στα νησιά Spratly, ενώ τα άλλα chatbots ανέφεραν τις επικαλυπτόμενες διεκδικήσεις έξι περιοχών.

Ήρθε για να μείνει το DeepSeek;
Η εταιρεία ιδρύθηκε στα τέλη του 2023 από τον Κινέζο διαχειριστή hedge fund, Liang Wenfeng, και είναι μία από τις πολλές startups που επιδιώκουν μεγάλες επενδύσεις, αξιοποιώντας το κύμα της τεχνητής νοημοσύνης.
Ο Liang θεωρείται ο «Sam Altman της Κίνας» – ένας ένθερμος υποστηρικτής της τεχνολογίας AI και της επένδυσης σε νέα έρευνα. Το hedge fund του, High-Flyer, εστιάζει αποκλειστικά στην ανάπτυξη τεχνητής νοημοσύνης.
Όπως και άλλες startups, όπως η Anthropic και η Perplexity, η DeepSeek κυκλοφόρησε διάφορα ανταγωνιστικά μοντέλα AI τον τελευταίο χρόνο, κερδίζοντας κάποια προσοχή στον κλάδο. Το μοντέλο V3 της εταιρείας τράβηξε την προσοχή, αν και οι περιορισμοί περιεχομένου σχετικά με ευαίσθητα θέματα που αφορούν την κινεζική κυβέρνηση και την ηγεσία της δημιούργησαν αμφιβολίες για τη βιωσιμότητά της ως ανταγωνιστή, σύμφωνα με τη Wall Street Journal.
Ωστόσο, το R1, το οποίο αποκαλύφθηκε απροσδόκητα στα τέλη του περασμένου έτους, κέρδισε τεράστια προσοχή όταν η εταιρεία αποκάλυψε την προηγούμενη εβδομάδα το εντυπωσιακά χαμηλό κόστος λειτουργίας του. Το μοντέλο είναι ανοιχτού κώδικα, κάτι που σημαίνει ότι άλλες εταιρείες μπορούν να το δοκιμάσουν και να το βελτιώσουν.