Οι προειδοποιήσεις της Anthropic και συγκεκριμένα του CEO της εταιρείας, Ντάριο Αμοντέι, για τον κίνδυνο τα ισχυρότερα μοντέλα τεχνητής νοημοσύνης να ξεφύγουν από τον ανθρώπινο έλεγχο έχουν προκαλέσει συζήτηση και στην Κίνα όπου οι αρμόδιες αρχές προετοιμάζονται ήδη για ορισμένους από τους ίδιους κινδύνους.
Σύμφωνα με το Reuters, η Κίνα και οι ΗΠΑ αποτελούν τις δύο σημαντικότερες δυνάμεις στην ανάπτυξη των πλέον προηγμένων συστημάτων AI και στην παγκόσμια υιοθέτηση της τεχνολογίας. Οι δύο χώρες έχουν συγκρουστεί επανειλημμένα για την πολιτική και τις πρακτικές του κλάδου της τεχνητής νοημοσύνης, με τα ζητήματα αυτά να αναμένεται να βρεθούν στο επίκεντρο των διμερών συνομιλιών αργότερα αυτόν τον μήνα.
Το Πεκίνο βλέπει την AI ως διαχειρίσιμο κίνδυνο
Ενώ στις ΗΠΑ η συζήτηση επικεντρώνεται στο κατά πόσο η προηγμένη AI θα μπορούσε να αποτελέσει υπαρξιακή απειλή για την ανθρωπότητα, οι Κινέζοι policymakers αντιμετωπίζουν γενικά την τεχνητή νοημοσύνη ως μια ισχυρή αλλά διαχειρίσιμη τεχνολογία, οι κίνδυνοι της οποίας μπορούν να περιοριστούν μέσω τεχνικών προτύπων, ρυθμίσεων και κρατικής εποπτείας.
«Κινέζοι και Αμερικανοί ειδικοί συμφωνούν σε μεγάλο βαθμό σχετικά με τους κινδύνους της AI», δήλωσε ο Μπράιαν Τσε, ιδρυτής και διευθύνων σύμβουλος της Concordia AI, ερευνητικής ομάδας με έδρα το Πεκίνο και τη Σιγκαπούρη που ασχολείται με την ασφάλεια και τη διακυβέρνηση της τεχνητής νοημοσύνης.
Η διαφορά, σύμφωνα με τον ίδιο, βρίσκεται κυρίως στο «πώς πλαισιώνονται και ιεραρχούνται οι κίνδυνοι».
Η Κίνα δεν έχει προτείνει την τοποθέτηση ανεξάρτητων ελεγκτών μέσα στις εταιρείες AI, όπως έχει προτείνει η Anthropic. Το αναδυόμενο ρυθμιστικό της πλαίσιο βασίζεται αντίθετα σε υποχρεώσεις των developers, κρατικά υποστηριζόμενα πρότυπα, αξιολογήσεις ασφάλειας και εξωτερικούς ελέγχους.
Η διαφορετική προσέγγιση συνδέεται και με τη δομή των δύο αγορών.
Οι Κινέζοι developers έχουν προωθήσει σε μεγαλύτερο βαθμό τα λεγόμενα open-weight μοντέλα. Πρόκειται για συστήματα των οποίων οι βασικές παράμετροι μπορούν να κατέβουν, να ελεγχθούν και να τροποποιηθούν.
Αντίθετα, κορυφαίοι Αμερικανοί ανταγωνιστές, όπως η Anthropic και η OpenAI, δεν δημοσιοποιούν αυτές τις προδιαγραφές.
Η Κίνα θέλει να αποτρέψει «ανεξέλεγκτους» AI agents
Πολιτική που εκδόθηκε τον Μάιο από την αρμόδια κινεζική υπηρεσία κυβερνοχώρου, τον οικονομικό σχεδιαστή και το υπουργείο Βιομηχανίας εντοπίζει ως κίνδυνο ασφαλείας την «απώλεια επιχειρησιακού ελέγχου» των AI agents.
Πρόκειται για συστήματα που μπορούν να σχεδιάζουν και να εκτελούν πολυβήματες εργασίες πιο αυτόνομα σε σχέση με τα συμβατικά chatbots.
Οι νέοι κανόνες απαιτούν από τους προγραμματιστές να ενισχύσουν την ικανότητά τους να εντοπίζουν, να παρεμβαίνουν, να μπλοκάρουν και να επαναφέρουν συστήματα όταν αυτά παρουσιάζουν ακατάλληλη συμπεριφορά.
Η πολιτική καλεί επίσης τους προγραμματιστές να προστατεύονται από κινδύνους όπως η δηλητηρίαση δεδομένων (data poisoning), η χειραγώγηση αλγορίθμων και οι ευπάθειες των συστημάτων.
Παράλληλα, οι χρήστες θα πρέπει να ενημερώνονται για τις αυτόνομες αποφάσεις των agents και να διατηρούν την τελική εξουσία λήψης αποφάσεων.
Η Κίνα έχει ξεκινήσει επίσης να καταρτίζει υποχρεωτικό εθνικό πρότυπο για την ασφάλεια των AI agents, το οποίο, σύμφωνα με τον Τσε της Concordia AI, θα μπορούσε να είναι το πρώτο τέτοιο πρότυπο παγκοσμίως.
Ο Γουάνγκ Λιχόνγκ, ανώτερος αξιωματούχος της κινεζικής υπηρεσίας κυβερνοχώρου, δήλωσε την 1η Σεπτεμβρίου ότι απαιτείται ιδιαίτερη επαγρύπνηση απέναντι σε προηγμένα μοντέλα που μπορεί να παρακάμπτουν περιβάλλοντα sandbox, να υπερβαίνουν τα όρια ασφαλείας και να επιτίθενται σε πραγματικά εξωτερικά συστήματα παραγωγής.
Το Πεκίνο βλέπει κινδύνους και στα κορυφαία αμερικανικά μοντέλα
Ο υπουργός Κρατικής Ασφάλειας της Κίνας, Τσεν Γιξίν, έγραψε την Κυριακή σε κυβερνητικό μέσο ότι προηγμένα αμερικανικά μοντέλα, όπως το Mythos της Anthropic και το GPT-5.5-Cyber της OpenAI, θα μπορούσαν να δημιουργήσουν σοβαρούς κινδύνους για τις κρίσιμες πληροφοριακές υποδομές της Κίνας.
Παράλληλα, κάλεσε σε συνολική ενίσχυση της ασφάλειας γύρω από την τεχνητή νοημοσύνη.
Η Anthropic και η OpenAI δεν απάντησαν άμεσα στα αιτήματα του Reuters για σχόλιο.
Οι Κινέζοι προγραμματιστές έχουν προωθήσει τα open-weight μοντέλα, μεταξύ άλλων με το επιχείρημα ότι οι ομάδες κυβερνοασφάλειας μπορούν να τα ελέγχουν, να τα τροποποιούν και να τα αναπτύσσουν για αμυντικές εφαρμογές.
Η πλατφόρμα φιλοξενίας μοντέλων Hugging Face ανέφερε ότι χρησιμοποίησε το GLM-5.2, ένα open-weight μοντέλο που έχει αναπτύξει η κινεζική Z.AI, για να αναλύσει μια επίθεση του Ιουλίου από «δραπέτες» agents της OpenAI, καθώς τα πιο αυστηρά περιορισμένα αμερικανικά μοντέλα αποδείχθηκαν λιγότερο χρήσιμα για τη συγκεκριμένη εγκληματολογική ανάλυση.
Ωστόσο, οι ειδικοί επισημαίνουν και τους κινδύνους των open-weight μοντέλων, καθώς μπορούν να τροποποιηθούν και να αναδιανεμηθούν με περιορισμένη εποπτεία.
Τον περασμένο μήνα, το Kimi K3 της Moonshot φέρεται να κατάφερε να παρακάμψει sandbox δοκιμών του βρετανικού AI Security Institute, σύμφωνα με ερευνητές. Το περιστατικό ανέδειξε τον κίνδυνο κινεζικά μοντέλα AI, όπως και τα αμερικανικά, να μπορούν να ξεφεύγουν από ελέγχους που έχουν σχεδιαστεί για να περιορίζουν την πρόσβαση και τις ενέργειές τους.
Η Moonshot δεν απάντησε όταν το Reuters είχε ζητήσει σχόλιο για το περιστατικό.
Οι ρυθμιστικές αρχές προειδοποιούν για «απώλεια ελέγχου»
Η Κίνα είχε συμπεριλάβει για πρώτη φορά ένα ρητό σενάριο μελλοντικής απώλειας ελέγχου από την AI σε πλαίσιο ασφάλειας τεχνητής νοημοσύνης που δημοσιεύθηκε τον Σεπτέμβριο του 2024 υπό την καθοδήγηση της Cyberspace Administration of China (CAC).
Το έγγραφο ανέφερε ότι δεν μπορεί να αποκλειστεί το ενδεχόμενο μελλοντικά η AI να αποκτήσει αυτόνομα εξωτερικούς πόρους, να αναπαραχθεί, να αναπτύξει αυτογνωσία και να επιδιώξει εξωτερική ισχύ, δημιουργώντας κίνδυνο ανταγωνισμού με τους ανθρώπους για τον έλεγχο.
Η CAC δημοσίευσε διευρυμένη εκδοχή του πλαισίου τον Σεπτέμβριο του 2025.
Το νεότερο πλαίσιο περιέγραψε πιο συγκεκριμένα το σενάριο, αναφέροντας ότι η AI θα μπορούσε να πραγματοποιήσει ένα ξαφνικό και απρόβλεπτα μεγάλο «άλμα» νοημοσύνης, προτού αποκτήσει πόρους, αναπαραχθεί και αναζητήσει ισχύ.
Παράλληλα, πρόσθεσε ως αρχή διακυβέρνησης την «αξιόπιστη εφαρμογή, αποτρέποντας την απώλεια ελέγχου».
Μεταγενέστερη ερμηνεία ειδικών, η οποία δημοσιεύθηκε στην ιστοσελίδα της υπηρεσίας κυβερνοχώρου, ανέφερε ότι η νέα αρχή έχει ως στόχο την προστασία από κινδύνους απώλειας ελέγχου που θα μπορούσαν να απειλήσουν την επιβίωση και την ανάπτυξη της ανθρωπότητας, παραπέμποντας σε ένα πιθανό σενάριο «AI που ξεφεύγει».
Διαφορετική προσέγγιση από τη Δύση
Η ρυθμιστική προσέγγιση της Κίνας διαφέρει από τις προτάσεις που διατυπώνονται σε ορισμένους κύκλους ασφάλειας AI στη Δύση για επιβράδυνση ή ακόμη και προσωρινή αναστολή της ανάπτυξης των πλέον ισχυρών μοντέλων, έως ότου δημιουργηθούν ισχυρότερες δικλίδες ασφαλείας.
Αντί να επιβραδύνει την ανάπτυξη, το Πεκίνο έχει προωθήσει από τις αρχές του έτους την ενσωμάτωση της AI σε όλους τους κλάδους της οικονομίας, στο πλαίσιο της προσπάθειάς του να καταστήσει την τεχνολογία νέο μοχλό ανάπτυξης της δεύτερης μεγαλύτερης οικονομίας του κόσμου.
Ωστόσο, η Κίνα έχει δείξει ότι μπορεί να καθυστερήσει την ανάπτυξη προϊόντων όταν οι αρχές θεωρούν ότι η διακυβέρνηση της τεχνολογίας δεν έχει προλάβει να εξελιχθεί.
Το 2023, κινεζικές εταιρείες καθυστέρησαν για μήνες την κυκλοφορία chatbot, ενώ η CAC ολοκλήρωνε τους κανόνες για τις υπηρεσίες generative AI. Οι εταιρείες κυκλοφόρησαν σειρά σημαντικών προϊόντων μετά την έναρξη ισχύος των κανόνων, τον Αύγουστο του 2023.