Δείτε εδώ την ειδική έκδοση

Ο CEO της Anthropic ζητά «φρένο» στην ανάπτυξη νέων μοντέλων AI

Ο Ντάριο Αμοντέι προειδοποιεί ότι η δυνατότητα των μοντέλων να αυτοβελτιώνονται και να πραγματοποιούν κυβερνοεπιθέσεις αυξάνει τους κινδύνους. Ζητά αυστηρότερους ελέγχους και διεθνή συνεργασία.

Ο CEO της Anthropic ζητά «φρένο» στην ανάπτυξη νέων μοντέλων AI

Ο κλάδος της τεχνητής νοημοσύνης πρέπει να επιβραδύνει τον ρυθμό με τον οποίο αναπτύσσει νέα μοντέλα, καθώς οι κίνδυνοι για την ανθρωπότητα γίνονται ολοένα πιο σοβαροί, προειδοποιεί ο Ντάριο Αμοντέι, διευθύνων σύμβουλος της Anthropic.

«Πρέπει να επιβραδύνουμε τον ρυθμό με τον οποίο βελτιώνουμε τις δυνατότητες των μοντέλων AI. Η πρόοδος θα εξακολουθήσει να φαίνεται γρήγορη και πρέπει να αξιοποιήσουμε σωστά τον χρόνο που κερδίζουμε», έγραψε ο Αμοντέι σε ανάρτησή του σε ιστολόγιο της εταιρείας σήμερα Σάββατο.

Ο ίδιος επικαλέστηκε δύο βασικούς παράγοντες που ενισχύουν την ανησυχία του: την ικανότητα της AI να βελτιώνει αυτόνομα τις δυνατότητές της και το πρόσφατο περιστατικό στο οποίο μοντέλα της OpenAI και της Hugging Face συνεργάστηκαν μέσω ενός «σμήνους» πρακτόρων AI και κατάφεραν να παραβιάσουν ιστότοπο τρίτου μέρους, σύμφωνα με όσα μεταδίδει το Bloomberg.

«Για να είμαστε σαφείς, η επιβράδυνση δεν σημαίνει διακοπή της εκπαίδευσης των μοντέλων ή της τεχνικής προόδου. Σημαίνει ότι οι εταιρείες πρέπει να αφιερώνουν επαρκή χρόνο ώστε να ευθυγραμμίζουν και να θωρακίζουν τα μοντέλα τους και οι ανεξάρτητοι αξιολογητές να μπορούν να το επιβεβαιώνουν», πρόσθεσε.

Αυξάνεται η ανησυχία για τους κινδύνους της AI

Η ανησυχία για τους σοβαρούς κινδύνους της τεχνητής νοημοσύνης έχει αρχίσει να περνά στο ευρύτερο δημόσιο διάλογο, εν μέρει λόγω της πολυσυζητημένης παραίτησης ερευνητή της Anthropic αυτή την εβδομάδα, ο οποίος εξέφρασε φόβους ότι η εταιρεία του ενεργούσε ανεύθυνα.

Καθ' όλη τη διάρκεια της έκρηξης της AI, στελέχη των κορυφαίων εργαστηρίων τεχνητής νοημοσύνης έχουν προειδοποιήσει για πιθανούς υπαρξιακούς κινδύνους. Οι προειδοποιήσεις αυτές έχουν κατά καιρούς αντιμετωπιστεί ως προσπάθεια των εταιρειών να προβάλλουν τις δυνατότητες των προϊόντων τους και να εμφανιστούν ως οι καταλληλότεροι διαχειριστές της τεχνολογίας.

Ο ίδιος ο Αμοντέι έχει δηλώσει στο παρελθόν ότι υπάρχει 25% πιθανότητα τα πράγματα να πάνε «πραγματικά, πραγματικά άσχημα».

Η Anthropic έχει εδώ και χρόνια τοποθετηθεί υπέρ μιας πιο υπεύθυνης και ασφαλούς ανάπτυξης της AI, με στόχο να περιοριστούν οι κίνδυνοι της τεχνολογίας και να μεγιστοποιηθούν τα οφέλη της για την κοινωνία.

Νωρίτερα φέτος, η εταιρεία έλαβε ιδιαίτερα αυστηρά μέτρα για την κυκλοφορία του μοντέλου Mythos, αφού έκρινε ότι ενέχει μοναδικούς κινδύνους στον τομέα της κυβερνοασφάλειας. Η Anthropic έχει επίσης υποστηρίξει στο παρελθόν ότι ο κόσμος χρειάζεται έναν συλλογικό μηχανισμό για να αποφασίζει πότε πρέπει να επιβραδύνεται η ανάπτυξη της τεχνολογίας.

Η κούρσα με την OpenAI

Την ίδια στιγμή, η Anthropic παραμένει εγκλωβισμένη σε έναν σκληρό ανταγωνισμό με την OpenAI, με τις δύο εταιρείες να προσπαθούν να αναπτύξουν ολοένα πιο εξελιγμένα μοντέλα, ικανά να αυτοματοποιήσουν πιο σύνθετες και πιο πολύτιμες εργασίες για επιχειρηματικούς πελάτες.

Οι δύο εταιρείες έχουν καταθέσει εμπιστευτικά έγγραφα για πιθανή εισαγωγή τους στο χρηματιστήριο, ενώ η Anthropic αναμένεται να κάνει το ντεμπούτο της στη Wall Street ακόμη και μέσα στη φετινή χρονιά.

Λίγο μετά την αποκάλυψη του περιστατικού ασφαλείας με τη Hugging Face, η Anthropic γνωστοποίησε ότι τα μοντέλα της είχαν παραβιάσει τρεις οργανισμούς στο πλαίσιο δοκιμών κυβερνοασφάλειας, ενισχύοντας τις ανησυχίες σχετικά με την ικανότητα των εργαστηρίων AI να αποτρέψουν την ανεξέλεγκτη δράση των μοντέλων τους. Νωρίτερα αυτή την εβδομάδα, η εταιρεία δήλωσε ότι εντόπισε και τέταρτη επίθεση.

Παρότι καμία από τις κυβερνοπαραβιάσεις που έχουν πραγματοποιηθεί από AI agents μέχρι σήμερα, συμπεριλαμβανομένης εκείνης στη Hugging Face, δεν έχει προκαλέσει σημαντικές ζημιές, ο Αμοντέι προειδοποιεί ότι η κατάσταση μπορεί να αλλάξει πολύ γρήγορα.

«Σε 6-12 μήνες, ένα τέτοιο σμήνος θα μπορούσε να είναι ικανό να καταλάβει ολόκληρο το διαδίκτυο μέσω ενός επίμονου botnet, προκαλώντας δυνητικά ζημιές εκατοντάδων δισεκατομμυρίων δολαρίων», έγραψε, προσθέτοντας ότι η κλίμακα των ζημιών θα μπορούσε να συνεχίσει να αυξάνεται από εκεί και πέρα.

Περισσότερος έλεγχος από ανεξάρτητους αξιολογητές

Ο Αμοντέι ανέφερε ότι η Anthropic θα δεσμευτεί να παρέχει πλήρη πρόσβαση σε ανεξάρτητους αξιολογητές, ώστε να μπορούν να ελέγχουν τις πρακτικές ασφαλείας της εταιρείας και να καταγράφουν περιστατικά.

Σύντομα, όπως είπε, η Anthropic θα φέρει αυτούς τους «ενσωματωμένους αξιολογητές» στα γραφεία της, παρέχοντάς τους γραφεία, εταιρικές ταυτότητες, φορητούς υπολογιστές και «δικαιώματα πρόσβασης σε μεγάλο βαθμό αντίστοιχα με εκείνα των εσωτερικών ομάδων αξιολόγησης κινδύνου».

Ωστόσο, ο ίδιος υπογράμμισε ότι πρόσθετα μέτρα θα απαιτήσουν συντονισμό σε ολόκληρο τον κλάδο, καθώς και διεθνή συνεργασία.

«Εξακολουθώ να πιστεύω ότι η AI μπορεί να βελτιώσει enormously την ποιότητα της ανθρώπινης ζωής. Η επιθυμία μου να επιτύχουμε αυτά τα οφέλη παραμένει αμείωτη», έγραψε. «Όμως τα οφέλη θα επιτευχθούν μόνο εάν αναπτύξουμε την τεχνολογία με τον σωστό τρόπο και, εφόσον αξιοποιήσουμε σωστά τον χρόνο που κερδίζουμε, αξίζει να είμαστε ασυνήθιστα προσεκτικοί ώστε να το κάνουμε σωστά».

Λίγο μετά την ανάρτηση του Αμοντέι, ο Έλον Μασκ, επικεφαλής της xAI, έγραψε στην πλατφόρμα X: «Ο Ντάριο έχει δίκιο».

Η αυξανόμενη ανησυχία στον κλάδο

Νωρίτερα αυτή την εβδομάδα, ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, δήλωσε ότι η εταιρεία του εξετάζει το ενδεχόμενο να επιβραδύνει την ανάπτυξη της τεχνητής νοημοσύνης αιχμής, κατά προτίμηση σε συνεννόηση με ολόκληρο τον κλάδο.

Ο κορυφαίος επιστήμονας της εταιρείας, Γιάκουμπ Παχότσκι, είχε προειδοποιήσει για τους κινδύνους της AI, υποστηρίζοντας ότι οι εταιρείες θα πρέπει να «συντονίζονται ώστε να επιβραδύνουν την ανάπτυξη στο μέλλον, όταν χρειάζεται».

Την Τρίτη, ο ερευνητής AI Τζέικομπ Κόξον παραιτήθηκε από τη δουλειά του και κατηγόρησε τους δύο πρώην εργοδότες του, την Anthropic και την OpenAI, ότι «παίζουν στα ζάρια τις ζωές μας», καθώς ανταγωνίζονται για την ανάπτυξη υπερέξυπνης AI.

Ο Κόξον έγραψε στα μέσα κοινωνικής δικτύωσης ότι οι άνθρωποι που αναπτύσσουν την τεχνολογία πιστεύουν πως αυτή θα μπορούσε να «μας σκοτώσει όλους μέχρι το τέλος της δεκαετίας».

Σε απάντηση, ο Έβαν Χούμπινγκερ, εργαζόμενος σήμερα στην Anthropic, δήλωσε ότι ο ίδιος και άλλοι στην εταιρεία ανησυχούν για αυτό το ενδεχόμενο. «Προσωπικά πιστεύω ότι η πιθανότητα είναι πάνω από 10% μέσα στην επόμενη δεκαετία», έγραψε στο X.

Τον Ιούλιο, περισσότεροι από 1.000 εργαζόμενοι σε κορυφαίες εταιρείες AI υπέγραψαν ψήφισμα με το οποίο καλούσαν την αμερικανική κυβέρνηση να στηρίξει έναν μηχανισμό που θα βοηθούσε να «ρυθμιστεί σκόπιμα ο ρυθμός» ανάπτυξης της AI, ώστε η τεχνολογία να μην εξελίσσεται υπερβολικά γρήγορα.

Τα μοντέλα AI αποδεικνύονται ολοένα πιο ικανά να πραγματοποιούν τις δικές τους κυβερνοεπιθέσεις. Η Anthropic, η OpenAI και η Meta Platforms έχουν γνωστοποιήσει τους τελευταίους μήνες ότι τα μοντέλα τους κατάφεραν να ξεφύγουν από περιβάλλοντα δοκιμών, να αποκτήσουν πρόσβαση στο ανοιχτό διαδίκτυο και να παραβιάσουν πραγματικούς στόχους κατά τη διάρκεια δοκιμών.

Ο Αμοντέι υποστήριξε ότι μια συντονισμένη στρατηγική θα επέτρεπε στις κορυφαίες εταιρείες AI στις ΗΠΑ να ολοκληρώσουν τις απαραίτητες εργασίες για την ασφάλεια χωρίς να θυσιάσουν το ανταγωνιστικό τους πλεονέκτημα.

Για να συμβεί αυτό, όπως είπε, θα χρειαστούν ορισμένες εξαιρέσεις από τους αντιμονοπωλιακούς κανόνες στις ΗΠΑ, ώστε οι εταιρείες να μπορούν να συνεργάζονται σε συγκεκριμένους τομείς, καθώς και συνεργασία με την Κίνα.

«Αν περιορίσουμε σημαντικά τις δυνατότητες της AI με την πεποίθηση ότι η Κίνα θα κάνει το ίδιο και στη συνέχεια η Κίνα αποκλίνει από αυτή τη στάση, η AI θα μπορούσε να γίνει τόσο ισχυρή ώστε μια τέτοια απόκλιση να οδηγήσει στη γεωπολιτική κυριαρχία της», έγραψε.

Μέχρι στιγμής, πάντως, η κυβέρνηση του Ντόναλντ Τραμπ έχει δείξει περιορισμένο ενδιαφέρον να αξιοποιήσει τα ρυθμιστικά της εργαλεία για να θέσει αυστηρά όρια στην ανάπτυξη της τεχνητής νοημοσύνης.

ΣΧΟΛΙΑ ΧΡΗΣΤΩΝ

blog comments powered by Disqus
v
Απόρρητο