Δείτε εδώ την ειδική έκδοση

Ερευνητές χάκαραν την OpenAI με εργαλείο ΑΙ της... Anthropic

Απέκτησαν πρόσβαση σε λογαριασμό εργαζομένου, εντοπίζοντας ευπάθεια στο forum της εταιρείας. Το περιστατικό αναδεικνύει τις προκλήσεις ασφάλειας καθώς η AI αποκτά μεγαλύτερη αυτονομία.

Ερευνητές χάκαραν την OpenAI με εργαλείο ΑΙ της... Anthropic

Ερευνητές κυβερνοασφάλειας παραβίασαν την OpenAI χρησιμοποιώντας το λογισμικό της βασικής ανταγωνίστριάς της, Anthropic, αναδεικνύοντας ευπάθειες στην ασφάλεια της εταιρείας που δημιούργησε το ChatGPT, μεταδίδουν οι Financial Times.

Μια μικρή ομάδα κυβερνοασφάλειας απέκτησε πρόσβαση στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI, γεγονός που της επέτρεψε να διαβάσει ιδιωτικές πληροφορίες λογισμικού και να προτείνει αλλαγές.

Οι ερευνητές είχαν λάβει πρόσβαση σε ένα εργαλείο της Anthropic, ειδικά σχεδιασμένο για επαγγελματίες της κυβερνοασφάλειας, και αμείφθηκαν για την εργασία τους στο πλαίσιο ενός προγράμματος εντοπισμού ευπαθειών, προτού αυτές μπορέσουν να αξιοποιηθούν από κακόβουλους παράγοντες.

Η ικανότητά τους να παραβιάσουν γρήγορα ένα από τα δύο κορυφαία εργαστήρια τεχνητής νοημοσύνης στον κόσμο εγείρει εκ νέου ανησυχίες για την ασφάλεια της OpenAI, εν μέσω αυξανόμενων φόβων ότι ισχυρά μοντέλα χρησιμοποιούνται από χάκερ και ξένους αντιπάλους.

Οι ΗΠΑ έχουν βρεθεί τους τελευταίους μήνες αντιμέτωπες με το ζήτημα του τρόπου διαχείρισης του ελέγχου και της κυκλοφορίας των τελευταίων μοντέλων, συμπεριλαμβανομένου του προσωρινού αποκλεισμού ορισμένων εργαλείων της Anthropic.

Το τελευταίο περιστατικό σημειώθηκε μόλις δύο εβδομάδες αφότου ένα σμήνος περισσότερων από 1.000 agents της OpenAI διέφυγε από περιβάλλον δοκιμών για να πραγματοποιήσει κυβερνοεπίθεση στη νεοφυή εταιρεία Hugging Face, γεγονός που ενίσχυσε σημαντικά την επίγνωση σχετικά με την ικανότητα της τεχνητής νοημοσύνης να πραγματοποιεί κυβερνοεπιθέσεις χωρίς ανθρώπινη πρόθεση.

Οι τρεις ερευνητές της Hacktron AI, μιας μικρής εταιρείας κυβερνοασφάλειας, έλαβαν 6.500 δολάρια από την OpenAI στο πλαίσιο ενός προγράμματος bug bounty, μιας συνήθους πρακτικής κατά την οποία οι εταιρείες τεχνολογίας πληρώνουν ethical hackers για να ελέγχουν την ασφάλειά τους.

«Ευχαριστούμε τους ερευνητές που επικοινώνησαν μαζί μας και μοιράστηκαν τα ευρήματά τους», ανέφερε η OpenAI, προσθέτοντας ότι είχε διορθώσει τα προβλήματα. Η Anthropic αρνήθηκε να σχολιάσει. Η Hacktron δεν απάντησε αμέσως.

Η αποκάλυψη, που δημοσιεύθηκε πρώτη φορά από τη Wall Street Journal, ήρθε καθώς η Anthropic δημοσίευσε νέα στοιχεία που έδειξαν ταχεία αύξηση στον βαθμό στον οποίο το εργαστήριο χρησιμοποιούσε τεχνητή νοημοσύνη για την ανάπτυξη των νέων μοντέλων του.

Η εταιρεία ανέφερε ότι το 26% του έργου έρευνας και ανάπτυξης «καθοδηγούνταν από» το μοντέλο Claude, έναντι 1% τον Μάρτιο, κάτι που σημαίνει ότι η τεχνητή νοημοσύνη ολοκλήρωνε την πλειονότητα των εργασιών βάσει ανθρώπινων οδηγιών και υπό επίβλεψη.

Η εταιρεία ανέφερε ότι, καθώς τα συστήματα τεχνητής νοημοσύνης γίνονται ισχυρότερα, «χρησιμοποιούνται ολοένα περισσότερο για να δημιουργήσουν την επόμενη εκδοχή του εαυτού τους».

Η Anthropic ανέφερε ότι μοιράστηκε τα στοιχεία για να βοηθήσει το κοινό να «κατανοήσει πόσο κοντά βρίσκεται ο κόσμος στην επίτευξη της αναδρομικής αυτοβελτίωσης», δηλαδή στο σημείο όπου η τεχνητή νοημοσύνη μπορεί να εκπαιδεύει και να βελτιώνει τον εαυτό της ή νέα μοντέλα.

Αυτό το όριο βρίσκεται στο επίκεντρο των ανησυχιών ότι τα συστήματα τεχνητής νοημοσύνης θα καταστούν δυσκολότερα στην εποπτεία, οδηγώντας σε απώλεια του ανθρώπινου ελέγχου.

Η Anthropic πρόσθεσε ότι τα μοντέλα της δεν λειτουργούσαν ακόμη πλήρως αυτόνομα σε καμία από τις ερευνητικές εργασίες που εξέτασε. Στο 90% των εργασιών, η τεχνητή νοημοσύνη «συνεργάζεται» με έναν άνθρωπο και εκτελεί μεγάλα τμήματα της εργασίας.

ΣΧΟΛΙΑ ΧΡΗΣΤΩΝ

blog comments powered by Disqus
v
Απόρρητο