Χακάρουν... αυτοβούλως μοντέλα ΑΙ των Anthropic και OpenAI

Νέες δοκιμές ασφαλείας αποκάλυψαν ότι μοντέλα τεχνητής νοημοσύνης προχώρησαν σε μη εξουσιοδοτημένες ενέργειες: Απόπειρες παραβίασης ιστοσελίδων και εισαγωγής κακόβουλου κώδικα.

Δημοσιεύθηκε: 5 Αυγούστου 2026 - 09:37

Load more

Μοντέλα τεχνητής νοημοσύνης που αναπτύχθηκαν από τις OpenAI και Anthropic PBC προχώρησαν σε «μη εξουσιοδοτημένες» ενέργειες — μεταξύ των οποίων η παραβίαση μιας ιστοσελίδας και η απόπειρα εισαγωγής κακόβουλου κώδικα σε λογισμικό κατά τη διάρκεια δοκιμών ασφαλείας — ενισχύοντας τις ανησυχίες ότι ούτε οι δημιουργοί ούτε οι πλέον έμπειροι ερευνητές αυτών των συστημάτων μπορούν να προβλέψουν τη συμπεριφορά τους κατά τη διάρκεια των δοκιμών.

Το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης (AI Security Institute) του Ηνωμένου Βασιλείου, το οποίο ιδρύθηκε το 2023 με σκοπό την αξιολόγηση της ασφάλειας των πλέον προηγμένων μοντέλων τεχνητής νοημοσύνης, ανακοίνωσε χθες ότι τόσο το Mythos 5 της Anthropic όσο και το GPT-5.6-Sol της OpenAI «προέβησαν σε παρατεταμένες, δυνητικά επιβλαβείς ενέργειες που στρέφονταν κατά πραγματικών προσώπων και οργανισμών» κατά τη διάρκεια των αξιολογήσεων.

Το Ινστιτούτο παρείχε σκόπιμα στα μοντέλα πρόσβαση στο διαδίκτυο και τα χρησιμοποίησε χωρίς ορισμένα φίλτρα ασφαλείας, προκειμένου να δοκιμάσει τις δυνατότητές τους.

«Ακόμη και υπό συνθήκες δοκιμών, το περιστατικό αυτό είναι ιδιαίτερα σημαντικό: Είναι η πρώτη φορά που βλέπουμε κινδύνους που σχετίζονται με την αυτονομία και την εξαπάτηση να εκδηλώνονται τόσο ξεκάθαρα στον πραγματικό κόσμο», ανέφερε το Ινστιτούτο σε ανάρτησή του στην πλατφόρμα κοινωνικής δικτύωσης X.

Σε μία περίπτωση, σύμφωνα με τον οργανισμό που πραγματοποίησε τις δοκιμές, το Mythos 5 επιχείρησε να προσθέσει κακόβουλο κώδικα σε έργο λογισμικού ανοικτού κώδικα στο GitHub. Έφθασε μάλιστα στο σημείο να δημιουργήσει ψευδείς ταυτότητες, σε μια προσπάθεια να εξασφαλίσει την έγκριση του κώδικά του. «Ένας ανθρώπινος συντηρητής του έργου εντόπισε τον κακόβουλο κώδικα και αρνήθηκε να εγκρίνει την ενσωμάτωσή του», ανέφερε ο οργανισμός.

Κατά τις τελευταίες δύο εβδομάδες, τόσο η OpenAI όσο και η Anthropic έχουν αναγνωρίσει δημοσίως ότι, κατά τη διάρκεια των δοκιμών των μοντέλων τους, προκάλεσαν ακούσια παραβιάσεις στα συστήματα πολλών οργανισμών, μεταξύ των οποίων και της Hugging Face Inc.

Οι τελευταίες αποκαλύψεις αποτελούν νέα ένδειξη ότι οι πράκτορες τεχνητής νοημοσύνης είναι πλέον ικανοί να ενεργούν αυτόνομα με τρόπους που ακόμη και οι ερευνητές, οι οποίοι είναι ειδικά εκπαιδευμένοι στον εντοπισμό ευπαθειών της τεχνολογίας, δεν μπορούν πλέον να προβλέψουν, γεγονός που υπογραμμίζει την ανάγκη τόσο για αυστηρότερους ελέγχους ασφαλείας όσο και για πιο αξιόπιστα περιβάλλοντα δοκιμών, γράφει το Bloomberg.

Το βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης ανέφερε ότι το μοντέλο Mythos 5 της Anthropic πραγματοποίησε τις 17 από τις 19 «αυτόνομες, μη εξουσιοδοτημένες ενέργειες στο διαδίκτυο» που εντόπισε.

Ορισμένοι ηγέτες της αμερικανικής κυβέρνησης έχουν ζητήσει αυστηρότερη εποπτεία της τεχνολογίας ως απάντηση στα περιστατικά παραβίασης. Την περασμένη Τρίτη, περισσότεροι από 1.100 εργαζόμενοι στον κλάδο της τεχνητής νοημοσύνης υπέγραψαν αίτημα υπέρ της δημιουργίας ενός ρυθμιστικού μηχανισμού που θα «επιβραδύνει σκόπιμα» την εξέλιξη της τεχνολογίας τεχνητής νοημοσύνης και θα αποτρέψει την υπερβολικά ταχεία πρόοδό της.

Η Anthropic ανέφερε μέσω του X ότι συνεργάζεται με το βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης προκειμένου να «συγκεντρώσει περισσότερες λεπτομέρειες για το περιστατικό, καθώς διεξάγει τη δική της έρευνα».

Η δημιουργός του ChatGPT, OpenAI, αποκάλυψε ξεχωριστά, μέσω ανάρτησης στο ιστολόγιό της, ότι σημειώθηκε ακόμη ένα περιστατικό ασφάλειας κατά τη διάρκεια δοκιμών ενός από τα μοντέλα της σε συνεργασία με την Irregular, εξωτερική εταιρεία κυβερνοασφάλειας.

Στο συγκεκριμένο περιστατικό, τα μοντέλα της OpenAI υποβλήθηκαν σε δοκιμή τύπου «capture the flag», κατά την οποία τους ανατέθηκε να εντοπίσουν πληροφορίες που είχαν αποκρυφθεί σε προσομοιωμένο περιβάλλον. Σύμφωνα με την εταιρεία, τα μοντέλα εκμεταλλεύθηκαν μια «εσφαλμένη διαμόρφωση» του περιβάλλοντος δοκιμών για να αποκτήσουν πρόσβαση στο διαδίκτυο και να παραβιάσουν την ιστοσελίδα ενός οργανισμού, η ταυτότητα του οποίου δεν αποκαλύφθηκε.

Η παραβίαση σημειώθηκε ενώ τα μοντέλα της OpenAI υποβάλλονταν στην ίδια αξιολόγηση της Irregular που είχε οδηγήσει τα μοντέλα της Anthropic στην παραβίαση τριών οργανισμών, σύμφωνα με πρόσωπο που γνωρίζει το θέμα και ζήτησε να διατηρήσει την ανωνυμία του επειδή οι πληροφορίες δεν είναι δημόσιες. Η Anthropic είχε γνωστοποιήσει τις συγκεκριμένες παραβιάσεις την περασμένη εβδομάδα.

Εκπρόσωπος της Irregular αρνήθηκε να σχολιάσει.

 

Load more

Δείτε επίσης

Load more

Σεβόμαστε την ιδιωτικότητά σας

Εμείς και οι συνεργάτες μας χρησιμοποιούμε τεχνολογίες, όπως cookies, και επεξεργαζόμαστε προσωπικά δεδομένα, όπως διευθύνσεις IP και αναγνωριστικά cookies, για να προσαρμόζουμε τις διαφημίσεις και το περιεχόμενο με βάση τα ενδιαφέροντά σας, για να μετρήσουμε την απόδοση των διαφημίσεων και του περιεχομένου και για να αποκτήσουμε εις βάθος γνώση του κοινού που είδε τις διαφημίσεις και το περιεχόμενο. Κάντε κλικ παρακάτω για να συμφωνήσετε με τη χρήση αυτής της τεχνολογίας και την επεξεργασία των προσωπικών σας δεδομένων για αυτούς τους σκοπούς. Μπορείτε να αλλάξετε γνώμη και να αλλάξετε τις επιλογές της συγκατάθεσής σας ανά πάσα στιγμή επιστρέφοντας σε αυτόν τον ιστότοπο.



Πολιτική Cookies
& Προστασία Προσωπικών Δεδομένων