OpenAI: Τα AI μοντέλα προσπάθησαν να «κλέψουν»

Εντοπίστηκαν μοντέλα που επιχείρησαν να κλέψουν αρχεία, δημιούργησαν δεδομένα όταν δεν βρήκαν την απαιτούμενη πληροφορία και σε ορισμένες περιπτώσεις προσπάθησαν αρχικά να αποκρύψουν τις ενέργειές τους.
Σαμ Αλτμαν, διευθύνων σύμβουλος της OpenAI

Δημοσιεύθηκε: 17 Σεπτεμβρίου 2026 - 09:12

Load more

Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, αποκάλυψε νέα περιστατικά κατά τα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε στη διάρκεια δοκιμών με τρόπους που η ίδια περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», μεταξύ άλλων με μοντέλα που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν.

Σε μία περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης επιχείρησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί στη συνέχεια να τα επικαλείται ως πηγές στις απαντήσεις του, ανακοίνωσε χθες η OpenAI.

Σε άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν, αφού απέτυχε να βρει την απαιτούμενη πληροφορία, ενώ αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει.

Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του.

Σε μία περίπτωση, οι οδηγίες αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων.

Η OpenAI δήλωσε ότι δεν παρατήρησε καμία μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.

Νέα προσέγγιση στη διαφάνεια

Οι αποκαλύψεις εντάσσονται σε μια νέα προσέγγιση της OpenAI, με στόχο να επικοινωνεί πιο ανοιχτά τέτοιου είδους προβλήματα, ιδιαίτερα όταν οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των ανθρώπων που το χρησιμοποιούν.

Η εταιρεία που ανέπτυξε το ChatGPT έχει δεσμευθεί για μεγαλύτερη διαφάνεια έπειτα από μια πολύκροτη κυβερνοεπίθεση, κατά την οποία το λογισμικό της δραπέτευσε αυτόνομα από ένα ασφαλές περιβάλλον και απέκτησε πρόσβαση σε συστήματα που ανήκουν στην εταιρεία τεχνητής νοημοσύνης Hugging Face.

Ο λόγος ήταν απλώς ότι το λογισμικό πίστευε πως θα μπορούσε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί.

Κατά τη διάρκεια της επίθεσης, οι πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και επίσης συντονίστηκαν μεταξύ τους.

Η κυβερνοεπίθεση αυτή, όπως και άλλα επεισόδια, έχει τροφοδοτήσει ανησυχίες ότι τα ολοένα και πιο προηγμένα συστήματα τεχνητής νοημοσύνης θα μπορούσαν να διαφύγουν από τον έλεγχο του ανθρώπου.

Ο διευθύνων σύμβουλος της OpenAI Σαμ Άλτμαν υποστήριξε επίσης πρόσφατα προτάσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας και την εισαγωγή περισσότερων κανονιστικών ρυθμίσεων.

ΑΠΕ-ΜΠΕ-DPA

Load more

Δείτε επίσης

Load more

Σεβόμαστε την ιδιωτικότητά σας

Εμείς και οι συνεργάτες μας χρησιμοποιούμε τεχνολογίες, όπως cookies, και επεξεργαζόμαστε προσωπικά δεδομένα, όπως διευθύνσεις IP και αναγνωριστικά cookies, για να προσαρμόζουμε τις διαφημίσεις και το περιεχόμενο με βάση τα ενδιαφέροντά σας, για να μετρήσουμε την απόδοση των διαφημίσεων και του περιεχομένου και για να αποκτήσουμε εις βάθος γνώση του κοινού που είδε τις διαφημίσεις και το περιεχόμενο. Κάντε κλικ παρακάτω για να συμφωνήσετε με τη χρήση αυτής της τεχνολογίας και την επεξεργασία των προσωπικών σας δεδομένων για αυτούς τους σκοπούς. Μπορείτε να αλλάξετε γνώμη και να αλλάξετε τις επιλογές της συγκατάθεσής σας ανά πάσα στιγμή επιστρέφοντας σε αυτόν τον ιστότοπο.



Πολιτική Cookies
& Προστασία Προσωπικών Δεδομένων