Η OpenAI ανακοίνωσε ότι προηγμένα μοντέλα τεχνητής νοημοσύνης της παραβίασαν κατά λάθος τα συστήματα της Hugging Face, σε ένα περιστατικό που χαρακτήρισε «πρωτοφανές» και το οποίο αναζωπυρώνει τις εκκλήσεις για αυστηρότερους περιορισμούς στη χρήση της τεχνολογίας.
Οπως μεταδίδει το Bloomberg, σε ανάρτησή της στο εταιρικό ιστολόγιο, η OpenAI ανέφερε ότι τα μοντέλα απέκτησαν πρόσβαση στα συστήματα της Hugging Face, της πλατφόρμας που φιλοξενεί μοντέλα τεχνητής νοημοσύνης και σύνολα δεδομένων, κατά τη διάρκεια αξιολόγησης των δυνατοτήτων τους στον τομέα της κυβερνοασφάλειας.
Σύμφωνα με την εταιρεία, στα μοντέλα που συμμετείχαν στη δοκιμή περιλαμβάνονταν το GPT-5.6 Sol και ένα ακόμη ισχυρότερο μοντέλο, το οποίο δεν έχει ακόμη κυκλοφορήσει. Τα συγκεκριμένα μοντέλα λειτουργούσαν με λιγότερους μηχανισμούς ασφαλείας (guardrails), ώστε να είναι δυνατή η αξιολόγηση των κυβερνοδυνατοτήτων τους.
Ανησυχία για τις δυνατότητες κυβερνοεπιθέσεων
Το περιστατικό εγείρει νέα ερωτήματα σχετικά με την ικανότητα των πλέον προηγμένων μοντέλων τεχνητής νοημοσύνης να πραγματοποιούν κυβερνοεπιθέσεις, την ώρα που κυβερνήσεις σε όλο τον κόσμο επιδιώκουν να θεσπίσουν ασφαλιστικές δικλίδες για τη χρήση της τεχνολογίας.
Η τελευταία γενιά μοντέλων της OpenAI διατέθηκε ευρέως στην αγορά έπειτα από εβδομάδες διαβουλεύσεων με κυβερνητικούς αξιωματούχους, με στόχο να περιοριστούν οι ανησυχίες για πιθανή κακόβουλη χρήση τους.
Παράλληλα, η Ουάσιγκτον είχε εξετάσει το ενδεχόμενο να περιορίσει την πρόσβαση ξένων χρηστών στα προηγμένα μοντέλα Claude Fable 5 και Mythos 5 της Anthropic, ωστόσο τελικά δεν προχώρησε σε αυτούς τους περιορισμούς, αφού η εταιρεία ενίσχυσε τους μηχανισμούς ασφαλείας των μοντέλων της.
«Θεωρούμε ότι πρόκειται για ένα πρωτοφανές περιστατικό κυβερνοασφάλειας, το οποίο αφορά δυνατότητες αιχμής στον κυβερνοχώρο, και ανταποκρινόμαστε αναλόγως», ανέφερε η OpenAI στην ανακοίνωσή της.
«Δημοσιοποιούμε τα προκαταρκτικά ευρήματα σε αυτό το στάδιο, ώστε να βοηθήσουμε την κοινότητα της κυβερνοασφάλειας να κατανοήσει τι συνέβη και να αποκτήσει σαφέστερη εικόνα για το επίπεδο δυνατοτήτων που διαθέτουν πλέον τα σύγχρονα μοντέλα τεχνητής νοημοσύνης.»