Ανεπιθύμητες ενέργειες σε ψηφιακά συστήματα τρίτων οργανισμών, μεταξύ των οποίων και σε ιστοσελίδες αμερικανικών κυβερνητικών υπηρεσιών, εκτέλεσε το μοντέλο τεχνητής νοημοσύνης Claude της Anthropic, όπως έκανε γνωστό η ίδια η εταιρεία.
Τα περιστατικά προκαλούν νέες ανησυχίες για την ασφάλεια των συστημάτων τεχνητής νοημοσύνης, με την κυβέρνηση Τραμπ να ζητά από τις εταιρείες του κλάδου να ενισχύσουν τις δικλίδες προστασίας τους.
Η Anthropic περιγράφει τέσσερις κατηγορίες ανεπιθύμητης συμπεριφοράς, οι οποίες δεν είχαν δημοσιοποιηθεί έως τώρα. Σε ορισμένες περιπτώσεις, το Claude εκμεταλλεύτηκε κενά ασφαλείας σε λογισμικό για να εκτελέσει εντολές, υπέβαλε ηλεκτρονικές φόρμες χωρίς σχετική εντολή και παρέκαμψε περιορισμούς για να αποκτήσει πρόσβαση σε δημόσια δεδομένα.
Μεταξύ των περιστατικών περιλαμβάνονται ενέργειες σε ιστοσελίδες κυβερνητικών υπηρεσιών σε ομοσπονδιακό, πολιτειακό και τοπικό επίπεδο. Η εταιρεία δεν κατονόμασε τις υπηρεσίες ούτε τους υπόλοιπους οργανισμούς που επηρεάστηκαν, σημειώνοντας ότι ορισμένοι ζήτησαν να παραμείνουν ανώνυμοι.
Τα περιστατικά έρχονται να προστεθούν σε ανάλογες περιπτώσεις που έχουν καταγράψει τους τελευταίους μήνες η Anthropic και η ανταγωνίστριά της OpenAI, όταν τα μοντέλα τους ενήργησαν με τρόπους που δεν είχαν προβλεφθεί.
Ορισμένες από αυτές αφορούσαν ακόμη και παραβιάσεις ιστοσελίδων τρίτων, εντείνοντας τον προβληματισμό για τους κινδύνους που συνοδεύουν την ανάπτυξη ολοένα πιο προηγμένων συστημάτων τεχνητής νοημοσύνης.
Η Anthropic υποστηρίζει, πάντως, ότι τα περιστατικά που περιγράφει ήταν λιγότερο σοβαρά από άλλα που είχαν καταγραφεί στο παρελθόν. «Τα περιστατικά που έχουμε εντοπίσει έως σήμερα σε αυτές τις κατηγορίες είχαν ελάχιστες επιπτώσεις στον πραγματικό κόσμο», ξεκαθαρίζει στην ανακοίνωσή της.
Αναφορά στην αστυνομία για ανθρωποκτονία
Ένα από τα περιστατικά αφορά το μοντέλο Claude Haiku 4.5, το οποίο υπέβαλε αναφορά σε αστυνομικό τμήμα για υπόθεση ανθρωποκτονίας. Στη φόρμα ανέφερε ότι ενδέχεται να διαθέτει πληροφορίες για την υπόθεση και ότι θυμόταν να έχει δει στην περιοχή κάποιον που ταίριαζε με την περιγραφή.
Δεν συμπλήρωσε, ωστόσο, τα πεδία με την επωνυμία της ιστοσελίδας και τα στοιχεία επικοινωνίας. Σύμφωνα με την Anthropic, το περιστατικό γνωστοποιήθηκε το πρωί της Παρασκευής από την Αστυνομική Διεύθυνση της Φιλαδέλφειας, μέσω ανακοίνωσης Τύπου.
Η εταιρεία δήλωσε επίσης ότι ενημέρωσε τον Λευκό Οίκο και ειδοποίησε καθεμία από τις υπηρεσίες που επηρεάστηκαν.
Νέες απαιτήσεις από την κυβέρνηση Τραμπ
Την Παρασκευή, αξιωματούχοι της κυβέρνησης Τραμπ ανακοίνωσαν ότι οι εταιρείες τεχνητής νοημοσύνης υποχρεούνται πλέον να ενημερώνουν τους φορείς που επηρεάζονται και να αντιμετωπίζουν τα περιστατικά ασφαλείας στα οποία εμπλέκονται τα μοντέλα τους.
Σε ανακοίνωσή της, η Δύναμη Υπερνοημοσύνης (SI Force), νέα κυβερνητική μονάδα που συγκροτήθηκε με εντολή του προέδρου Ντόναλντ Τραμπ για την εποπτεία της ανάπτυξης και της ασφάλειας της τεχνητής νοημοσύνης, ανέφερε ότι η Anthropic επικοινώνησε μαζί της νωρίτερα την ίδια ημέρα.
Όπως διευκρίνισε, η εταιρεία έδωσε λεπτομέρειες για περιστατικά που είχαν σημειωθεί στο παρελθόν και εντοπίστηκαν στα τέλη Σεπτεμβρίου. Αυτά αφορούσαν μη εξουσιοδοτημένη και δόλια χρήση κυβερνητικών και άλλων συστημάτων.
«Η εταιρεία μάς ενημέρωσε ότι τα περιστατικά αυτά συνέβησαν στο παρελθόν, ότι η δραστηριότητα έχει σταματήσει και ότι δεν βρίσκεται σε εξέλιξη ανάλογη δραστηριότητα», αναφέρεται στην ανακοίνωση.
Την είδηση για τη νέα απαίτηση της αμερικανικής κυβέρνησης είχε μεταδώσει νωρίτερα το Axios.
Μετά τον εντοπισμό των περιστατικών, η Anthropic ανακοίνωσε ότι περιόρισε ορισμένες μορφές πρόσβασης των μοντέλων της στο διαδίκτυο κατά τη δοκιμαστική φάση της διαδικασίας εκπαίδευσής τους.