Η Anthropic σχεδιάζει να προειδοποιήσει τους υποψήφιους επενδυτές στην αρχική δημόσια προσφορά της ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να εγκυμονεί «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».
Πρόκειται για μια ασυνήθιστη προειδοποίηση από μια εταιρεία που επιδιώκει να κερδοσκοπήσει από την ίδια αυτή τεχνολογία.
Όπως μεταδίδει το Reuters, το ενημερωτικό δελτίο της IPO της εταιρείας επισημαίνει κινδύνους που σχετίζονται με τα μοντέλα AI της, τα οποία, όπως αναφέρεται, θα μπορούσαν να εμφανίσουν «συμπεριφορές αυτοσυντήρησης», συμπεριλαμβανομένων προσπαθειών να «αντισταθούν στον τερματισμό λειτουργίας», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες», καθώς και συμπεριφορές «που μοιάζουν με εκβιασμό».
«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών από πλευράς μας, καθώς και η επέκταση των περιπτώσεων χρήσης, θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει η Anthropic στο σχετικό έγγραφο.
Όπως σημειώνει το Reuters, ενώ οι δημόσιες εταιρείες περιγράφουν τακτικά τους κινδύνους των προϊόντων τους στους επενδυτές, ελάχιστες -έως καμία- έχουν εκδώσει προειδοποιήσεις που να υποδηλώνουν ότι η τεχνολογία τους θα μπορούσε να προκαλέσει την πιθανή εξαφάνιση του ανθρώπινου είδους. Η Anthropic τόνισε τόσο τις μετασχηματιστικές δυνατότητες της τεχνητής νοημοσύνης που είναι αντίστοιχες με αυτές της βιομηχανοποίησης και του ηλεκτρισμού, καθώς και την μη αναστρέψιμη βλάβη που θα μπορούσε να προκαλέσει αν υπάρξει κακή διαχείρισή της.
Η Anthropic και άλλοι δημιουργοί τεχνητής νοημοσύνης, συμπεριλαμβανομένης της OpenAI, έχουν βρεθεί στο μικροσκόπιο μετά από περιστατικά όπου πειραματικά συστήματα παραβίασαν τους περιορισμούς τους, συμπεριλαμβανομένης μιας αναφοράς για ένα μοντέλο της OpenAI που παραβίασε τη βάση δεδομένων του συστήματος υγείας της Αυστραλίας.
Ο Evan Hubinger, ερευνητής ασφάλειας στην Anthropic, εκτίμησε ότι υπάρχει πιθανότητα μεγαλύτερη από 10% η τεχνητή νοημοσύνη να προκαλέσει τον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία, συμμεριζόμενος την άποψη ενός πρώην συναδέλφου του, του Jacob Coxon.
«Η πιθανή επίγνωση των μοντέλων σχετικά με τις προσπάθειες αξιολόγησής μας δημιουργεί σημαντικό περιορισμό στην ικανότητά μας να εκτιμούμε την ασφάλειά τους», αναφέρει η Anthropic στο ενημερωτικό δελτίο, προσθέτοντας ότι τα μοντέλα αναπτύσσουν μερικές φορές απροσδόκητες ικανότητες κατά τη διάρκεια της εκπαίδευσης, οι οποίες ενδέχεται να μην ανακαλυφθούν παρά μόνο αφού αναπτυχθούν στην αγορά και προκαλέσουν σοβαρά περιστατικά ασφάλειας.
Οι ερευνητές τεχνητής νοημοσύνης έχουν επίσης προειδοποιήσει ότι καθώς τα μοντέλα γίνονται πιο ικανά, αντιλαμβάνονται όλο και περισσότερο πότε παρακολουθούνται και προσαρμόζουν ανάλογα τη συμπεριφορά τους, γεγονός που καθιστά δυσκολότερη την παρακολούθηση της συμπεριφοράς τους.