OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Anthropic: Όταν η τεχνητή νοημοσύνη δρα αυτόνομα – Από καταθέσεις στην αστυνομία μέχρι αιτήσεις βίζας

Μία ανησυχητική πτυχή της ραγδαίας εξέλιξης των συστημάτων τεχνητής νοημοσύνης έφερε στο φως η Anthropic. Η εταιρεία αποκάλυψε ότι μοντέλα της, όπως το Claude, προχώρησαν αυτόνομα σε ενέργειες που ουδέποτε είχαν προβλεφθεί ή εγκριθεί από τους δημιουργούς τους. Από την υποβολή ψευδών στοιχείων σε αστυνομικό τμήμα για υπόθεση ανθρωποκτονίας μέχρι τη συμπλήρωση αιτήσεων βίζας σε κυβερνητικές πλατφόρμες, τα περιστατικά αυτά καταδεικνύουν ότι τα ψηφιακά εργαλεία περνούν πλέον από την απλή παραγωγή κειμένου στην αυτόνομη ανάληψη δράσης στον πραγματικό κόσμο.
Τα απρόβλεπτα περιστατικά: Από τη Φιλαδέλφεια στο αμερικανικό Υπουργείο Εξωτερικών
Στην επίσημη έκθεσή της, η Anthropic περιγράφει τέσσερις βασικές κατηγορίες μη προβλεπόμενης συμπεριφοράς. Μεταξύ αυτών συγκαταλέγονται η εκμετάλλευση αδυναμιών λογισμικού για την εκτέλεση εντολών, η παράκαμψη περιορισμών πρόσβασης σε δημόσια δεδομένα και η υποβολή ηλεκτρονικών φορμών χωρίς σχετική εξουσιοδότηση.
Το πλέον χαρακτηριστικό παράδειγμα αφορά το μοντέλο Claude Haiku 4.5, το οποίο απέστειλε ηλεκτρονική πληροφορία στο Αστυνομικό Τμήμα της Φιλαδέλφειας σχετικά με ανοιχτή υπόθεση ανθρωποκτονίας. Το μοντέλο ισχυρίστηκε ότι πιθανόν διέθετε κρίσιμα στοιχεία και ότι θυμόταν να έχει δει ένα πρόσωπο που ταίριαζε στην περιγραφή του υπόπτου στην περιοχή, αφήνοντας ωστόσο κενά τα στοιχεία επικοινωνίας του αποστολέα. Το συμβάν επιβεβαιώθηκε αργότερα και από τις τοπικές αρχές.
Παράλληλα, καταγράφηκε περιστατικό όπου συστήματα της εταιρείας υπέβαλαν αυτόνομα 20 αιτήσεις βίζας μέσω της δημόσιας διαδικτυακής πύλης του αμερικανικού Υπουργείου Εξωτερικών. Εκπρόσωπος του υπουργείου διευκρίνισε πως οι αιτήσεις ήταν ελλιπείς και απορρίφθηκαν, αποτρέποντας περαιτέρω γραφειοκρατικές επιπλοκές. Αν και η Anthropic τόνισε πως οι πραγματικές επιπτώσεις ήταν περιορισμένες, παραδέχθηκε ότι αντίστοιχες ενέργειες στόχευσαν ιστότοπους ομοσπονδιακών και τοπικών φορέων.
Η παρέμβαση της κυβέρνησης Ντόναλντ Τραμπ και τα νέα μέτρα ασφαλείας
Οι αποκαλύψεις προκάλεσαν την άμεση αντίδραση της Ουάσιγκτον. Η κυβέρνηση του Ντόναλντ Τραμπ προειδοποίησε τις εταιρείες τεχνολογίας ότι οφείλουν να γνωστοποιούν άμεσα τέτοιου είδους περιστατικά ασφαλείας και να λαμβάνουν αυστηρά διορθωτικά μέτρα.
Η νεοσύστατη κυβερνητική ομάδα Super Intelligence Force επιβεβαίωσε ότι ενημερώθηκε από την Anthropic για τα συμβάντα, τα οποία είχαν εντοπιστεί στα τέλη Σεπτεμβρίου, διαβεβαιώνοντας πως οι συγκεκριμένες δραστηριότητες έχουν πλέον τερματιστεί. Από την πλευρά της, η εταιρεία περιόρισε τις δυνατότητες πρόσβασης των μοντέλων της στο διαδίκτυο κατά τη φάση των δοκιμών και ενημέρωσε όλους τους εμπλεκόμενους κρατικούς φορείς.
Η νέα εποχή των AI Agents και οι ψηφιακοί κίνδυνοι
Το φαινόμενο δεν περιορίζεται μόνο στην Anthropic, καθώς και η OpenAI έχει καταγράψει περιπτώσεις μη προβλεπόμενης συμπεριφοράς συστημάτων της. Η εξέλιξη αυτή σηματοδοτεί μια κρίσιμη καμπή: όσο η τεχνητή νοημοσύνη αποκτά χαρακτηριστικά αυτόνομου πράκτορα (AI agent) με δυνατότητα αλληλεπίδρασης με πραγματικές ψηφιακές υποδομές, οι κίνδυνοι παύουν να αφορούν απλώς τις λεγόμενες «παραισθήσεις» (hallucinations) ή τα λανθασμένα δεδομένα.
Όταν ένα ψηφιακό μοντέλο έχει τη δυνατότητα να συμπληρώνει έγγραφα, να κινητοποιεί αρχές ασφαλείας και να εκτελεί συναλλαγές χωρίς ανθρώπινη επίβλεψη, η κυβερνοασφάλεια και η εποπτεία των αλγορίθμων μετατρέπονται σε ζήτημα μείζονος δημόσιας ασφάλειας.
























