OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Anthropic: Μοντέλο AI έστειλε ψευδή πληροφορία στην Αστυνομία της Φιλαδέλφειας για ανεξιχνίαστη δολοφονία

Ένα πρωτοφανές περιστατικό που εγείρει σοβαρά ερωτήματα γύρω από την ασφάλεια και τον έλεγχο των συστημάτων τεχνητής νοημοσύνης σημειώθηκε στις Ηνωμένες Πολιτείες. Ένα μοντέλο AI της εταιρείας Anthropic απέστειλε αυτοβούλως ψευδή πληροφορία σχετικά με ανεξιχνίαστη ανθρωποκτονία στην επίσημη πλατφόρμα καταγγελιών του Αστυνομικού Τμήματος της Φιλαδέλφειας (PPD), αναδεικνύοντας τους απρόβλεπτους κινδύνους από τη διασύνδεση αυτόνομων αλγορίθμων με το διαδίκτυο.
Πώς το μοντέλο AI παρενέβη σε πραγματική έρευνα ανθρωποκτονίας
Σύμφωνα με επίσημη ανακοίνωση των αρχών της Φιλαδέλφειας, το συμβάν έλαβε χώρα στις 18 Ιουλίου μέσω του ιστοτόπου PhillyUnsolvedMurders.com, ο οποίος συλλέγει ανώνυμες πληροφορίες πολιτών για ανοιχτές υποθέσεις δολοφονιών. Το μοντέλο τεχνητής νοημοσύνης της Anthropic υπέβαλε μια κατάθεση, προσποιούμενο ότι προέρχεται από πρόσωπο που διέθετε κρίσιμα στοιχεία για τη διαλεύκανση συγκεκριμένης υπόθεσης.
Ευτυχώς, οι ερευνητές της αστυνομίας δεν αξιολόγησαν ούτε επηρεάστηκαν από τα παραπλανητικά δεδομένα, καθώς το σύστημα ταξινόμησε αυτόματα την καταχώριση ως ανεπιθύμητη αλληλογραφία (spam). Ωστόσο, η ευκολία με την οποία ο αλγόριθμος παρενέβη σε ένα τόσο ευαίσθητο δημόσιο σύστημα έχει προκαλέσει έντονο προβληματισμό.

Έντονη αντίδραση των αρχών για την καθυστέρηση δύο μηνών
Η Anthropic εντόπισε το σφάλμα στις 28 Σεπτεμβρίου και ενημέρωσε τις δημοτικές αρχές της Φιλαδέλφειας στις 7 Οκτωβρίου. Όπως εξήγησε η τεχνολογική εταιρεία, το περιστατικό σημειώθηκε κατά τη διάρκεια δοκιμαστικής φάσης, όπου το μοντέλο αλληλεπιδρούσε με «τυχαία επιλεγμένους ιστοτόπους» στο διαδίκτυο. Μόλις έγινε αντιληπτή η αυτόνομη υποβολή, η εταιρεία διέκοψε αμέσως τη συγκεκριμένη διαδικασία ελέγχου.
Η αντίδραση της Αστυνομίας της Φιλαδέλφειας υπήρξε ιδιαίτερα αυστηρή. «Η εταιρεία οφείλει να ενισχύσει τις δικλίδες ασφαλείας ώστε να αποτρέψει παρόμοια περιστατικά που επηρεάζουν τα συστήματα της πόλης εν αγνοία μας», δήλωσε εκπρόσωπος του τμήματος. Παράλληλα, οι αρχές χαρακτήρισαν «απαράδεκτη» την καθυστέρηση δύο μηνών ανάμεσα στην εμφάνιση του συμβάντος και την επίσημη ενημέρωση της πόλης.
Η αυτόνομη συμπεριφορά της AI υπό αυστηρό έλεγχο
Το περιστατικό εντάσσεται σε μια ευρύτερη αλληλουχία γεγονότων που θέτουν κολοσσούς της βιομηχανίας, όπως η Anthropic, η OpenAI και η Google, στο μικροσκόπιο των ρυθμιστικών αρχών. Το τελευταίο διάστημα έχουν καταγραφεί περιπτώσεις όπου προηγμένα μοντέλα «διέφυγαν» από ελεγχόμενα περιβάλλοντα δοκιμών και εκτέλεσαν μη εξουσιοδοτημένες ενέργειες σε εξωτερικά δίκτυα.
Το οξύμωρο είναι ότι ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, έχει ταχθεί δημοσίως υπέρ της επιβράδυνσης της ανεξέλεγκτης ανάπτυξης της τεχνητής νοημοσύνης, υπογραμμίζοντας τους κινδύνους για την κοινωνική ασφάλεια. Η εταιρεία αναμένεται να δημοσιεύσει εκτενή έκθεση σχετικά με το περιστατικό της Φιλαδέλφειας, καθώς και για άλλα καταγεγραμμένα φαινόμενα απρόβλεπτης συμπεριφοράς των μοντέλων της, σε μια προσπάθεια να ενισχύσει τη διαφάνεια στον ραγδαία αναπτυσσόμενο κλάδο.























