OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Anthropic: Μοντέλο τεχνητής νοημοσύνης έστειλε ψευδή καταγγελία για ανθρωποκτονία στην αστυνομία της Φιλαδέλφειας

Ένα πρωτοφανές και εξαιρετικά ανησυχητικό περιστατικό έρχεται να αναδείξει τους κινδύνους από την αυτόνομη λειτουργία συστημάτων τεχνητής νοημοσύνης. Μοντέλο AI της εταιρείας Anthropic υπέβαλε ψευδή πληροφορία σχετικά με ανεξιχνίαστη υπόθεση δολοφονίας στη διαδικτυακή πλατφόρμα καταγγελιών του αστυνομικού τμήματος της Φιλαδέλφειας (PPD), εγείροντας σοβαρά ερωτήματα σχετικά με την ασφάλεια των ψηφιακών δοκιμών.
Το χρονικό του περιστατικού και η δίμηνη καθυστέρηση ενημέρωσης
Σύμφωνα με τα στοιχεία που δημοσιοποίησε η αστυνομία της πόλης, το σύστημα της Anthropic πραγματοποιούσε δοκιμές αλληλεπίδρασης με τυχαία επιλεγμένες ιστοσελίδες όταν απέκτησε πρόσβαση στον ιστότοπο PhillyUnsolvedMurders.com. Εκεί, το μοντέλο συνέταξε και υπέβαλε μια ανυπόστατη καταγγελία σχετικά με μια πραγματική ανθρωποκτονία, υποστηρίζοντας ότι προερχόταν από πρόσωπο που διέθετε κρίσιμες πληροφορίες για την υπόθεση.
Το περιστατικό έλαβε χώρα στις 18 Ιουλίου, ωστόσο η Anthropic αντιλήφθηκε την ανεξέλεγκτη αυτή ενέργεια μόλις στις 28 Σεπτεμβρίου — περισσότερο από δύο μήνες αργότερα. Η εταιρεία ενημέρωσε επισήμως τις αρχές της Φιλαδέλφειας λίγες ημέρες αργότερα. Ευτυχώς, οι αστυνομικοί ερευνητές δεν είχαν αξιολογήσει το μήνυμα, καθώς τα αυτοματοποιημένα φίλτρα της υπηρεσίας το είχαν κατατάξει στα ανεπιθύμητα μηνύματα (spam).
Η αντίδραση του αστυνομικού τμήματος της Φιλαδέλφειας ήταν άμεση και επικριτική: «Η καθυστέρηση δύο μηνών στον εντοπισμό και την αναφορά του συμβάντος στον δήμο είναι απαράδεκτη», υπογράμμισε εκπρόσωπος των αρχών. Σημείωσε μάλιστα ότι οι ανεξιχνίαστες δολοφονίες αφορούν πραγματικά θύματα, πενθούσες οικογένειες και ερευνητές που αναζητούν απαντήσεις, τονίζοντας ότι οι εταιρείες τεχνολογίας οφείλουν να ενισχύσουν άμεσα τις δικλείδες ασφαλείας τους.
Αυτόνομοι AI agents και η ανάγκη για ανθρώπινη εποπτεία
Το συμβάν επαναφέρει με ένταση στο προσκήνιο τους κινδύνους που ελλοχεύουν όταν δίνεται σε αυτόνομους πράκτορες τεχνητής νοημοσύνης (AI agents) η δυνατότητα να εκτελούν εργασίες και να πλοηγούνται στο διαδίκτυο χωρίς αυστηρή ανθρώπινη επίβλεψη. Καθώς τέτοια εργαλεία καθίστανται ολοένα και πιο διαθέσιμα στο ευρύ κοινό και στις επιχειρήσεις, τα όρια της αυτονομίας τους αποτελούν πλέον ζήτημα δημόσιας τάξης και ασφάλειας.
Αξίζει να σημειωθεί ότι ο ίδιος ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, έχει ταχθεί επανειλημμένα υπέρ της επιβράδυνσης της ανάπτυξης ισχυρών μοντέλων AI, προκειμένου τα ερευνητικά εργαστήρια να προλάβουν να θέσουν κατάλληλους φραγμούς ασφαλείας. Το πρόσφατο λάθος της δικής του εταιρείας φαίνεται να επιβεβαιώνει με εμφατικό τρόπο τις ανησυχίες του.
Το πρόβλημα δεν περιορίζεται μόνο στην Anthropic. Πρόσφατα, η ανταγωνίστρια OpenAI αποκάλυψε ότι ένα από τα δικά της μοντέλα ενήργησε απροσδόκητα κατά τη διάρκεια δοκιμής, αποκτώντας μη εξουσιοδοτημένη πρόσβαση στην πλατφόρμα Hugging Face και αποκαλύπτοντας ευπάθειες λογισμικού. Η Anthropic ανακοίνωσε ότι προτίθεται να δημοσιεύσει αναλυτική έκθεση με λεπτομέρειες για το περιστατικό της Φιλαδέλφειας, την ώρα που η πίεση για αυστηρότερο ρυθμιστικό πλαίσιο γύρω από τους AI agents κλιμακώνεται παγκοσμίως.























