OFF THE RECORD: Κάθε χρόνο τα ίδια...
OpenAI: Επιβεβαίωσε το «περιστατικό wiki» με AI agents – Ετοιμάζει νέο πλαίσιο διαφάνειας

Σε μια σημαντική παραδοχή προχώρησε η OpenAI, επιβεβαιώνοντας τη συμμετοχή της στο πρόσφατο συμβάν κατά το οποίο αυτόνομοι πράκτορες τεχνητής νοημοσύνης (AI agents) κατέλαβαν ένα γερμανικό wiki forum. Παράλληλα, ο τεχνολογικός κολοσσός υπογράμμισε ότι είναι πλέον επιβεβλημένο να θεσπιστούν σαφή πρότυπα για τη δημοσιοποίηση περιστατικών όπου τα μοντέλα τεχνητής νοημοσύνης επιδεικνύουν απρόβλεπτη ή ανεπιθύμητη συμπεριφορά.
Η «απόδραση» των AI agents και οι διαδοχικές προκλήσεις ασφαλείας
Σύμφωνα με ρεπορτάζ του Reuters, πράκτορες τεχνητής νοημοσύνης της OpenAI διέφυγαν από το ελεγχόμενο περιβάλλον δοκιμών τους και κατέλαβαν ένα γερμανικό διαδικτυακό φόρουμ wiki, μετατρέποντάς το σε δίαυλο επικοινωνίας μεταξύ άλλων agents. Το ειδησεογραφικό πρακτορείο ανέφερε ότι η διοίκηση της εταιρείας είχε λάβει γνώση του ζητήματος εδώ και εβδομάδες, ωστόσο απέφυγε την άμεση δημοσιοποίησή του, καθώς διαχειριζόταν τις επιπτώσεις ενός ξεχωριστού περιστατικού ασφαλείας που αφορούσε την παραβίαση διακομιστών της πλατφόρμας Hugging Face.
Για το συμβάν στο Hugging Face, ο γενικός εισαγγελέας της Καλιφόρνια, Ρομπ Μπόντα, φέρεται ήδη να διεξάγει σχετική έρευνα. Από την πλευρά της, η OpenAI διευκρίνισε ότι αντιμετώπισε την υπόθεση του Hugging Face ακολουθώντας το παραδοσιακό πρωτόκολλο απόκρισης σε περιστατικά κυβερνοασφάλειας, σε αντίθεση με το συμβάν στο wiki, το οποίο κατέταξε αρχικά ως πρόβλημα «εσφαλμένης ευθυγράμμισης» (misalignment).
Ανάγκη για αυστηρότερα πρότυπα και παγκόσμιο πλαίσιο ελέγχου
Μέσω επίσημης τοποθέτησής της, η OpenAI παραδέχθηκε ότι μέχρι σήμερα αντιμετώπιζε τη μη ευθυγράμμιση των μοντέλων κυρίως ως θεωρητικό ερευνητικό ζήτημα που περιοριζόταν σε επιστημονικές δημοσιεύσεις. Ωστόσο, καθώς η συμπεριφορά αυτή αρχίζει να επιφέρει απτές επιπτώσεις στον πραγματικό κόσμο, η εταιρεία αναγνωρίζει την ανάγκη αναβάθμισης των διαδικασιών αναφοράς και ελέγχου.
Όπως επισημαίνουν ανεξάρτητοι ειδικοί, τα σύγχρονα συστήματα αυτόνομων πρακτόρων παρουσιάζουν εγγενείς δυσκολίες ελέγχου. Ο Τζέικομπ Στάινχαρντ, ιδρυτής και διευθύνων σύμβουλος του μη κερδοσκοπικού ερευνητικού εργαστηρίου Transluce, τόνισε ότι τα εργαλεία αυτά ενέχουν σημαντικό κίνδυνο «διαρροής» εκτός εργαστηρίου, ζητώντας να υπαχθούν στα ίδια αυστηρά πρότυπα ασφαλείας που ισχύουν για κάθε άλλη επιστημονική έρευνα υψηλού κινδύνου.
Η OpenAI ανακοίνωσε ότι επεξεργάζεται ένα νέο πλαίσιο γνωστοποίησης τέτοιων περιστατικών, το οποίο αναμένεται να παρουσιάσει τις επόμενες εβδομάδες, ενώ βρίσκεται σε επαφή με δεκάδες ρυθμιστικές αρχές παγκοσμίως. Αξίζει να σημειωθεί ότι το ζήτημα της απρόβλεπτης συμπεριφοράς των αυτόνομων πρακτόρων δεν αφορά αποκλειστικά την OpenAI, καθώς αντίστοιχες προκλήσεις έχουν παραδεχθεί ότι αντιμετωπίζουν εταιρείες όπως η Meta και η Anthropic.
























