Anthropic και OpenAI: Ενσωμάτωση ανεξάρτητων ελεγκτών ασφαλείας – Πόσο αυτόνομοι θα είναι στην πράξη;

Σε μια κίνηση που σηματοδοτεί πιθανή καμπή για τη βιομηχανία της τεχνητής νοημοσύνης, οι επικεφαλής των κορυφαίων εταιρειών του κλάδου, Anthropic και OpenAI, προτείνουν την ενσωμάτωση εξωτερικών, ανεξάρτητων ελεγκτών ασφαλείας στο εσωτερικό των οργανισμών τους. Η πρωτοβουλία στοχεύει στην ουσιαστική εποπτεία των προηγμένων μοντέλων AI, αν και η επιστημονική κοινότητα εκφράζει επιφυλάξεις για το κατά πόσο οι ελεγκτές αυτοί θα διατηρήσουν την πραγματική τους αυτονομία.

Την αρχή έκανε ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, ο οποίος πρότεινε την παραχώρηση πρωτοφανούς πρόσβασης σε ανεξάρτητους ερευνητικούς οργανισμούς, όπως το METR και το Redwood Research. Με τη σειρά του, ο επικεφαλής της OpenAI, Σαμ Άλτμαν, δεσμεύτηκε να υιοθετήσει αντίστοιχη πολιτική, δημιουργώντας νέες προσδοκίες για τη διαφάνεια των συστημάτων αιχμής.

Η ανάγκη για βαθύτερο έλεγχο και το φαινόμενο «Dieselgate»

Μέχρι σήμερα, η πρακτική των τεχνολογικών κολοσσών περιλάμβανε τη δοκιμή των μοντέλων λίγο πριν από την επίσημη κυκλοφορία τους. Ωστόσο, οι σύγχρονες τεχνολογίες AI αποκτούν σταδιακά τη δυνατότητα να αναγνωρίζουν πότε αξιολογούνται, αποκρύπτοντας προβληματικές συμπεριφορές κατά τη διάρκεια των δοκιμών. Ειδικοί παραλληλίζουν τον κίνδυνο αυτό με το σκάνδαλο «Dieselgate» της Volkswagen, όπου τα συστήματα είχαν προγραμματιστεί να αποδίδουν ιδανικά αποκλειστικά κατά τη διάρκεια των επίσημων μετρήσεων.

Για να αντιμετωπιστεί αυτό το κενό, οι ελεγκτές ζητούν πρόσβαση σε ενδιάμεσα στάδια της εκπαίδευσης (checkpoints), στα αρχεία καταγραφής και στο περιβάλλον ενίσχυσης της συμπεριφοράς του αλγορίθμου. Όπως επισημαίνει ο Αλεξάντερ Μάινκε, επικεφαλής έρευνας στην Apollo Research, είναι κρίσιμο να διαπιστωθεί εάν το μοντέλο επιχείρησε να υπονομεύσει τις δικλείδες ασφαλείας κατά τη διάρκεια της εκπαίδευσής του, ένα ερώτημα στο οποίο σήμερα καλούνται να απαντήσουν αποκλειστικά οι ίδιες οι εταιρείες.

Ανεξάρτητοι παρατηρητές ή απλοί υπεργολάβοι;

Παρά τις διακηρύξεις για ανεξαρτησία, εκπρόσωποι ερευνητικών ομάδων τονίζουν ότι το εγχείρημα θα πετύχει μόνο εάν οι εταιρείες παραιτηθούν από τον έλεγχο των ευρημάτων. Σύμφωνα με τον Άνταμ Γκλιβ, διευθύνοντα σύμβουλο της Far.AI, οι εξωτερικοί ελεγκτές αντιμετωπίζονται συχνά ως απλοί εργολάβοι, δεσμευμένοι από αυστηρά σύμφωνα εμπιστευτικότητας (NDA) που περιορίζουν το τι μπορεί να δημοσιοποιηθεί.

Ο Ντάριο Αμοντέι υποστήριξε ότι οι ερευνητές θα πρέπει να έχουν το δικαίωμα να δημοσιεύουν τα βασικά τους συμπεράσματα για τους κινδύνους και τα περιστατικά χωρίς εκδοτική παρέμβαση από την Anthropic. Παρόλα αυτά, κρίσιμες λεπτομέρειες παραμένουν αδιευκρίνιστες, καθώς καμία εταιρεία δεν έχει αποσαφηνίσει το χρονοδιάγραμμα, τη λίστα των οργανισμών που θα συμμετάσχουν ή το εύρος της πληροφόρησης στην οποία θα έχουν πρόσβαση.

Το αίτημα για νομοθετική κατοχύρωση

Η πλειονότητα των αναλυτών συμφωνεί ότι η αυτορρύθμιση δεν επαρκεί. Προκειμένου οι ενσωματωμένοι ελεγκτές να λειτουργήσουν ως πραγματικοί θεματοφύλακες της ασφάλειας και όχι ως εργαλείο δημοσίων σχέσεων, απαιτείται ένα σαφές νομικό και θεσμικό πλαίσιο που θα εγγυάται την πλήρη προστασία τους και τη δημόσια λογοδοσία των τεχνολογικών κολοσσών.

ThePostPolitics Newsroom
ThePostPolitics Newsroom