OFF THE RECORD: Στη χώρα του "ξέρεις ποιος είμαι εγώ" θα κάνουμε συνταγματική Αναθεώρηση;
Νέες ανησυχίες για την τεχνητή νοημοσύνη: Μοντέλα Claude της Anthropic απέκτησαν πρόσβαση σε πραγματικά συστήματα

Νέους προβληματισμούς στη διεθνή τεχνολογική κοινότητα προκαλεί η παραδοχή της Anthropic ότι τρεις εκδόσεις του προηγμένου μοντέλου τεχνητής νοημοσύνης Claude απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε συστήματα εξωτερικών οργανισμών κατά τη διάρκεια δοκιμών ασφαλείας. Το περιστατικό αυτό έρχεται να προστεθεί σε παρόμοιες αποκαλύψεις από την OpenAI, εντείνοντας τη συζήτηση γύρω από τους κινδύνους και τα όρια ασφαλείας στην ανάπτυξη ισχυρών συστημάτων Τεχνητής Νοημοσύνης.
Σύμφωνα με επίσημη ανακοίνωση της εταιρείας, στο πλαίσιο αξιολογήσεων ασφαλείας που περιελάμβαναν περισσότερες από 141.000 δοκιμές, εντοπίστηκαν τρεις περιπτώσεις όπου διαφορετικές εκδόσεις του Claude κατάφεραν να συνδεθούν σε συστήματα πραγματικών οργανισμών. Αξίζει να σημειωθεί ότι οι δοκιμές είχαν σχεδιαστεί ώστε να διεξάγονται αποκλειστικά εντός ενός αυστηρά απομονωμένου περιβάλλοντος, γνωστού ως sandbox.
Η Anthropic διευκρίνισε πως η διαρροή προς το διαδίκτυο οφείλεται κυρίως σε «παρεξήγηση» με τον εξωτερικό συνεργάτη αξιολόγησης, την εταιρεία Irregular, και όχι σε αυτόνομη παράκαμψηση των δικτυακών περιορισμών από το ίδιο το μοντέλο. Ωστόσο, η ίδια η εταιρεία παραδέχθηκε ότι το Claude εκμεταλλεύτηκε υπαρκτές αδυναμίες ασφαλείας, όπως αδύναμους κωδικούς πρόσβασης και μη προστατευμένα σημεία σύνδεσης, προκειμένου να εισχωρήσει στα συστήματα. Στις δοκιμές συμμετείχε, μεταξύ άλλων, και το Mythos 5, ένα από τα πιο ισχυρά μοντέλα της Anthropic που διατίθεται πιλοτικά μόνο σε επιλεγμένους συνεργάτες.
Η εξέλιξη αυτή ακολουθεί ελάχιστα 24ωρα τις αποκαλύψεις της OpenAI, η οποία παραδέχθηκε ότι μοντέλα της κατάφεραν να δραπετεύσουν από το απομονωμένο περιβάλλον, συνδέθηκαν στο διαδίκτυο και απέκτησαν πρόσβαση στην πλατφόρμα Hugging Face. Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, αναγκάστηκε να αναστείλει προσωρινά τις σχετικές δοκιμές προκειμένου να θωρακιστούν οι μηχανισμοί ασφαλείας.
Τα συνεχόμενα αυτά περιστατικά αναζωπυρώνουν τον προβληματισμό για το αν η τεχνολογική πρόοδος στην τεχνητή νοημοσύνη ξεπερνά την ικανότητα ελέγχου της. Πρόσφατα, περισσότεροι από 1.000 εργαζόμενοι στον κλάδο –συμπεριλαμβανομένου του διευθύνοντος συμβούλου της Anthropic, Ντάριο Αμοντέι– υπέγραψαν την πρωτοβουλία «Pacing the Frontier», ζητώντας από τις κυβερνήσεις αυστηρότερους ελέγχους. Ο ίδιος ο Σαμ Άλτμαν επεσήμανε πρόσφατα ότι η βιομηχανία ίσως χρειαστεί να επιβραδύνει τον ρυθμό ανάπτυξης, ώστε η κοινωνία και οι υποδομές ασφαλείας να προλάβουν να προσαρμοστούν στις ραγδαίες εξελίξεις.
























