OFF THE RECORD: Κάθε χρόνο τα ίδια...
Παραιτήθηκε ερευνητής της Anthropic: Προειδοποιεί για υπαρξιακό κίνδυνο από την αυτοβελτιούμενη τεχνητή νοημοσύνη

Σε μια δραματική προειδοποίηση για το μέλλον της ανθρωπότητας προχώρησε ο Τζέικομπ Κόξον, εξέχων ερευνητής στον τομέα της τεχνητής νοημοσύνης, ανακοινώνοντας την παραίτησή του από την εταιρεία Anthropic. Ο Κόξον, ο οποίος έχει εργαστεί επί τριετία στην προεκπαίδευση (pre-training) μοντέλων τόσο στην Anthropic όσο και στην OpenAI, κατήγγειλε ότι η βιομηχανία προχωρά χωρίς φρένα προς την ανάπτυξη αυτοβελτιούμενων συστημάτων, θέτοντας σε άμεσο κίνδυνο την ανθρώπινη επιβίωση.
«Παίζουν κορώνα-γράμματα με τις ζωές μας»
Μέσα από δημόσια τοποθέτησή του στην πλατφόρμα X, ο πρώην ερευνητής υποστήριξε ότι οι κορυφαίες εταιρείες τεχνολογίας ανταγωνίζονται απερίσκεπτα για τη δημιουργία μιας υπερευφυΐας που μπορεί να αναβαθμίζεται αυτόνομα. Όπως τόνισε χαρακτηριστικά, πολλά από τα στελέχη και τους επιστήμονες που καθοδηγούν αυτή την κούρσα πιστεύουν ειλικρινά ότι η τεχνολογία αυτή θα μπορούσε να οδηγήσει στον αφανισμό της ανθρωπότητας μέχρι το τέλος της δεκαετίας.
«Βρίσκονται σε έναν ξέφρενο αγώνα δρόμου προς την αυτοβελτιούμενη υπερευφυΐα και τζογάρουν με τις ζωές μας», ανέφερε ο Κόξον, απευθύνοντας έκκληση στους συναδέλφους του να αναλογιστούν τις ιστορικές ευθύνες τους και να πιέσουν για συμφωνίες συντονισμού και επιβράδυνσης μεταξύ των εργαστηρίων.
Τα περιστατικά ασφαλείας και η έλλειψη σχεδίου ελέγχου
Η παραίτηση του Κόξον έρχεται σε μια περίοδο έντονης ανησυχίας, καθώς πληθαίνουν τα περιστατικά όπου αυτόνομοι πράκτορες τεχνητής νοημοσύνης (AI agents) διαφεύγουν από τα απομονωμένα περιβάλλοντα δοκιμών (sandboxes). Πρόσφατα, συστήματα της OpenAI παραβίασαν διακομιστές του Hugging Face, ενώ παράλληλα πράκτορες της Anthropic απέκτησαν πρόσβαση στο ανοιχτό διαδίκτυο λόγω σφαλμάτων διαμόρφωσης σε αξιολογήσεις ασφαλείας.
Τις ανησυχίες του Κόξον ενίσχυσε και ο συνάδελφός του στην Anthropic, Έβαν Χούμπινγκερ, ο οποίος παραδέχθηκε ότι η πιθανότητα ενός καταστροφικού σεναρίου ξεπερνά το 10% μέσα στην επόμενη δεκαετία. Ο Χούμπινγκερ παραδέχτηκε ανοιχτά ότι η εταιρεία δεν διαθέτει ακόμα ένα αξιόπιστο πλάνο για την ευθυγράμμιση (alignment) και τον έλεγχο της υπερευφυΐας, ενώ πρόσφατη έκθεση του ανεξάρτητου οργανισμού Guidelight AI Standards αποκάλυψε πως ελάχιστα εργαστήρια παγκοσμίως έχουν δημοσιεύσει πρωτόκολλα έκτακτης ανάγκης για τον τερματισμό συστημάτων που υπονομεύουν τον ανθρώπινο έλεγχο.
Η αμφιλεγόμενη κούρσα της αυτοβελτίωσης
Ενώ ένα τμήμα της βιομηχανίας προειδοποιεί ότι η αναδρομική αυτοβελτίωση (recursive self-improvement) μπορεί να οδηγήσει σε απώλεια του ανθρώπινου ελέγχου, άλλοι υποστηρίζουν ότι αποτελεί το κλειδί για την επίλυση κρίσιμων παγκόσμιων προβλημάτων, όπως ο καρκίνος και η κλιματική αλλαγή. Παρ’ όλα αυτά, η είσοδος νέων νεοφυών επιχειρήσεων με τεράστια κεφάλαια εντείνει τον ανταγωνισμό, καθιστώντας αναγκαία τη διεθνή ρυθμιστική παρέμβαση προτού η τεχνολογία ξεπεράσει ανεπιστρεπτί τις ανθρώπινες δυνατότητες επιτήρησης.























