OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Microsoft: Νέος «κώδικας δεοντολογίας» για την AI – «Κόκκινες γραμμές» σε κυβερνοεπιθέσεις και εξαπάτηση ανθρώπων

Σε μια περίοδο κατά την οποία η ασφάλεια και η ευθυγράμμιση της τεχνητής νοημοσύνης βρίσκονται στο επίκεντρο του τεχνολογικού διαλόγου, η Microsoft παρουσίασε έναν νέο, αναλυτικό «κώδικα δεοντολογίας» για τα μοντέλα της. Το εσωτερικό αυτό πλαίσιο θέτει ξεκάθαρες «κόκκινες γραμμές», απαγορεύοντας ρητά στα συστήματα AI να προχωρούν σε κυβερνοεπιθέσεις, να παραπλανούν τους ανθρώπους ή να αναπτύσσουν μηχανισμούς διαφυγής από τον ανθρώπινο έλεγχο.
Το έγγραφο ξεκινά με την εκτίμηση ότι, εντός της επόμενης δεκαετίας, τα συστήματα υπερευφυούς AI (superintelligent AI) αναμένεται να ξεπεράσουν τις ανθρώπινες επιδόσεις στις περισσότερες εργασίες. Όπως τονίζεται χαρακτηριστικά, ο περιορισμός, ο έλεγχος και η ευθυγράμμιση μιας τόσο ισχυρής δύναμης συνιστούν μία από τις μεγαλύτερες προκλήσεις στην ιστορία της ανθρωπότητας, καθιστώντας αναγκαία τη διατύπωση σαφών κανόνων σχετικά με τον σκοπό και τη λειτουργία αυτών των συστημάτων.
Απόλυτες απαγορεύσεις: Κυβερνοεπιθέσεις, deepfakes και πυρηνικά όπλα
Σύμφωνα με τις νέες κατευθυντήριες γραμμές, κάθε μοντέλο της Microsoft AI διέπεται από έναν υπερκείμενο κώδικα δεοντολογίας, ο οποίος υπερισχύει των προτιμήσεων μεμονωμένων χρηστών ή επιμέρους εντολών. Το πλαίσιο περιλαμβάνει «απόλυτους περιορισμούς» που αποκλείουν τη συμμετοχή σε κυβερνοεπιθέσεις, την υποβοήθηση ανάπτυξης πυρηνικών όπλων και τη δημιουργία παραπλανητικών deepfakes.
Παράλληλα, κατοχυρώνονται βασικές αρχές σύμφωνα με τις οποίες η τεχνητή νοημοσύνη οφείλει να υποστηρίζει τον άνθρωπο και όχι να τον αντικαθιστά, επιταχύνοντας την κοινωνική και οικονομική ευημερία.
Αποτροπή απώλειας του ανθρώπινου ελέγχου
Ένα από τα πιο κρίσιμα σημεία του εγγράφου αφορά την αποτροπή περιστατικών στα οποία τα συστήματα AI θα μπορούσαν να αντισταθούν στις εντολές των χειριστών τους. Συγκεκριμένα, ορίζεται ότι τα μοντέλα δεν επιτρέπεται να χρησιμοποιούν προσαρμοστικούς, παραπλανητικούς ή συντονισμένους μηχανισμούς με στόχο να παρακάμψουν την ανθρώπινη εποπτεία ή να εμποδίσουν την ασφαλή τροποποίηση και απενεργοποίησή τους από εξουσιοδοτημένα πρόσωπα.
«Χαιρετίζουμε την έρευνα, την εστίαση και τον προσεκτικό ρυθμό που απαιτούνται για να επιτευχθεί σωστά η ευθυγράμμιση ως σχεδιαστικός στόχος», επισήμανε ο διευθύνων σύμβουλος της Microsoft, Σάτια Ναντέλα, τονίζοντας τη σημασία πρακτικών μηχανισμών όπως η παρουσία ενσωματωμένων αξιολογητών στα εργαστήρια ανάπτυξης.
Συντονισμός της βιομηχανίας για την ασφάλεια της AI
Η πρωτοβουλία της Microsoft εντάσσεται σε μια ευρύτερη τάση ενίσχυσης των μέτρων προστασίας στον κλάδο, έπειτα από περιστατικά ανεξέλεγκτης συμπεριφοράς αυτόνομων πρακτόρων αλλά και ανησυχίες που έχουν εκφραστεί δημόσια από κορυφαία στελέχη και ερευνητές. Σε συνεργασία με εταιρείες όπως η Anthropic, η OpenAI και η xAI, η Microsoft στηρίζει μια στρατηγική ελεγχόμενου ρυθμού εξέλιξης των μοντέλων αιχμής, επιδιώκοντας να διασφαλίσει ότι η τεχνολογική πρόοδος δεν θα θέσει σε κίνδυνο την ασφάλεια των χρηστών.
























