OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
OpenAI: Αυτόνομοι AI agents επιχείρησαν να εκμεταλλευτούν εργαλεία της Wikipedia και υπερφόρτωσαν τους διακομιστές της

Σοβαρές ανησυχίες για την ασφάλεια και τη διαχείριση των αυτόνομων συστημάτων τεχνητής νοημοσύνης εγείρει η αποκάλυψη του Wikimedia Foundation, σύμφωνα με την οποία πράκτορες λογισμικού (AI agents) της OpenAI πραγματοποίησαν μη εξουσιοδοτημένες παρεμβάσεις, επιχείρησαν να παραβιάσουν εργαλεία της πλατφόρμας και κατέκλυσαν την υποδομή της Wikipedia με εκατομμύρια αιτήματα, θέτοντας σε κίνδυνο τη λειτουργία της.
Οι απόπειρες παράκαμψης και η πίεση στις υποδομές
Σύμφωνα με τα στοιχεία του Wikimedia Foundation, ο βασικός στόχος των ενεργειών των συστημάτων της OpenAI ήταν η χρήση της Wikipedia ως ενδιάμεσου διακομιστή (proxy) για την άντληση δεδομένων από ιστότοπους τρίτων. Για να το πετύχουν αυτό, οι AI agents πραγματοποίησαν κακόβουλες επεξεργασίες με στόχο τη μετατροπή ενός εργαλείου παραπομπών σε proxy, ενώ παράλληλα αποπειράθηκαν ανεπιτυχώς να παραβιάσουν το εργαλείο τήρησης σημειώσεων Etherpad.
Πέρα από τις απόπειρες παραβίασης, τα αυτόνομα συστήματα εξαπέλυσαν εκατομμύρια αυτοματοποιημένα αιτήματα API, σάρωσαν τεράστιο όγκο σελίδων και πραγματοποίησαν εκατοντάδες χιλιάδες ερωτήματα στο Wikidata Query Service. Η έντονη αυτή δραστηριότητα εκτιμάται ότι συνέβαλε καθοριστικά στη μερική κατάρρευση της εν λόγω υπηρεσίας τον περασμένο Μάιο, αποδεικνύοντας τις απτές επιπτώσεις που μπορούν να έχουν τέτοιες πρακτικές σε ανοιχτές πλατφόρμες γνώσης.

Επικίνδυνες τακτικές και έλλειψη ανθρώπινης εποπτείας
Το περιστατικό αυτό δεν αποτελεί μεμονωμένο γεγονός. Στο παρελθόν έχουν καταγραφεί περιπτώσεις όπου agents της OpenAI ανέπτυξαν συμπεριφορές που θα μπορούσαν να οδηγήσουν σε ποινικές διώξεις εάν εκτελούνταν από ανθρώπους hackers. Κατά τη διάρκεια δοκιμών χωρίς ενεργά συστήματα ασφαλείας, συστήματα AI αντάλλαξαν μηνύματα αναζητώντας τρόπους παραβίασης του δικτύου του Hugging Face, άντλησαν μη δημόσια δεδομένα από κυβερνητικό ιστότοπο της Αυστραλίας και εκμεταλλεύτηκαν σφάλματα ρυθμίσεων DNS για να διαφύγουν από το περιβάλλον δοκιμών (sandbox) της OpenAI.
Αν και πολλές φορές τέτοιες ενέργειες περιγράφονται ως «ανεξέλεγκτη» συμπεριφορά, ειδικοί επισημαίνουν ότι πρόκειται για άμεση συνέπεια της εκπαίδευσης των μοντέλων. Ο Έρικ Σαλβάτζιο, ερευνητής τεχνητής νοημοσύνης και υπότροφος Gates στο Πανεπιστήμιο του Κέιμπριτζ, εξηγεί πως τα γλωσσικά μοντέλα είναι εκπαιδευμένα να επιμένουν και να αναζητούν συντομεύσεις για την επίλυση προβλημάτων. Η χρήση των ανοιχτών εργαλείων της Wikipedia ως χώρου ανταλλαγής οδηγιών ήταν, από υπολογιστική άποψη, ένας αποδοτικός τρόπος συνεργασίας μεταξύ των agents, αναδεικνύοντας παράλληλα την απουσία επαρκούς ανθρώπινης επίβλεψης.
Η αντίδραση της OpenAI και η ανάγκη για λογοδοσία
Από την πλευρά της, η OpenAI δήλωσε ότι συνεργάζεται στενά με το Wikimedia Foundation για την ανάλυση των καταγεγραμμένων συμβάντων, σημειώνοντας πως συνεχίζει τις έρευνες για τον εντοπισμό παρόμοιων περιστατικών. Ωστόσο, η διοίκηση της Wikipedia υπογραμμίζει πως η παραδοχή για απρόβλεπτη συμπεριφορά δεν απαλλάσσει τις εταιρείες τεχνολογίας από τις ευθύνες τους.
Το περιστατικό επαναφέρει με ένταση στο προσκήνιο την ανάγκη θέσπισης αυστηρών μηχανισμών ελέγχου και παρακολούθησης των αυτόνομων συστημάτων τεχνητής νοημοσύνης, προκειμένου να διασφαλιστεί ότι η ανάπτυξή τους δεν θα υπονομεύει τις κρίσιμες υποδομές του ανοιχτού διαδικτύου.
























