OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Anthropic: Μαζικές επιθέσεις «απόσταξης» δεδομένων από κινεζικές εταιρείες AI όπως οι Alibaba, Moonshot και DeepSeek

Σε μια αποκαλυπτική έκθεση προχώρησε η Anthropic, καταγγέλλοντας εκτεταμένες και συντονισμένες εκστρατείες υποκλοπής τεχνογνωσίας (distillation attacks) από κορυφαίες εταιρείες τεχνητής νοημοσύνης με έδρα την Κίνα. Σύμφωνα με την αμερικανική εταιρεία, κινεζικοί κολοσσοί και εργαστήρια τεχνητής νοημοσύνης, ανάμεσά τους οι Alibaba, Moonshot AI και DeepSeek, χρησιμοποίησαν εξελιγμένες τεχνικές για να παρακάμψουν τα μέτρα ασφαλείας και να «αντλήσουν» τις προηγμένες δυνατότητες συλλογιστικής του μοντέλου Claude.
Η τεχνική της «απόσταξης» και η στόχευση του Chain of Thought
Οι επιθέσεις απόσταξης (distillation) επικεντρώνονται στην εξαγωγή της εσωτερικής αλυσίδας σκέψης (Chain of Thought) ενός κορυφαίου μοντέλου τεχνητής νοημοσύνης. Μέσω αυτής της μεθόδου, οι επιτιθέμενοι συλλέγουν τον τρόπο με τον οποίο το μοντέλο επιλύει σύνθετα προβλήματα και χρησιμοποιούν αυτά τα δεδομένα για να εκπαιδεύσουν μικρότερα μοντέλα μέσω εποπτευόμενης λεπτομερούς ρύθμισης (supervised fine-tuning). Παρόλο που η Anthropic αποκρύπτει συνήθως τις πλήρεις εσωτερικές διεργασίες σκέψης, οι επιτιθέμενοι χρησιμοποίησαν ευφυείς προτροπές —όπως παραπλανητικά αιτήματα μετάφρασης σε ιαπωνικά katakana— για να υποκλέψουν τα δεδομένα συλλογισμού, κωδικοποίησης και ανάλυσης.
Η κλίμακα των επιθέσεων από Alibaba και Moonshot AI
Συνολικά, η Anthropic κατέγραψε σχεδόν 200 εκατομμύρια αλληλεπιδράσεις που συνδέονται με πέντε διακριτές εκστρατείες. Η μεγαλύτερη εξ αυτών αποδίδεται στην Alibaba, η οποία φέρεται να πραγματοποίησε 151 εκατομμύρια ανταλλαγές μηνυμάτων σε διάστημα τριών μηνών μέσω 3.500 λογαριασμών, με στόχο την εκπαίδευση της σειράς μοντέλων Qwen. Παράλληλα, η Moonshot AI, δημιουργός του Kimi, φέρεται να χρησιμοποίησε 5.000 λογαριασμούς για εκατοντάδες χιλιάδες αιτήματα προς το μοντέλο Opus, ορισμένα εκ των οποίων αφορούσαν ακόμη και ανάλυση υλικού παρακολούθησης.
Κλιμάκωση του παγκόσμιου ανταγωνισμού στην τεχνητή νοημοσύνη
Οι αποκαλύψεις αυτές αναδεικνύουν την ολοένα και πιο έντονη γεωπολιτική και τεχνολογική διαμάχη στον τομέα της τεχνητής νοημοσύνης. Καθώς τα κορυφαία αμερικανικά μοντέλα διατηρούν το προβάδισμα σε δυνατότητες λογικής και αυτόνομων πρακτόρων (agents), οι προσπάθειες παράκαμψης των περιορισμών μέσω αντίστροφης μηχανικής και μαζικής συλλογής δεδομένων αναμένεται να αποτελέσουν κεντρικό πεδίο τριβής για την ασφάλεια των συστημάτων AI διεθνώς.
























