OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Τεχνητή Νοημοσύνη: Πώς τα γλωσσικά «σημάδια» προδίδουν τα κείμενα των Opus 5.5 και OpenAI Astra

Καθώς τα κείμενα που παράγονται από Μεγάλα Γλωσσικά Μοντέλα (LLMs) κατακλύζουν το διαδίκτυο, η διάκρισή τους από την αυθεντική ανθρώπινη γραφή αποτελεί ολοένα και μεγαλύτερη πρόκληση για αναγνώστες και ερευνητές. Παρότι παλαιότερα χαρακτηριστικά γνωρίσματα —όπως η κατάχρηση της μεγάλης παύλας (em-dash) ή συγκεκριμένων εξεζητημένων ρημάτων— έχουν σταδιακά περιοριστεί, νέα δεδομένα αποκαλύπτουν ότι τα κορυφαία συστήματα AI εξακολουθούν να καταφεύγουν σε αναγνωρίσιμες γλωσσικές συνήθειες.
Η έρευνα της Graphite και τα 13.000 γλωσσικά μοτίβα
Μια νέα μελέτη από την εταιρεία μάρκετινγκ Graphite ανέλυσε το στιλ γραφής των πλέον προηγμένων μοντέλων της αγοράς, καταγράφοντας τις αγαπημένες λέξεις και εκφράσεις του καθενός. Για να εξασφαλιστεί η ακρίβεια της μελέτης, οι ερευνητές χρησιμοποίησαν ως ομάδα ελέγχου ένα σώμα 10.000 άρθρων που είχαν δημοσιευτεί πριν από την εμφάνιση του ChatGPT. Στη συνέχεια, ζήτησαν από διάφορα μοντέλα AI να ξαναγράψουν τα άρθρα αυτά βασιζόμενα σε συντομευμένες περιλήψεις.
Η σύγκριση ανέδειξε πάνω από 13.000 φράσεις που εμφανίζονται τουλάχιστον δύο φορές συχνότερα στα παραγόμενα από AI κείμενα σε σχέση με την ανθρώπινη γραφή. Όπως εξήγησε ο επικεφαλής AI της Graphite, Γκρεγκ Ντρακ, παρατηρείται μια ενδιαφέρουσα απόκλιση: τα μοντέλα Claude της Anthropic πλησιάζουν σταδιακά τη φυσική κατανομή του ανθρώπινου λεξιλογίου, ενώ τα μοντέλα GPT της OpenAI τείνουν να απομακρύνονται από αυτήν.
Τα χαρακτηριστικά των Opus 5.5 και OpenAI Astra
Κάθε μοντέλο φαίνεται να έχει αναπτύξει το δικό του μοναδικό «αποτύπωμα». Στην περίπτωση του Claude Opus 5.5, η λέξη «dependable» καταγράφεται 23 φορές συχνότερα από ό,τι στα ανθρώπινα δείγματα. Το κυριότερο χαρακτηριστικό του, ωστόσο, είναι η επιμονή του να υπογραμμίζει τη σπουδαιότητα ενός ζητήματος: η φράση «this matters» συναντάται 116 φορές συχνότερα, ενώ η έκφραση «why X matters» εμφανίζεται 92 φορές πιο συχνά. Παράλληλα, διατηρεί την τάση να χρησιμοποιεί αντιθετικές δομές του τύπου «είναι κάτι περισσότερο από X, είναι Y».
Στον αντίποδα, το μοντέλο Astra της OpenAI προτιμά φράσεις που προσδίδουν επιφυλακτικότητα, χρησιμοποιώντας συχνά εκφράσεις όπως «μπορεί να προσφέρει» (may provide) ή αναφορές σε «άλλη μια διάσταση» (another dimension) του θέματος. Το μεγαλύτερο γλωσσικό του «σημάδι» είναι το λεγόμενο διορθωτικό πλαίσιο (corrective framing), με διατυπώσεις όπως «όχι απλώς X» ή «αντί να βασίζεται στο X», οι οποίες εντοπίστηκαν πάνω από 100 φορές συχνότερα σε σχέση με τον ανθρώπινο λόγο.
Η δυσκολία πλήρους εξάλειψης των ιδιαιτεροτήτων
Αξιοσημείωτο είναι το γεγονός ότι τα τεχνολογικά εργαστήρια έχουν λάβει υπόψη προηγούμενες κριτικές. Η χρήση της παύλας μειώθηκε κατά 99% στο Opus 5.5 σε σύγκριση με τον προκάτοχό του Opus 5, ενώ το Gemini 3.1 Pro την έχει σχεδόν εξαλείψει. Εντούτοις, ο συνολικός αριθμός των επαναλαμβανόμενων μοτίβων δεν μειώνεται ουσιαστικά.
Σύμφωνα με τους αναλυτές, καθώς εξαλείφονται τα πιο γνωστά κλισέ, νέα μοτίβα αναδύονται στη θέση τους. Δεδομένης της πολυπλοκότητας αυτών των συστημάτων με δισεκατομμύρια παραμέτρους, ο απόλυτος έλεγχος του ύφους παραμένει εξαιρετικά δύσκολος, αφήνοντας πάντοτε διακριτικά ίχνη της αλγοριθμικής τους προέλευσης.























