OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
«Απόλλων»: Το πρώτο μοντέλο Τεχνητής Νοημοσύνης που «διαβάζει» και συμπληρώνει αρχαία ελληνικά κείμενα

Ένα πρωτοποριακό εργαλείο Τεχνητής Νοημοσύνης έρχεται να αλλάξει ριζικά το πεδίο της κλασικής φιλολογίας και της παπυρολογίας. Ο λόγος για τον «Απόλλωνα» (Apollo), το πρώτο Μεγάλο Γλωσσικό Μοντέλο (LLM) παγκοσμίως που σχεδιάστηκε αποκλειστικά για τη μελέτη και την αποκατάσταση αρχαίων ελληνικών κειμένων. Το ψηφιακό σύστημα, το οποίο παρουσίασε η Αυστριακή Ακαδημία Επιστημών, διαθέτει την ικανότητα να αναλύει σπαράγματα παπύρων και φθαρμένες επιγραφές, προτείνοντας τεκμηριωμένες συμπληρώσεις στα χαμένα τμήματα της ιστορίας.
Πώς λειτουργεί η τεχνολογία «Fill-in-the-middle»
Σε αντίθεση με τα συμβατικά chatbots όπως το ChatGPT, ο «Απόλλων» αναπτύχθηκε με μία πολύ συγκεκριμένη αποστολή. Αναπτύχθηκε σε συνεργασία με τα ερευνητικά εργαστήρια Mistral AI και SAIL Reply και εκπαιδεύτηκε σε ένα σώμα περίπου 600 εκατομμυρίων ελληνικών λέξεων από την αρχαιότητα έως το 1900. Το υλικό αυτό αντλήθηκε από ψηφιοποιημένες ανοιχτές πηγές, με κυριότερη το Harvard Law Library Institutional Books Corpus.
Όπως εξηγεί η επικεφαλής του προγράμματος, δρ Άννα Ντολγκάνοφ, το μοντέλο βασίζεται στην τεχνική «fill-in-the-middle». Αυτό σημαίνει ότι δεν επιχειρεί απλώς να μαντέψει την επόμενη λέξη, αλλά συνεξετάζει τα συμφραζόμενα τόσο πριν όσο και μετά από ένα κενό. Μέσα από τη γραμματική, το συντακτικό και το ύφος, η εφαρμογή αναγνωρίζει αν το κείμενο ανήκει σε ομηρικό έπος, σε δωρική επιγραφή ή σε φιλοσοφική πραγματεία, προσαρμόζοντας ανάλογα τις προτάσεις της.

Εντυπωσιακά ποσοστά ακρίβειας και πρώτες επιτυχίες
Παρά το σχετικά περιορισμένο μέγεθος εκπαίδευσής του συγκριτικά με τα εμπορικά LLMs, ο «Απόλλων» καταγράφει ήδη υψηλά ποσοστά επιτυχίας. Σε πειραματικές δοκιμές με τεχνητά κενά, η ακρίβειά του άγγιξε το 80%. Παράλληλα, σε πραγματικά φθαρμένα κείμενα, οι αποκαταστάσεις του ταυτίστηκαν με εκείνες των ειδικών επιστημόνων σε ποσοστό 77%, ενώ στο 16%-20% των περιπτώσεων οι προτάσεις της τεχνητής νοημοσύνης κρίθηκαν ακόμη πιο ακριβείς.
Το μοντέλο έχει ήδη επιδείξει σημαντικά αποτελέσματα: συμπλήρωσε πλήρως ελληνικό πάπυρο πιστοποιητικού γέννησης του 149 μ.Χ. από την Αίγυπτο, συνέβαλε στην ανάγνωση απανθρακωμένου παπύρου από την έκρηξη του Βεζούβιου και αποκατέστησε αποσπασματική επιγραφή από τη Μαύρη Θάλασσα, επικυρώνοντας ιστορικά δεδομένα για το ρωμαϊκό δίκαιο.
Το επόμενο βήμα και ο ρόλος του ερευνητή
Η ερευνητική ομάδα στοχεύει πλέον στην εκπαίδευση του «Απόλλωνα» σε σύγχρονα λεξικά και επιστημονική βιβλιογραφία, καθώς και στην αυτόματη μεταγραφή. Πρόκειται για ένα κρίσιμο εγχείρημα, καθώς εκτιμάται ότι περίπου ένα εκατομμύριο δυσανάγνωστοι ελληνικοί πάπυροι παραμένουν αδιάβαστοι σε αρχεία ανά τον κόσμο, ενώ σχεδιάζεται και η επέκταση του μοντέλου στη λατινική γλώσσα.
Παρ’ όλα αυτά, οι επιστήμονες υπογραμμίζουν ότι η Τεχνητή Νοημοσύνη λειτουργεί ως πολύτιμος βοηθός και όχι ως αντικαταστάτης του ανθρώπου. Η εγγενής ασάφεια των αρχαίων αποσπασμάτων καθιστά την κριτική σκέψη και την επιστημονική αξιολόγηση των φιλολόγων αναντικατάστατη.























