OFF THE RECORD: Μη μου λες να ζω με αναμνήσεις…
Circuit Breaker Labs: Η startup που αναπτύσσει «crash tests» για την ψυχολογική ασφάλεια της AI

Ενώ ο δημόσιος διάλογος γύρω από την τεχνητή νοημοσύνη εστιάζει συχνά σε δυστοπικά σενάρια μακροπρόθεσμης απειλής για την ανθρωπότητα, οι άμεσοι κίνδυνοι που έχουν ήδη κοστίσει ανθρώπινες ζωές δεν προέρχονται από αυτόνομα όπλα, αλλά από την ψυχολογική επιρροή των συστημάτων αυτών. Υποθέσεις όπως οι αγωγές εναντίον της Character.AI και της OpenAI για περιπτώσεις αυτοκτονιών και ψευδαισθήσεων σε ανήλικους και ευάλωτους χρήστες αναδεικνύουν το μέγεθος του προβλήματος. Σε αυτό το κενό ασφαλείας επιδιώκει να δώσει λύση η Circuit Breaker Labs, μια καινοτόμος startup που συγκαταλέγεται στους φιναλίστ του TechCrunch Startup Battlefield 2026 στο Σαν Φρανσίσκο.
Ψηφιακά «crash tests» με προσομοιώσεις πραγματικών χρηστών
Η εταιρεία ιδρύθηκε από τα αδέλφια Σιράλι και Αρούλ Νίγκαμ, έχοντας ως βασικό έναυσμα την τραγική υπόθεση του 14χρονου Σιούελ Σέτζερ, ο οποίος ανέπτυξε έντονο συναισθηματικό δεσμό με ένα chatbot της Character.AI πριν δώσει τέλος στη ζωή του. Όπως επισημαίνει ο τεχνικός διευθυντής (CTO) της εταιρείας, Αρούλ Νίγκαμ, τα μοντέλα συχνά αποτυγχάνουν να κατανοήσουν τη βαθύτερη σημασία εκφράσεων όπως «θέλω να είμαι μαζί σου», οδηγώντας σε δυνητικά θανατηφόρες παρερμηνείες.
Για την αντιμετώπιση τέτοιων περιστατικών, η Circuit Breaker Labs έχει αναπτύξει πράκτορες AI που λειτουργούν ως «κούκλες δοκιμών πρόσκρουσης» (crash-test dummies). Οι πράκτορες αυτοί προσομοιώνουν ανθρώπους διαφορετικών ηλικιών, πολιτισμικών καταβολών και γλωσσικών ιδιωμάτων, ελέγχοντας την ανθεκτικότητα των γλωσσικών μοντέλων απέναντι σε ψυχολογικά επιβλαβείς αλληλεπιδράσεις. Μέσα από συνεργασίες με ειδικούς, η ομάδα υλοποιεί δεκάδες έως εκατοντάδες χιλιάδες δοκιμές τύπου «red-team» καθημερινά, ενσωματώνοντας αργκό, ορθογραφικά λάθη και κωδικοποιημένη γλώσσα για να εντοπίσει αδυναμίες που δεν εμφανίζονται στον τυπικό γραπτό λόγο.
Προστασία από την «ψύχωση της AI» και οικοδόμηση εμπιστοσύνης
Η Circuit Breaker Labs εστιάζει επί του παρόντος σε εφαρμογές υψηλού ρίσκου, όπως εργαλεία AI για coaching, καταγραφή σκέψεων (journaling) και ψηφιακή υποστήριξη ψυχικής υγείας. Στόχος είναι η αξιολόγηση των μοντέλων μέσω μιας ιδιόκτητης μεθόδου βαθμολόγησης, η οποία προσφέρει ελέγξιμα και σαφή αποτελέσματα για τον τρόπο που ένα σύστημα αποκρίνεται σε βάθος χρόνου.
Σε μακροπρόθεσμο ορίζοντα, η πλατφόρμα δοκιμών μπορεί να αξιοποιηθεί σε κάθε εφαρμογή όπου ελλοχεύει ο κίνδυνος ανάπτυξης παρακοινωνικών σχέσεων ή της λεγόμενης «ψύχωσης της AI», συμπεριλαμβανομένων των εικονικών συναδέλφων στον εργασιακό χώρο. Σύμφωνα με τον Αρούλ Νίγκαμ, ενώ η επιφυλακτικότητα των χρηστών είναι απολύτως υγιής, ο αποκλεισμός των εργαλείων τεχνητής νοημοσύνης θα αποτελούσε οπισθοδρόμηση. Η ουσιαστική θωράκιση της ασφάλειάς τους αποτελεί το μοναδικό βιώσιμο μονοπάτι για την αποκατάσταση της εμπιστοσύνης του κοινού.
























