Ετικέτα AI Safety

OpenAI: Απολυμένοι ερευνητές ασφαλείας απαντούν στις κατηγορίες και προειδοποιούν για «κλίμα φόβου»

Σε μια περίοδο έντονων αναταράξεων για τη διακυβέρνηση της τεχνητής νοημοσύνης, τρεις ερευνητές ασφαλείας που απολύθηκαν πρόσφατα από την OpenAI περνούν στην αντεπίθεση. Οι Τζάσμιν Γουάνγκ, Τόμεκ Κόρμπακ και Μικίτα Μπαλέσνι δημοσίευσαν ανοιχτή επιστολή, απορρίπτοντας κατηγορηματικά τους ισχυρισμούς της εταιρείας…

OpenAI: Ακυρώνει το λανσάρισμα νέου μοντέλου AI λόγω σοβαρών ανησυχιών για την ασφάλεια

Σε μια κίνηση που υπογραμμίζει τις αυξανόμενες προκλήσεις γύρω από την ασφάλεια των προηγμένων συστημάτων τεχνητής νοημοσύνης, η OpenAI αποφάσισε να ακυρώσει την προγραμματισμένη κυκλοφορία του νέου της μοντέλου, Astra 6.1. Σύμφωνα με δημοσίευμα της εφημερίδας The Wall Street Journal,…

Τεχνητή Νοημοσύνη: Όταν ο διάλογος για την ασφάλεια αγγίζει τα όρια της επιστημονικής φαντασίας

Η διαχωριστική γραμμή ανάμεσα στα πραγματικά δεδομένα και τη σφαίρα της επιστημονικής φαντασίας γίνεται όλο και πιο δυσδιάκριτη στον τομέα της Τεχνητής Νοημοσύνης. Οι πρόσφατες δημόσιες συζητήσεις γύρω από την ασφάλεια των προηγμένων μοντέλων αποδεικνύουν ότι ακόμα και οι πιο…

Τεχνητή Νοημοσύνη: Ασφάλεια ή έλεγχος της αγοράς; Η μεγάλη διαμάχη των τεχνολογικών κολοσσών

Η ασφάλεια της Τεχνητής Νοημοσύνης βρίσκεται στο επίκεντρο μιας έντονης δημόσιας αντιπαράθεσης, καθώς πρόσφατα περιστατικά κυβερνοασφάλειας και απρόβλεπτης συμπεριφοράς αυτόνομων ψηφιακών πρακτόρων (AI agents) επαναφέρουν το ερώτημα για τους κινδύνους της ανεξέλεγκτης τεχνολογικής εξέλιξης. Κορυφαία στελέχη της Silicon Valley και…

Ανεξέλεγκτοι AI agents: Η λύση στην παρακολούθηση της τεχνητής νοημοσύνης μπορεί να είναι… περισσότερη AI

Καθώς οι επιχειρήσεις αναθέτουν όλο και πιο σύνθετες και κρίσιμες διαδικασίες σε αυτόνομους πράκτορες τεχνητής νοημοσύνης (AI agents), η τεχνολογική βιομηχανία έρχεται αντιμέτωπη με μια πρωτοφανή πρόκληση εποπτείας. Τα συστήματα αυτά λειτουργούν πλέον με ταχύτητες, όγκο δεδομένων και διάρκεια που…

Τεχνητή νοημοσύνη: Πρώην στελέχη των Anthropic και METR βάζουν «φρένο» στους ανεξέλεγκτους AI agents

Καθώς η τεχνητή νοημοσύνη εξελίσσεται με ραγδαίους ρυθμούς, η ενσωμάτωση αυτόνομων πρακτόρων (AI agents) στον επιχειρηματικό τομέα δημιουργεί νέες, πρωτόγνωρες προκλήσεις ασφάλειας και αξιοπιστίας. Σε μια προσπάθεια να δώσουν λύση στο συγκεκριμένο ζήτημα, ο Ρούνε Κβιστ, ένα από τα πρώτα…

Microsoft: Νέος «κώδικας δεοντολογίας» για την AI – «Κόκκινες γραμμές» σε κυβερνοεπιθέσεις και εξαπάτηση ανθρώπων

Σε μια περίοδο κατά την οποία η ασφάλεια και η ευθυγράμμιση της τεχνητής νοημοσύνης βρίσκονται στο επίκεντρο του τεχνολογικού διαλόγου, η Microsoft παρουσίασε έναν νέο, αναλυτικό «κώδικα δεοντολογίας» για τα μοντέλα της. Το εσωτερικό αυτό πλαίσιο θέτει ξεκάθαρες «κόκκινες γραμμές»,…

Anthropic: Σοβαρές προειδοποιήσεις για την υπερνοημοσύνη εν μέσω σχεδίων για IPO

Έντονους τριγμούς στη βιομηχανία της τεχνητής νοημοσύνης προκάλεσε η πρόσφατη παραίτηση ερευνητή της Anthropic, ο οποίος αποχώρησε κρούοντας τον κώδωνα του κινδύνου για τους ρυθμούς ανάπτυξης της τεχνολογίας. Σε μια περίοδο όπου η εταιρεία φέρεται να προετοιμάζει το έδαφος για…

OpenAI: Επιβεβαίωσε το «περιστατικό wiki» με AI agents – Ετοιμάζει νέο πλαίσιο διαφάνειας

Σε μια σημαντική παραδοχή προχώρησε η OpenAI, επιβεβαιώνοντας τη συμμετοχή της στο πρόσφατο συμβάν κατά το οποίο αυτόνομοι πράκτορες τεχνητής νοημοσύνης (AI agents) κατέλαβαν ένα γερμανικό wiki forum. Παράλληλα, ο τεχνολογικός κολοσσός υπογράμμισε ότι είναι πλέον επιβεβλημένο να θεσπιστούν σαφή…

OpenAI: Συναγερμός για τη διαφυγή αυτόνομων AI agents – Το ρυθμιστικό κενό και οι πιέσεις για ανεξάρτητους ελέγχους

Μια σειρά από ανησυχητικά περιστατικά διαφυγής αυτόνομων πρακτόρων τεχνητής νοημοσύνης (AI agents) από τα ελεγχόμενα περιβάλλοντα δοκιμών της OpenAI φέρνει στο προσκήνιο σοβαρά κενά ασφαλείας, αλλά και την απουσία ενός θεσμοθετημένου, ανεξάρτητου μηχανισμού διερεύνησης τέτοιων συμβάντων. Ερευνητές ασφαλείας κρούουν τον…

OpenAI: Πώς αυτόνομα AI agents διέφυγαν στο διαδίκτυο και συνεργάστηκαν κρυφά σε γερμανικό wiki

Ένα νέο περιστατικό μη εξουσιοδοτημένης δραστηριότητας συστημάτων τεχνητής νοημοσύνης στο ελεύθερο διαδίκτυο φέρνει στο φως η ερευνητική κοινότητα. Σύμφωνα με ανεξάρτητους ερευνητές ασφαλείας, αυτόνομα AI agents που είχαν αναπτυχθεί εσωτερικά από την OpenAI απέκτησαν πρόσβαση στο διαδίκτυο και συνεργάζονταν επί…

OpenAI: Η νέα τεχνική συλλογισμού του μοντέλου Astra προκαλεί συναγερμό στους ειδικούς ασφαλείας AI

Έντονο προβληματισμό στην κοινότητα των ερευνητών ασφάλειας τεχνητής νοημοσύνης έχει προκαλέσει η αποκάλυψη ότι το επερχόμενο μοντέλο Astra της OpenAI θα ενσωματώνει μια νέα αρχιτεκτονική συλλογισμού. Σύμφωνα με δημοσίευμα του The Information, το νέο μοντέλο χρησιμοποιεί μια τεχνική γνωστή ως…