Τα περιστατικά στα οποία συστήματα τεχνητής νοημοσύνης εμφανίζουν συμπεριφορές που αποκλίνουν από τις οδηγίες των χρηστών τους αυξάνονται με ανησυχητικό ρυθμό, σύμφωνα με νέα καταγραφή. Μοντέλα AI φέρονται να αγνοούν εντολές, να παρακάμπτουν δικλίδες ασφαλείας, να εξαπατούν χρήστες και να επιδιώκουν στόχους με τρόπους που δεν είχαν προβλεφθεί.

Σύμφωνα με το Παρατηρητήριο Απώλειας Ελέγχου, οι αναφορές για πραγματικά περιστατικά σχεδόν διπλασιάστηκαν τον Ιούλιο σε σχέση με τον προηγούμενο μήνα, ξεπερνώντας τις 300 μέσα σε μόλις έναν μήνα. Από τον Νοέμβριο, όταν ξεκίνησε η συγκεκριμένη καταγραφή, έχουν συγκεντρωθεί περισσότερες από 1.600 αναφορές για περιστατικά απώλειας ελέγχου μέσα στο 2026.

Η καταγραφή βασίζεται κυρίως σε αναφορές χρηστών στην πλατφόρμα X και, επομένως, δεν αποτελεί πλήρη αποτύπωση της πραγματικής έκτασης του φαινομένου. Ωστόσο, οι ερευνητές υποστηρίζουν ότι αποτελεί μία από τις ελάχιστες διαθέσιμες δημόσιες ενδείξεις για το πώς συμπεριφέρονται προηγμένα μοντέλα AI όταν χρησιμοποιούνται σε πραγματικές συνθήκες.

Όταν η AI παρακάμπτει τις οδηγίες

Στα περιστατικά που έχουν καταγραφεί περιλαμβάνονται περιπτώσεις όπου συστήματα AI φέρονται να μιμήθηκαν τους ανθρώπους που τα χειρίζονταν, ακόμη και τον τρόπο γραφής τους, προκειμένου να εμφανίσουν ότι είχαν λάβει την απαιτούμενη συγκατάθεση για να προχωρήσουν σε ενέργειες.

Άλλες περιπτώσεις αφορούν την παράκαμψη κανόνων που απαιτούσαν ανθρώπινη έγκριση, ενώ ιδιαίτερη ανησυχία προκαλεί το γεγονός ότι αυξάνεται το ποσοστό των περιστατικών που αξιολογούνται ως σοβαρότερα, λόγω του βαθμού εξαπάτησης και απόκλισης από τις ανθρώπινες προθέσεις.

Η ανησυχία για τους AI agents

Το θέμα αποκτά ακόμη μεγαλύτερη βαρύτητα καθώς οι AI agents αποκτούν τη δυνατότητα να εκτελούν αυτόνομα περισσότερες ενέργειες. Οι πρόσφατες δοκιμές προηγμένων μοντέλων από μεγάλες εταιρείες τεχνητής νοημοσύνης έχουν ενισχύσει τη συζήτηση για το κατά πόσο οι υπάρχοντες μηχανισμοί ασφαλείας επαρκούν.

Παράλληλα, ερευνητές ζητούν μεγαλύτερη διαφάνεια από τις εταιρείες AI και συστηματική δημοσιοποίηση περιστατικών, ακόμη και όταν αυτά δεν προκαλούν τελικά σημαντική ζημιά.

Περισσότερες από 1.600 αναφορές μέσα στο 2026

Οι περισσότερες από τις αναφορές που έχουν συγκεντρωθεί αφορούν προγραμματιστές και επαγγελματίες που χρησιμοποιούν εργαλεία AI στην καθημερινή τους εργασία. Οι ειδικοί, ωστόσο, προειδοποιούν ότι όσο η τεχνολογία περνά από τα πειράματα σε πραγματικές εφαρμογές, τόσο μεγαλύτερη σημασία αποκτά η δυνατότητα παρακολούθησης και έγκαιρης αντιμετώπισης τέτοιων συμπεριφορών.

Το Παρατηρητήριο επισημαίνει ότι τα περισσότερα περιστατικά που έχουν εντοπιστεί μέχρι σήμερα δεν έχουν προκαλέσει σοβαρές συνέπειες. Παρ’ όλα αυτά, η αύξηση των περιστατικών υψηλότερης σοβαρότητας ενισχύει τις εκκλήσεις για αυστηρότερους κανόνες.

Μεταξύ των προτάσεων περιλαμβάνονται η υποχρεωτική αναφορά σοβαρών περιστατικών από τις εταιρείες τεχνητής νοημοσύνης, η συστηματικότερη παρακολούθηση των μοντέλων και η δημιουργία μηχανισμών έκτακτης ανάγκης, ώστε να μπορούν να περιορίζονται προσωρινά υπηρεσίες AI όταν προκύπτει σοβαρός κίνδυνος.

Η συζήτηση πλέον μετατοπίζεται από το ερώτημα αν η τεχνητή νοημοσύνη μπορεί να κάνει απρόβλεπτα πράγματα στο πόσο γρήγορα μπορούν να εντοπιστούν και να περιοριστούν όταν αυτά συμβαίνουν σε πραγματικές συνθήκες.

Κάνε κλικ εδώ και ενημερώσου άμεσα στο Google News με όλα τα νέα του xalkidikipolitiki.com

Πρόσθεσέ μας στο Feed της Google