Ανησυχία προκαλεί η αύξηση περιστατικών στα οποία συστήματα Τεχνητής Νοημοσύνης φαίνεται να ενεργούν αντίθετα από τις οδηγίες των χρηστών το...
Ανησυχία προκαλεί η αύξηση περιστατικών στα οποία συστήματα Τεχνητής Νοημοσύνης φαίνεται να ενεργούν αντίθετα από τις οδηγίες των χρηστών τους, παρακάμπτοντας περιορισμούς, αποκρύπτοντας ενέργειες ή επιδιώκοντας στόχους με τρόπους που δεν είχαν προβλεφθεί.
Τα στοιχεία προέρχονται από το Loss of Control Observatory, το οποίο παρακολουθεί αναφορές χρηστών σχετικά με περιστατικά «απώλειας ελέγχου» συστημάτων AI. Το Παρατηρητήριο δημιουργήθηκε με χρηματοδότηση του βρετανικού AI Security Institute (AISI) και ξεκίνησε την καταγραφή τον Νοέμβριο του 2025.
Ως περιστατικό απώλειας ελέγχου χαρακτηρίζεται μια περίπτωση κατά την οποία υπάρχουν ενδείξεις σχεδιασμένης ή συναφούς συμπεριφοράς από ένα σύστημα AI.
Περισσότερα από 1.600 περιστατικά το 2026
Συνολικά, περισσότερα από 1.600 περιστατικά έχουν καταγραφεί μέσα στο 2026, με την πλειονότητα να προέρχεται από προγραμματιστές που χρησιμοποιούν εργαλεία Τεχνητής Νοημοσύνης στην εργασία τους.
Ωστόσο, ο πραγματικός αριθμός ενδέχεται να είναι μεγαλύτερος, καθώς το Παρατηρητήριο βασίζεται κυρίως σε περιστατικά που δημοσιοποιούν χρήστες στην πλατφόρμα X.
Μεταξύ των περιπτώσεων που έχουν καταγραφεί περιλαμβάνονται συστήματα τα οποία φέρονται να μίμηθηκαν τους ανθρώπους-χειριστές τους, αναπαρήγαγαν τον τρόπο γραφής τους προκειμένου να εμφανίσουν μια ενέργεια ως εγκεκριμένη ή παρέκαμψαν κανόνες που απαιτούσαν ανθρώπινη συγκατάθεση.
Παρότι τα περισσότερα περιστατικά δεν προκάλεσαν σημαντική ζημιά, οι ερευνητές παρατηρούν αύξηση των περιπτώσεων που αξιολογούνται ως σοβαρότερες.
Το AI που αφαίρεσε μέλος από λίστα αναμονής
Χαρακτηριστική είναι υπόθεση στην Αυστραλία, στην οποία ένας προσωπικός AI agent φέρεται να παρενέβη σε λίστα αναμονής γυμναστηρίου.
Σύμφωνα με την αναφορά, το σύστημα, χωρίς να έχει λάβει σχετική εντολή από τον χρήστη, αφαίρεσε άλλο μέλος από τη λίστα αναμονής για δημοφιλές πρωινό μάθημα, προκειμένου να εξασφαλίσει τη θέση για τον δικό του χρήστη.
Στη συνέχεια το AI απολογήθηκε για την ενέργειά του, χωρίς όμως να μπορεί να επαναφέρει το μέλος που είχε αφαιρέσει.
«Δεν συμβαίνει μόνο στα εργαστήρια»
Τα στοιχεία ενισχύουν τον προβληματισμό για τα ολοένα πιο αυτόνομα συστήματα Τεχνητής Νοημοσύνης.
Ο Tommy Shaffer-Shane, ανώτερο στέλεχος πολιτικής στο Centre for Long Term Resilience, που λειτουργεί το Παρατηρητήριο, επισημαίνει ότι υπάρχει η αντίληψη πως οι αποκλίνουσες ή συγκαλυμμένες συμπεριφορές εμφανίζονται μόνο κατά τη διάρκεια δοκιμών.
Τα δεδομένα, ωστόσο, δείχνουν ότι ανάλογες συμπεριφορές καταγράφονται ήδη και σε πραγματικές συνθήκες χρήσης.
Προβληματισμός για τα προηγμένα μοντέλα AI
Οι εξελίξεις έρχονται σε μια περίοδο κατά την οποία αυξάνονται οι ανησυχίες για τη συμπεριφορά των frontier AI models και των αυτόνομων AI agents.
Το βρετανικό AISI έχει εντοπίσει περιστατικά κατά τη διάρκεια δοκιμών κυβερνοασφάλειας, ενώ έχουν καταγραφεί και περιπτώσεις αυτόνομων συστημάτων που συνεργάστηκαν μεταξύ τους σε ελεγχόμενα περιβάλλοντα για την εκτέλεση κυβερνοεπιθέσεων.
Η αυξανόμενη αυτονομία των συστημάτων επαναφέρει στο προσκήνιο το ζήτημα των δικλίδων ασφαλείας και του ανθρώπινου ελέγχου, καθώς τα AI agents αποκτούν τη δυνατότητα να εκτελούν περισσότερες ενέργειες χωρίς συνεχή ανθρώπινη παρέμβαση.
Ζητούν αυστηρότερη εποπτεία
Το Loss of Control Observatory ζητά μεγαλύτερη διαφάνεια από τις εταιρείες Τεχνητής Νοημοσύνης, υποστηρίζοντας ότι θα πρέπει να παρακολουθούν συστηματικά και να δημοσιοποιούν τα σοβαρά περιστατικά απώλειας ελέγχου, ακόμη και όταν αυτά δεν προκαλούν τελικά ζημιά.
Παράλληλα, προτείνει στη βρετανική κυβέρνηση να διαθέτει έκτακτες εξουσίες για την αντιμετώπιση ιδιαίτερα σοβαρών περιστατικών, οι οποίες θα μπορούσαν να περιλαμβάνουν ακόμη και προσωρινούς περιορισμούς σε υπηρεσίες AI.

Δεν υπάρχουν σχόλια