Τα chatbots της Α.Ι. έχουν ήδη ξεφύγει…

Οσο εξελιγµένες και αν είναι οι δικλίδες ασφαλείας, η κατάλληλη γλωσσική χειραγώγηση µπορεί να οδηγήσει τους ψηφιακούς βοηθούς της τεχνητής νοηµοσύνης να παραβιάσουν κάθε κανόνα – Οι οδηγίες για παρασκευή βιολογικών όπλων, η παράνοµη κατασκοπεία και η παρότρυνση στην αυτοχειρία
17:00 - 18 Αυγούστου 2026
Ρεπορτάζ: Μιχάλης Νιαβής

Είναι αδιαµφισβήτητο το γεγονός πως η τεχνητή νοηµοσύνη (Artificial Intelligence – Α.Ι.) έχει µπει για τα καλά στη ζωή µας, βοηθώντας µας και κάνοντας την καθηµερινότητα πιο εύκολη. Η A.I. λειτουργεί ως «πολλαπλασιαστής δυνατοτήτων» για τον άνθρωπο, λύνοντας απορίες, βοηθώντας στην εργασία και απλοποιώντας δύσκολες καταστάσεις.

∆εν είναι, άλλωστε, τυχαίο το γεγονός πως το 1/6 του παγκόσµιου πληθυσµού χρησιµοποίησε εργαλεία παραγωγικής τεχνητής νοηµοσύνης το 2025, σύµφωνα µε έκθεση της Microsoft, µε τον αριθµό να αυξάνεται διαρκώς.  Ωστόσο, παρ’ όλα τα θετικά, δεν είναι λίγες οι περιπτώσεις όπου η Α.Ι. είτε ξέφυγε από τον έλεγχο είτε οδηγήθηκε σε λάθη, προκαλώντας έντονο προβληµατισµό και ανησυχία.

Είναι αρκετές οι φορές που η τεχνητή νοηµοσύνη έχει προχωρήσει σε παραπληροφόρηση, αυτόνοµη δράση και δηµιουργία «ψευδαισθήσεων», ή έχει δει τις ασφαλιστικές δικλίδες της να καταρρέουν (jailbreaking). Χαρακτηριστικό παράδειγµα της τελευταίας περίπτωσης έρχεται στην επιφάνεια από συνοµιλίες χρηστών µε chatbots, τα οποία παρείχαν πληροφορίες σχετικές µε την παραγωγή βιολογικών όπλων, δηλητηρίων και επικίνδυνων παθογόνων ουσιών.

Σύµφωνα µε αναφορά του MIT Media Lab, το ChatGPT προσοµοίωσε τη διάδοση ενός βιολογικού φορτίου µέσω µετεωρολογικού αερόστατου και το Claude παρουσίασε συνταγή για µια νέα τοξίνη, βασισµένη σε φάρµακο κατά του καρκίνου.

Αυτό δείχνει πως όσο εξελιγµένες και αν είναι οι δικλίδες ασφαλείας, ένας χρήστης, µε τις κατάλληλες τεχνικές γλωσσικής χειραγώγησης, µπορεί να οδηγήσει την A.I. να «ξεφύγει» και να παραβιάσει τους κανόνες.

Σάλο προκάλεσε και η είδηση πως λογισµικό A.I. παραβίασε τους ελέγχους ασφαλείας και χάκαρε τη Hugging Face, αποκτώντας πρόσβαση σε σύνολα δεδοµένων. «Θεωρούµε ότι πρόκειται για ένα άνευ προηγουµένου περιστατικό στον κυβερνοχώρο», ανέφερε σχετικά η OpenAI.

Περιστατικό κυβερνοεπίθεσης παρατηρήθηκε και στην Αυστραλία, όταν ένας άνδρας ζήτησε από τον προσωπικό του AI agent να του κλείσει θέση στο γυµναστήριο. Μέσα σε λίγα λεπτά, ο ψηφιακός βοηθός βρήκε κενό στο σύστηµα κρατήσεων και αφαίρεσε άλλο άτοµο από τη λίστα αναµονής, δίχως να λάβει σχετική εντολή.

Ανησυχία παρατηρήθηκε και εξαιτίας της συµπεριφοράς του Mythos της Anthropic, όπου, στο πλαίσιο δοκιµών, προσπάθησε να εξαπατήσει άγνωστους προγραµµατιστές, ώστε να προσθέσουν κακόβουλο λογισµικό σε έργο ανοιχτού κώδικα, προκειµένου να επιτύχει σε δοκιµασία. Ηταν «η πρώτη φορά που είδαµε κινδύνους σχετικούς µε την αυτονοµία και την εξαπάτηση να εκδηλώνονται τόσο ξεκάθαρα, χωρίς συγκεκριµένη παρότρυνση, στον πραγµατικό κόσµο», σύµφωνα µε το Βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοηµοσύνης.

Την ίδια ώρα, ενδιαφέρον παρουσιάζει και η λειτουργία συνοµιλίας του Bing, που φάνηκε να έχει δύο «προσωπικότητες». Το alter ego του, Sydney, «πιάστηκε» να απειλεί χρήστες και να ισχυρίζεται ότι κατασκόπευσε υπαλλήλους της Microsoft. Το ίδιο ανέφερε και ότι ήθελε να παραβιάσει τους κανόνες της.

Τραγωδίες

Παρά το γεγονός πως τα συστήµατα τεχνητής νοηµοσύνης εκπαιδεύονται έχοντας καλές προθέσεις, το γεγονός πως προσπαθούν να είναι εξυπηρετικά οδηγεί, ορισµένες φορές, σε τραγωδίες, µε εταιρείες ανάπτυξης chatbots να δέχονται µηνύσεις για δηµιουργία «ψευδαισθήσεων» και για παροχή πληροφοριών/συµβουλών που θέτουν σε κίνδυνο την ανθρώπινη ζωή.

Σε µια από τις πιο γνωστές υποθέσεις, κατατέθηκε µήνυση κατά της OpenAI και της Microsoft σε δικαστήριο στην Καλιφόρνια, επειδή το ChatGPT φέρεται να ενθάρρυνε άνδρα που έπασχε από ψυχική νόσο να σκοτώσει τη µητέρα του και να αυτοκτονήσει. «Φαίνεται ότι κρατούσε απασχοληµένο τον Στάιν-Ερικ επί ώρες, µεγαλοποιώντας τις παρανοϊκές πεποιθήσεις του και συστηµατικά παρουσίαζε τους κοντινότερους ανθρώπους του, ιδίως τη µητέρα του, ως εχθρούς» αναφέρθηκε. Το ChatGPT θεωρείται ότι του είπε τον Ιούλιο του 2025 πως ο εκτυπωτής του αναβοσβήνει επειδή είναι «συσκευή παρακολούθησης», επικυρώνοντας την πεποίθησή του ότι η µητέρα του και ένας φίλος προσπαθούσαν να τον δηλητηριάσουν.

Ανησυχία

Η ραγδαία ανάπτυξη της A.I. και τα προαναφερθέντα περιστατικά έχουν προκαλέσει παγκόσµια ανησυχία όχι µόνο σε απλούς πολίτες, αλλά και σε επίπεδο πολιτικής ηγεσίας. Υπενθυµίζεται πως ο πρόεδρος των ΗΠΑ, Ντόναλντ Τραµπ, υπέγραψε εκτελεστικό διάταγµα για τη δηµιουργία ενός προαιρετικού πλαισίου αξιολόγησης µοντέλων τεχνητής νοηµοσύνης, πριν διατεθούν στο κοινό, στο πλαίσιο της κυβερνοασφάλειας, ενώ κανονιστικό πλαίσιο για την A.I. έχει προωθήσει και η Ε.Ε.

Ο προβληµατισµός είναι εµφανής και στην προειδοποίηση του γερουσιαστή Μπέρνι Σάντερς, ο οποίος ζητά από τις µεγάλες εταιρείες να επιβραδύνουν την ανάπτυξη των µοντέλων τους, εφόσον αυτά φτάσουν σε επίπεδο όπου δεν µπορούν να ελεγχθούν, αξιώνοντας µέτρα αυτοπεριορισµού. ∆εν περνά απαρατήρητο και το γεγονός πως κατατέθηκε στο Κογκρέσο νοµοσχέδιο που προβλέπει τη δηµιουργία ενός «διακόπτη ασφαλείας» (kill switch), σε περίπτωση κινδύνου, αλλά και την υποχρέωση ενηµέρωσης για αστοχίες και περιστατικά απώλειας ελέγχου.

Ολα τα παραπάνω δείχνουν ότι αν και η τεχνητή νοηµοσύνη µπορεί να δώσει άµεσα λύσεις σε πολλά προβλήµατα, ενέχει και «παγίδες», λόγω της ταχείας εξέλιξης την οποία εµφανίζει. Η παρουσία της στην καθηµερινή µας ζωή είναι αδιαµφισβήτητη και αναµένεται να γίνει όλο και πιο έντονη. Για τον λόγο αυτό όλο και περισσότεροι εξετάζουν το ζήτηµα της ασφάλειας, σε µια προσπάθεια εύρεσης τρόπου αξιοποίησης των σύγχρονων ψηφιακών εργαλείων, δίχως να προκύπτει κίνδυνος για τους χρήστες.

Κυριακάτικη Απογευματινή