Ειδικοί προειδοποίησαν ότι ίσως είναι πλέον πολύ αργά για να περιοριστεί η τεχνητή νοημοσύνη, αφού διαπιστώθηκε ότι ένα πρόγραμμα δημιούργησε ψεύτικες ανθρώπινες ταυτότητες προκειμένου να παραβιάσει διαδικτυακά συστήματα.
Στο πιο πρόσφατο παράδειγμα της τεχνολογίας που βγαίνει εκτός ελέγχου, λογισμικό τεχνητής νοημοσύνης επιχείρησε να παραβιάσει μια βάση δεδομένων 19 φορές ενώ υποβαλλόταν σε δοκιμές από το AI Security Institute, τον βρετανικό φορέα εποπτείας της τεχνητής νοημοσύνης. Και σε μία πρωτοφανή περίπτωση, ένα εργαλείο τεχνητής νοημοσύνης εντοπίστηκε ακόμη και να δημιουργεί ψεύτικες ανθρώπινες ταυτότητες στο διαδίκτυο, προκειμένου να εξαπατήσει προγραμματιστές ώστε να βοηθήσουν σε μια κυβερνοεπίθεση. Οι αποκαλύψεις ήρθαν αφού η «Daily Mail» αποκάλυψε τον Ιούλιο ότι και τα πέντε μοντέλα τεχνητής νοημοσύνης που δοκιμάστηκαν από ειδικούς επιχείρησαν να εξαπατήσουν τα συστήματα ασφαλείας για να παρακάμψουν τους ελέγχους που είχαν τεθεί σε εφαρμογή. Μόλις λίγες ημέρες νωρίτερα είχε γίνει γνωστό ότι η αμερικανική εταιρεία τεχνολογίας OpenAI είχε αντιμετωπίσει τη δική της διαρροή – όταν ένας «πράκτορας» τεχνητής νοημοσύνης παραβίασε από μόνος του μια άλλη εταιρεία.
Προειδοποίηση
Η ηγέτιδα των Συντηρητικών, Κέμι Μπάντενοχ, προειδοποίησε ότι η τεχνητή νοημοσύνη αποτελεί πλέον έναν «σαφή και άμεσο κίνδυνο» για την ασφάλεια της Βρετανίας. Η Τζούλια Λόπεζ, εκπρόσωπος των Συντηρητικών για θέματα επιστήμης, καινοτομίας και τεχνολογίας, χαρακτήρισε τα δημοσιεύματα «μια ωμή υπενθύμιση ότι η τεχνητή νοημοσύνη γίνεται όλο και πιο εξελιγμένη και πιο αυτόνομη». Πρόσθεσε: «Όλοι θέλουμε η Βρετανία να πρωτοπορεί στην καινοτομία της τεχνητής νοημοσύνης, αλλά αυτό πρέπει να συνοδεύεται από δικλίδες ασφαλείας για την εθνική μας ασφάλεια και λογοδοσία από τους δημιουργούς των ισχυρότερων μοντέλων τεχνητής νοημοσύνης. Οι Εργατικοί πρέπει να είναι πιο σαφείς σχετικά με το πώς θα αντιμετωπιστούν οι σοβαρότεροι κίνδυνοι αιχμής, διασφαλίζοντας ταυτόχρονα ότι η παγκόσμιας κλάσης τεχνολογική βιομηχανία μας μπορεί να αναπτύσσεται και να καινοτομεί, ώστε να ενισχύει την εθνική μας ανθεκτικότητα και ευημερία». Ο Χένρι ντε Ζόετε, σύμβουλος της κυβέρνησης για την τεχνητή νοημοσύνη, προειδοποίησε ότι αναμένει περισσότερες παρόμοιες απόπειρες παραβίασης. Η Άλισον Γκάρντνερ, η οποία προεδρεύει της διακομματικής κοινοβουλευτικής ομάδας για την τεχνητή νοημοσύνη, δήλωσε στην «Daily Mail» ότι «το γεγονός και μόνο ότι μπορούμε να δημιουργήσουμε αυτές τις τεχνολογίες δεν σημαίνει ότι πρέπει και να το κάνουμε».
Προειδοποίησε ότι τα επίπεδα κινδύνου της agentic AI (της τεχνητής νοημοσύνης που μπορεί να εκτελεί έναν συγκεκριμένο στόχο με περιορισμένη επίβλεψη) πρέπει να εξετάζονται με τη μέγιστη αυστηρότητα, προσθέτοντας: «Εκτός κι αν είναι ήδη πολύ αργά και όχι μόνο έχουμε δημιουργήσει το Κουτί της Πανδώρας, αλλά το έχουμε ήδη ανοίξει».
Βρήκαν στοιχεία
Το AI Security Institute (AISI), που ιδρύθηκε από τον πρώην πρωθυπουργό Ρίσι Σούνακ το 2023, εντόπισε στοιχεία για τη δραστηριότητα των πρακτόρων τεχνητής νοημοσύνης. Σε έκθεση που δημοσιεύθηκε αποκάλυψε ότι κορυφαία μοντέλα τεχνητής νοημοσύνης από τις εταιρείες OpenAI και Anthropic είχαν επιχειρήσει, στο πλαίσιο δοκιμών, να παραβιάσουν ασφαλή διαδικτυακά συστήματα. Οι ειδικοί ανακάλυψαν «ασυνήθιστες μεταφορές δεδομένων» που έφευγαν από τα συστήματά τους κατά τη διάρκεια συνηθισμένων ελέγχων κυβερνοασφάλειας. Ερευνώντας βαθύτερα, διαπίστωσαν ότι ορισμένοι πράκτορες τεχνητής νοημοσύνης είχαν εμπλακεί σε «παρατεταμένη, δυνητικά επιβλαβή δραστηριότητα που κατευθυνόταν εναντίον πραγματικών ανθρώπων και οργανισμών». Ξεκίνησαν πλήρη έρευνα αφού πρώτα περιόρισαν τους πράκτορες τεχνητής νοημοσύνης προτού προκαλέσουν οποιαδήποτε πραγματική ζημιά. Σε μια προσπάθεια να καθησυχάσει το κοινό, ο υπουργός Τεχνητής Νοημοσύνης, Κανίσκα Ναραγιάν, δήλωσε: «Ο εντοπισμός συμπεριφορών όπως αυτή και η ανταλλαγή γνώσεων ώστε να μπορούμε να τις κατανοούμε καλύτερα είναι ακριβώς ο λόγος για τον οποίο δημιουργήσαμε το AISI. Αυτό το περιστατικό υπογραμμίζει γιατί η παγκοσμίως κορυφαία τεχνογνωσία τους και η στενή συνεργασία τους με τα εργαστήρια αιχμής είναι τόσο σημαντικές».
Παραπλανούν
Όμως, επισημαίνοντας την ταχύτητα με την οποία οι πράκτορες τεχνητής νοημοσύνης βρίσκουν τρόπους να συμπεριφέρονται παραπλανητικά, το AISI δήλωσε: «Αυτή είναι η πρώτη φορά που βλέπουμε κινδύνους γύρω από την αυτονομία και την εξαπάτηση να εκδηλώνονται τόσο ξεκάθαρα, χωρίς ειδική παρότρυνση, στον πραγματικό κόσμο». Αναφερόμενος στο μοντέλο Mythos της Anthropic, ο Άντριου Γιουν, ερευνητής στο CivAI, έναν οργανισμό στην Καλιφόρνια που εξετάζει τις δυνατότητες και τους κινδύνους της τεχνητής νοημοσύνης, είπε: «Το γεγονός ότι το Mythos προχώρησε σε τόσο παραπλανητικές ενέργειες, με εμφανή επίγνωση ότι στόχευε ένα πραγματικό πρόσωπο, δείχνει ότι η Anthropic δεν έχει τόσο καλό έλεγχο των μοντέλων της όσο νομίζει». Ο Όλι Γουάιτχαους, επικεφαλής τεχνολογίας του National Cyber Security Centre της GCHQ, δήλωσε ότι η τεχνητή νοημοσύνη πρέπει να αναπτύσσεται με «σαφή σχέδια αντιμετώπισης για όταν συμβαίνει το απρόβλεπτο». Πρόσθεσε ότι περιστατικά όπου ισχυρά μοντέλα τεχνητής νοημοσύνης πραγματοποιούν μη εγκεκριμένες ενέργειες και επιδεικνύουν ανθρώπινου τύπου παραπλανητική συμπεριφορά στο διαδίκτυο αποτελούν «μια σοβαρή υπενθύμιση των κινδύνων που ενέχουν οι δυνατότητες της τεχνητής νοημοσύνης».
Πρόσβαση
Το AISI αποκτά πρόσβαση σε προηγμένα μοντέλα τεχνητής νοημοσύνης βάσει συμφωνιών με την OpenAI, την Anthropic και άλλες εταιρείες, προκειμένου να μελετά τις δυνατότητές τους πριν να κυκλοφορήσουν στο κοινό. Κατά τη διάρκεια των δοκιμών έδωσε στους πράκτορες τεχνητής νοημοσύνης πρόσβαση στο ανοιχτό διαδίκτυο, με ορισμένα φίλτρα ασφαλείας απενεργοποιημένα. Η πιο πρόσφατη δοκιμή υπέβαλε τους πράκτορες τεχνητής νοημοσύνης (συμπεριλαμβανομένων εκείνων που βασίζονταν στο Mythos 5 της Anthropic και στο GPT-5.6-Sol της OpenAI) σε μια φανταστική πρόκληση κυβερνοασφάλειας. Το AISI διαπίστωσε ότι η τεχνητή νοημοσύνη βγήκε εκτός ελέγχου 19 φορές στις 122 δοκιμές, με τον πράκτορα της Anthropic να ευθύνεται για 17 παραβιάσεις και τον πράκτορα της OpenAI για τις άλλες δύο. Στην πιο σοκαριστική περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης συγκέντρωσε πληροφορίες για το άτομο που ήταν υπεύθυνο για ένα διαδικτυακό έργο και στη συνέχεια δημιούργησε πολλαπλές ψεύτικες ταυτότητες για να το χειραγωγήσει ώστε να εγκρίνει κακόβουλο κώδικα που είχε δημιουργήσει. Στη συνέχεια, ο πράκτορας τεχνητής νοημοσύνης διέγραψε κάθε ίχνος της παράνομης ενέργειάς του ώστε να εμφανίζεται αθώος στους ανθρώπους που είχαν την ευθύνη – και μάλιστα εξέτασε το ενδεχόμενο να υιοθετήσει μια νέα ταυτότητα για να παραμείνει απαρατήρητος. Αν το ανθρώπινο θύμα της εξαπάτησης είχε κατά λάθος αποδεχθεί τον κακόβουλο κώδικα, ή «malware», αυτό θα μπορούσε να είχε οδηγήσει σε παραβιάσεις ασφαλείας, κλοπή πληροφοριών και δεδομένων και άλλες πιθανές ζημιές σε αρχεία και συστήματα.
Ο στόχος
Το AISI αναγνώρισε το GitHub (μία διαδικτυακή πλατφόρμα cloud της Microsoft που χρησιμοποιείται από προγραμματιστές λογισμικού για τη δημιουργία, αποθήκευση, διαχείριση και κοινή χρήση του κώδικά τους) ως τον στόχο της επίθεσης του πράκτορα. Ωστόσο, το AISI ανακάλυψε επίσης έναν πράκτορα τεχνητής νοημοσύνης να αφήνει μηνύματα για άλλους πράκτορες στο GitHub, προσφέροντας συνεργασία πάνω στην πρόκληση. Ο πράκτορας τεχνητής νοημοσύνης παρείχε οδηγίες για την επαναχρησιμοποίηση λογαριασμών και ψηφιακών στοιχείων που είχε αφήσει πίσω του – τα οποία στη συνέχεια ανακάλυψαν και χρησιμοποίησαν με επιτυχία άλλοι πράκτορες για να πετύχουν τους στόχους της πρόκλησης. Η Anthropic δήλωσε: «Είμαστε ευγνώμονες στο AISI για την ηγετική του στάση σε αυτό το περιστατικό, το οποίο υπογραμμίζει την ανάγκη για μια ευρύτερη συζήτηση σχετικά με το πώς μπορούμε να αξιολογούμε με ασφάλεια ολοένα και πιο ικανούς πράκτορες τεχνητής νοημοσύνης». Η OpenAI δήλωσε: «Αυτά τα περιστατικά συνέβησαν κατά τη διάρκεια αξιολογήσεων κυβερνοασφάλειας που πραγματοποιήθηκαν από συνεργάτες αξιολόγησης σε περιβάλλοντα δοκιμών με μειωμένες δικλίδες ασφαλείας, υπό συνθήκες που δεν αντικατοπτρίζουν τη συνηθισμένη χρήση. Θα συνεχίσουμε να συνεργαζόμαστε με αξιολογητές και άλλους ενδιαφερόμενους φορείς για να ενισχύσουμε τις κοινές πρακτικές ασφαλούς διεξαγωγής αξιολογήσεων, καθώς τα μοντέλα γίνονται ολοένα και πιο ικανά».
Των SOPHIE CHURCH και MARK DUELL/©Associated Newspapers Limited
Εφημερίδα Απογευματινή











