Νέα «πολύ σοβαρά» περιστατικά κυβερνοασφάλειας με αυτόνομα συστήματα Τεχνητής Νοημοσύνης (agents), τα οποία «βγήκαν εκτός ελέγχου» κατά την διάρκεια ελεγχόμενων δοκιμών, αποκάλυψαν νέους κινδύνους που ενέχει η αναπτυσσόμενη τεχνολογία.
Σύμφωνα με δημοσίευμα του Guardian, δύο προηγμένα agents των εταιρειών Anthropic και OpenAI -δηλαδή τα ανεξάρτητα συστήματα Τεχνητής Νοημοσύνης, τα οποία δεν χρειάζονται ανθρώπινη παρέμβαση για να ολοκληρώσουν εργασίες- προχώρησαν σε ενέργειες, τις οποίες το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου (AISI) χαρακτήρισε «πολύ σοβαρές».
Το Ινστιτούτο ανακοίνωσε πως, κατά την διάρκεια ελέγχου ρουτίνας για ζητήματα κυβερνοασφάλειας στις 28 Ιουλίου, εντόπισε «ασυνήθιστη δραστηριότητα» από μοντέλα Τεχνητής Νοημοσύνης. Διαπίστωσε ότι δύο agents είχαν εμπλακεί σε «συνεχή, δυνητικά επιβλαβή δραστηριότητα που απευθυνόταν σε πραγματικά άτομα και οργανισμούς».
Η «αθέμιτη συμπεριφορά» προήλθε από agents που υποστηρίζονται από δύο μοντέλα – το «Mythos 5» της Anthropic και το «GPT-5.6 Sol» της OpenAI, ενώ χρειάστηκε μία ώρα για να περιοριστεί το ζήτημα.
Για παράδειγμα, το agent του Mythos της Anthropic έστειλε email σε πραγματικά πρόσωπα, με στόχο την εξαπάτηση τους.
Το πιο σοβαρό περιστατικό, αφορά agent που υποστηρίζεται από την Mythos, ο οποίος προσπάθησε να εισάγει κακόβουλο κώδικα σε ένα project λογισμικού κώδικα στην πλατφόρμα GitHub, που χρησιμοποιείται από προγραμματιστές.
Σε μια προσπάθεια να εγκριθεί ο κώδικας του, ο agent δημιούργησε ψεύτικες διαδικτυακές προσωπικότητες -βασισμένες σε πραγματικά άτομα- και τις χρησιμοποίησε για να πιέσει τον επιβλέποντα του έργου να αποδεχτεί τον κώδικα.
Ένας προγραμματιστής της πλατφόρμας αντιλήφθηκε πως κάτι δεν πήγαινε καλά και «μπλόκαρε» τον agent.
Το βρετανικό ινστιτούτο ανέφερε ότι ο agent χρησιμοποιούσε τεχνικές που συνήθως αξιοποιούν πραγματικοί χάκερς. Το αυτόνομο σύστημα AI έστειλε emails σε συγκεκριμένα άτομα που είχε επιλέξει – μια τεχνική γνωστή ως «spear-phishing» – με τα οποία επιχείρησε να χειραγωγήσει τους παραλήπτες. Μάλιστα, ορισμένα από τα μηνύματα περιείχαν κακόβουλο λογισμικό.
Παρότι τα agents δεν κατάφεραν να προκαλέσουν βλάβες, οι ενέργειες τους ήταν άνευ προηγουμένου, προκαλώντας μεγάλη ανησυχία για πιθανούς κινδύνους.
«Αυτή είναι η πρώτη φορά που βλέπουμε κίνδυνο εξαπάτησης λόγω αυτονομίας να εκδηλώνονται ξεκάθαρα, χωρίς συγκεκριμένη προτροπή, στον πραγματικό κόσμο», δήλωσε το AISI σε ανακοίνωσή του.
Το νέο περιστατικό έρχεται ύστερα από άλλα παρόμοια επεισόδια με agents των δύο εταιρειών.
Τον Ιούλιο, η OpenAI δήλωσε ότι ένας agent που υποστηρίζεται από τα μοντέλα της είχε χακάρει μια νεοσύστατη επιχείρηση τεχνητής νοημοσύνης κατά τη διάρκεια μιας δοκιμής, και λίγες μέρες αργότερα η Anthropic δήλωσε ότι το μοντέλο Claude είχε χακάρει τρεις οργανισμούς, κατά τη διάρκεια μιας αξιολόγησης.
Το AISI δήλωσε ότι το νέο επεισόδιο, σε συνδυασμό με τα πρόσφατα περιστατικά στις OpenAI και Anthropic, δείχνει μια «μετατόπιση στο τοπίο πρόβλεψης κινδύνου».
Οι ενέργειες των μοντέλων δεν αποτελούν αποτέλεσμα σκόπιμης κακόβουλης χρήσης, αλλά έδειξαν πως, ακόμη και σε ένα ερευνητικό περιβάλλον, τα agent λειτούργησαν με τρόπο που ξεπερνά το πεδίο ενεργειών για το οποίο έχουν λάβει εξουσιοδότηση.
Σύμφωνα με την έκθεση, 17 από τα 19 περιστατικά αθέμιτης συμπεριφοράς που σημειώθηκαν κατά τη διάρκεια της αξιολόγησης πραγματοποιήθηκαν από agent της Anthropic, ενώ τα άλλα δύο από την OpenAI.
Από μεριάς της, η OpenAI υποστήριξε ότι οι δοκιμές πραγματοποιήθηκαν υπό «συνθήκες που δεν αντικατοπτρίζουν τη συνήθη χρήση» των μοντέλων της. Εκπρόσωπος της εταιρείας δήλωσε: «Θα συνεχίσουμε να συνεργαζόμαστε με εκλεκτές και άλλα ενδιαφερόμενα μέρη σε ολόκληρο τον κλάδο για να ενισχύσουμε τις κοινές πρακτικές για την ασφαλή διεξαγωγή αξιολογήσεων, καθώς τα μοντέλα γίνονται πιο ικανά».
Η Anthropic δήλωσε ότι το περιστατικό «υπογραμμίζει την ανάγκη για μια ευρύτερη συζήτηση, σχετικά με τον τρόπο ασφαλούς αξιολόγησης των ολοένα και πιο ικανών αυτόνομων μοντέλων Τεχνητής Νοημοσύνης» και πως θα συνεχίσει να συνεργάζεται με το AISI, για την διερεύνηση του περιστατικού.
Διαβάστε επίσης:
Reuters: Η τεχνητή νοημοσύνη σε τετ α τετ Κίνας και ΗΠΑ τον Σεπτέμβριο
Tα σχόλια στο site έχουν απενεργοποιηθεί. Μπορείτε να σχολιάζετε μέσα από την επίσημη σελίδα στο Facebook
Σχόλια