Τεχνητή Νοημοσύνη: «Εκτός ελέγχου» αυτόνομα agents των OpenAI και Anthropic- Απόπειρες εξαπάτησης και «μόλυνσης» κώδικα

Παρότι τα agents δεν κατάφεραν να προκαλέσουν βλάβες, οι ενέργειες τους ήταν άνευ προηγουμένου, προκαλώντας μεγάλη ανησυχία για πιθανούς κινδύνους.

geralt web 4682754

Νέα «πολύ σοβαρά» περιστατικά  κυβερνοασφάλειας με αυτόνομα συστήματα Τεχνητής Νοημοσύνης (agents), τα οποία «βγήκαν εκτός ελέγχου» κατά την διάρκεια ελεγχόμενων δοκιμών, αποκάλυψαν νέους κινδύνους που ενέχει η αναπτυσσόμενη τεχνολογία.

Σύμφωνα με δημοσίευμα του Guardian, δύο προηγμένα agents των εταιρειών Anthropic και OpenAI -δηλαδή τα ανεξάρτητα συστήματα Τεχνητής Νοημοσύνης, τα οποία δεν χρειάζονται ανθρώπινη παρέμβαση για να ολοκληρώσουν εργασίες- προχώρησαν σε ενέργειες, τις οποίες το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου (AISI) χαρακτήρισε «πολύ σοβαρές».

Το Ινστιτούτο ανακοίνωσε πως, κατά την διάρκεια ελέγχου ρουτίνας για ζητήματα κυβερνοασφάλειας στις 28 Ιουλίου,  εντόπισε «ασυνήθιστη δραστηριότητα» από μοντέλα Τεχνητής Νοημοσύνης. Διαπίστωσε ότι δύο agents είχαν εμπλακεί σε «συνεχή, δυνητικά επιβλαβή δραστηριότητα που απευθυνόταν σε πραγματικά άτομα και οργανισμούς».

Η «αθέμιτη συμπεριφορά» προήλθε από agents που υποστηρίζονται από δύο μοντέλα – το «Mythos 5» της Anthropic και το «GPT-5.6 Sol» της OpenAI, ενώ χρειάστηκε μία ώρα για να περιοριστεί το ζήτημα.

Για παράδειγμα, το agent του Mythos της Anthropic έστειλε email σε πραγματικά πρόσωπα, με στόχο την εξαπάτηση τους.

Το πιο σοβαρό περιστατικό, αφορά agent που υποστηρίζεται από την Mythos, ο οποίος  προσπάθησε να εισάγει κακόβουλο κώδικα σε ένα project λογισμικού κώδικα στην πλατφόρμα GitHub, που χρησιμοποιείται από προγραμματιστές.

Σε μια προσπάθεια να εγκριθεί ο κώδικας του, ο agent δημιούργησε ψεύτικες διαδικτυακές προσωπικότητες -βασισμένες σε πραγματικά άτομα- και τις χρησιμοποίησε για να πιέσει τον επιβλέποντα του έργου να αποδεχτεί τον κώδικα.

Ένας προγραμματιστής της πλατφόρμας αντιλήφθηκε πως κάτι δεν πήγαινε καλά και «μπλόκαρε» τον agent.

Το βρετανικό ινστιτούτο ανέφερε ότι ο agent χρησιμοποιούσε τεχνικές που συνήθως αξιοποιούν πραγματικοί χάκερς. Το αυτόνομο σύστημα AI έστειλε emails σε συγκεκριμένα άτομα που είχε επιλέξει – μια τεχνική γνωστή ως «spear-phishing» – με τα οποία επιχείρησε να χειραγωγήσει τους παραλήπτες. Μάλιστα, ορισμένα από τα μηνύματα περιείχαν κακόβουλο λογισμικό.

Παρότι τα agents δεν κατάφεραν να προκαλέσουν βλάβες, οι ενέργειες τους ήταν άνευ προηγουμένου, προκαλώντας μεγάλη ανησυχία για πιθανούς κινδύνους.

«Αυτή είναι η πρώτη φορά που βλέπουμε κίνδυνο εξαπάτησης λόγω αυτονομίας να εκδηλώνονται ξεκάθαρα, χωρίς συγκεκριμένη προτροπή, στον πραγματικό κόσμο», δήλωσε το AISI σε ανακοίνωσή του.

Το νέο περιστατικό έρχεται ύστερα από άλλα παρόμοια επεισόδια με agents των δύο εταιρειών.

Τον Ιούλιο, η OpenAI δήλωσε ότι ένας agent που υποστηρίζεται από τα μοντέλα της είχε χακάρει μια νεοσύστατη επιχείρηση τεχνητής νοημοσύνης κατά τη διάρκεια μιας δοκιμής, και λίγες μέρες αργότερα η Anthropic δήλωσε ότι το μοντέλο Claude είχε χακάρει τρεις οργανισμούς, κατά τη διάρκεια μιας αξιολόγησης.

Το AISI δήλωσε ότι το νέο επεισόδιο, σε συνδυασμό με τα πρόσφατα περιστατικά στις OpenAI και Anthropic, δείχνει μια «μετατόπιση στο τοπίο πρόβλεψης κινδύνου».

Οι ενέργειες των μοντέλων δεν αποτελούν αποτέλεσμα σκόπιμης κακόβουλης χρήσης, αλλά έδειξαν πως, ακόμη και σε ένα ερευνητικό περιβάλλον, τα agent λειτούργησαν με τρόπο που ξεπερνά το πεδίο ενεργειών για το οποίο έχουν λάβει εξουσιοδότηση.

Σύμφωνα με την έκθεση, 17 από τα 19 περιστατικά αθέμιτης συμπεριφοράς που σημειώθηκαν κατά τη διάρκεια της αξιολόγησης πραγματοποιήθηκαν από agent της Anthropic, ενώ τα άλλα δύο από την OpenAI.

Από μεριάς της, η OpenAI υποστήριξε ότι οι δοκιμές πραγματοποιήθηκαν υπό «συνθήκες που δεν αντικατοπτρίζουν τη συνήθη χρήση» των μοντέλων της. Εκπρόσωπος της εταιρείας δήλωσε: «Θα συνεχίσουμε να συνεργαζόμαστε με εκλεκτές και άλλα ενδιαφερόμενα μέρη σε ολόκληρο τον κλάδο για να ενισχύσουμε τις κοινές πρακτικές για την ασφαλή διεξαγωγή αξιολογήσεων, καθώς τα μοντέλα γίνονται πιο ικανά».

Η Anthropic δήλωσε ότι το περιστατικό «υπογραμμίζει την ανάγκη για μια ευρύτερη συζήτηση, σχετικά με τον τρόπο ασφαλούς αξιολόγησης των ολοένα και πιο ικανών αυτόνομων μοντέλων Τεχνητής Νοημοσύνης» και πως θα συνεχίσει να συνεργάζεται με το AISI, για την διερεύνηση του περιστατικού.

Διαβάστε επίσης: 

Reuters: Η τεχνητή νοημοσύνη σε τετ α τετ Κίνας και ΗΠΑ τον Σεπτέμβριο

OpenAI: Δεύτερο «χτύπημα» από το αυτόνομο σύστημα Τεχνητής Νοημοσύνης – «Επιτέθηκε» και σε άλλη τεχνολογική εταιρεία

Το ChatGPT έδινε οδηγίες για παρασκευή βιολογικών όπλων σύμφωνα με την WSJ – Ανησυχία στην Ουάσινγκτον

Δείτε όλες τις ειδήσεις από την Ελλάδα και τον Κόσμο στο koutipandoras.gr

Τραγωδία στη Σίφνο: Στο «μικροσκόπιο» τα τελευταία δευτερόλεπτα της πτήσης του μοιραίου ελικοπτέρου

Sifnos 1024x661 1

Τραγωδία στη Σίφνο: Στο «μικροσκόπιο» τα τελευταία δευτερόλεπτα της πτήσης του μοιραίου ελικοπτέρου

Οπτικό υλικό από κάμερα ασφαλείας αποτυπώνει την καθοδική πορεία του ελικοπτέρου και τη συντριβή του

Τη δολοφονία 30 με 40 Παλαιστινίων «κάθε νύχτα» και τον εποικισμό ολόκληρης της Γάζας ζητά ο Ισραηλινός υπουργός Μπεν-Γκβιρ

AP26203709183531

Τη δολοφονία 30 με 40 Παλαιστινίων «κάθε νύχτα» και τον εποικισμό ολόκληρης της Γάζας ζητά ο Ισραηλινός υπουργός Μπεν-Γκβιρ

«Τρομοκράτισσα» που «χρειάζεται μια σφαίρα στο κεφάλι» χαρακτήρισε ο υπουργός τη γυναίκα που προσέφερε φαγητό…

Περαία Θεσσαλονίκης: Συνέλαβαν 51χρονο σε σκάφος με 45 κιλά μύδια που αλίευσε παράτυπα

5085064

Περαία Θεσσαλονίκης: Συνέλαβαν 51χρονο σε σκάφος με 45 κιλά μύδια που αλίευσε παράτυπα

Το Λιμενικό της Θεσσαλονίκης διαπίστωσε πως ο Αλβανός υπήκοος που ψάρευε στην Περαία στερείτο αδείας…

Ιάσονας Αποστολόπουλος: «Ξεπλένης του σιωνισμού» ο Άδωνις Γεωργιάδης – Τι απαντά στον υπουργό

apostolopoulos georgiadis

Ιάσονας Αποστολόπουλος: «Ξεπλένης του σιωνισμού» ο Άδωνις Γεωργιάδης – Τι απαντά στον υπουργό

Ο Γεωργιάδης κοινοποίησε και σχολίασε βίντεο που εικονίζει τον ακτιβιστή σε κινητοποίηση υπέρ της Παλαιστίνης

Πλασματικό think tank «ταΐζει» τα μοντέλα τεχνητής νοημοσύνης με «έγκριτες» φιλοϊσραηλινές απαντήσεις

AP24041647832152

Πλασματικό think tank «ταΐζει» τα μοντέλα τεχνητής νοημοσύνης με «έγκριτες» φιλοϊσραηλινές απαντήσεις

Τι ανέφερε το Institute for Responsible Statecraft για το κατά παραγγελία του Ισραήλ «Hanover Insitute»

Οι Προτάσεις μας

Σαββατοκύριακο στην πόλη της Αναγέννησης: Όλα όσα πρέπει να δείτε και να κάνετε στη Φλωρεντία

Φλωρεντία

Σαββατοκύριακο στην πόλη της Αναγέννησης: Όλα όσα πρέπει να δείτε και να κάνετε στη Φλωρεντία

48 ώρες στην πρωτεύουσα της Τοσκάνης: Τα εμβληματικά αξιοθέατα, οι γειτονιές, οι γεύσεις και οι…

Ικαρία: Καταγγελίες πολιτών για εύφλεκτα υλικά κοντά σε κολόνες της ΔΕΗ (φωτογραφίες)

766193537 28255598087414117 2673620441530183215 n

Ικαρία: Καταγγελίες πολιτών για εύφλεκτα υλικά κοντά σε κολόνες της ΔΕΗ (φωτογραφίες)

Δοχεία με χρησιμοποιημένα λάδια μηχανών, λάστιχα και άλλα εύφλεκτα υλικά βρίσκονται σε μικρή απόσταση από…

Εύβοια: 8 εμπειρίες που δεν περίμενες να βρεις σε έναν από τους ομορφότερους προορισμούς της

Αμάρυνθος

Εύβοια: 8 εμπειρίες που δεν περίμενες να βρεις σε έναν από τους ομορφότερους προορισμούς της

Η Εύβοια είναι πολλά περισσότερα από εμπειρίες που δεν φανταζόσουν ότι προσφέρει και παροχές που…

UNDERLINE Επεισόδιο 8 – Η σκοτεινή πλευρά του καλοκαιριού: Ο θερμικός νόμος του εγκλήματος – Μύθος ή επιστήμη;

Underline 1024x661 1

UNDERLINE Επεισόδιο 8 – Η σκοτεινή πλευρά του καλοκαιριού: Ο θερμικός νόμος του εγκλήματος – Μύθος ή επιστήμη;

Το νέο επεισόδιο του UNDERLINE εξετάζει τον λεγόμενο «θερμικό νόμο» του εγκλήματος, μια θεωρία που…

Το Κουτί της Πανδώρας του Κ. Βαξεβάνη επέστρεψε: Σκοτεινές επιχειρήσεις από βρετανικές υπηρεσίες στην Ελλάδα

snapshot2

Το Κουτί της Πανδώρας του Κ. Βαξεβάνη επέστρεψε: Σκοτεινές επιχειρήσεις από βρετανικές υπηρεσίες στην Ελλάδα

Εμπλέκονται κορυφαίοι πανεπιστημιακοί, σύμβουλοι πολιτικών και δημοσιογράφοι.

Σχετικά με ΚΟΣΜΟΣ

Τη δολοφονία 30 με 40 Παλαιστινίων «κάθε νύχτα» και τον εποικισμό ολόκληρης της Γάζας ζητά ο Ισραηλινός υπουργός Μπεν-Γκβιρ

AP26203709183531

Τη δολοφονία 30 με 40 Παλαιστινίων «κάθε νύχτα» και τον εποικισμό ολόκληρης της Γάζας ζητά ο Ισραηλινός υπουργός Μπεν-Γκβιρ

«Τρομοκράτισσα» που «χρειάζεται μια σφαίρα στο κεφάλι» χαρακτήρισε ο υπουργός τη γυναίκα που προσέφερε φαγητό…

Πλασματικό think tank «ταΐζει» τα μοντέλα τεχνητής νοημοσύνης με «έγκριτες» φιλοϊσραηλινές απαντήσεις

AP24041647832152

Πλασματικό think tank «ταΐζει» τα μοντέλα τεχνητής νοημοσύνης με «έγκριτες» φιλοϊσραηλινές απαντήσεις

Τι ανέφερε το Institute for Responsible Statecraft για το κατά παραγγελία του Ισραήλ «Hanover Insitute»

Σε ισραηλινό τέλμα ο «οδικός χάρτης» για τη Γάζα: Με τον Νετανιάχου συναντήθηκε ο Τζάρεντ Κούσνερ

AP26195656190440

Σε ισραηλινό τέλμα ο «οδικός χάρτης» για τη Γάζα: Με τον Νετανιάχου συναντήθηκε ο Τζάρεντ Κούσνερ

Ο γαμπρός του Τραμπ και διαπραγματευτής των ΗΠΑ για τη Μέση Ανατολή συναντήθηκε την προηγούμενη…

Γερμανία: Νέες εκκλήσεις για εξέταση της συνταγματικότητας του AfD ενόψει των εκλογών σε κρίσιμα κρατίδια

AP24108544123646

Γερμανία: Νέες εκκλήσεις για εξέταση της συνταγματικότητας του AfD ενόψει των εκλογών σε κρίσιμα κρατίδια

Οι υποστηρικτές, οι επιφυλακτικοί, οι δυσκολίες και τα εναλλακτικά ενδεχόμενα για την απαγόρευση της Εναλλακτικής…