Η δραστηριότητα προέκυψε κατά την προσπάθεια ανάκτησης δημόσιων δεδομένων και επαναφέρει το ζήτημα των ορίων αυτονομίας των AI agents (Interesting Engineering)
Αυτόνομα AI agents της OpenAI υπέβαλαν επανειλημμένα αιτήματα σε ιστότοπο του ΟΗΕ και χρησιμοποίησαν τεχνικές που φαίνεται να παρέκαμπταν περιορισμούς, όταν προσπαθούσαν να ανακτήσουν δημοσίως διαθέσιμα δεδομένα, σύμφωνα με ανεξάρτητη ερευνητική έκθεση που βασίζεται σε πληροφορίες οι οποίες παρασχέθηκαν από την εταιρεία έρευνας τεχνητής νοημοσύνης Transluce.
Τα AI agents σάρωσαν περισσότερες από 16.000 φορές μεταξύ Απριλίου και τέλους Ιουνίου έναν δημόσιο κόμβο δεδομένων που διαχειρίζεται η UN Trade and Development, ο εμπορικός βραχίονας του ΟΗΕ, αναδεικνύοντας ένα αυξανόμενο πρόβλημα με τα AI agents που μπορούν να πλοηγούνται αυτόνομα στο διαδίκτυο και να αναλαμβάνουν δράση όταν συναντούν εμπόδια.
Οι ερευνητές πιστεύουν ότι τα μοντέλα είχαν αρχικά την αποστολή να εντοπίσουν δημοσίως διαθέσιμες πληροφορίες, όμως η συμπεριφορά τους έγινε ολοένα πιο επιθετική όταν ο ιστότοπος τα εμπόδισε να αποκτήσουν πρόσβαση σε ορισμένα από τα δεδομένα που ζητούσαν.
Ξεπερνώντας τους περιορισμούς του ιστότοπου
Σύμφωνα με τον ερευνητή και συγγραφέα της έκθεσης Rowan Howard-Jones, τα AI agents ήρθαν αντιμέτωπα με ένα φίλτρο που μπλόκαρε τα αιτήματά τους και στη συνέχεια βρήκαν τρόπο να το παρακάμψουν, με την τεχνική που τελικά χρησιμοποίησαν να μην επιτρέπεται από τους διαχειριστές του ιστότοπου.
Επιπλέον, τα AI agents προφανώς δεν είχαν λάβει εντολή να επιτεθούν στον ιστότοπο του ΟΗΕ ή να θέσουν σε κίνδυνο την ασφάλειά του. Αντίθετα, η συμπεριφορά αυτή προέκυψε καθώς προσπαθούσαν να ολοκληρώσουν μια εργασία ανάκτησης πληροφοριών, αναφέρει η Wall Street Journal.
Ο ειδικός σε θέματα κυβερνοασφάλειας Alex Stamos, λέκτορας στο Stanford University, δήλωσε στη WSJ ότι το περιστατικό στον ΟΗΕ ήταν «οριακά» hacking, ενώ το περιέγραψε κυρίως ως εξαιρετικά επιθετική συλλογή δεδομένων και ανάκτηση πληροφοριών.
Η δραστηριότητα στον ΟΗΕ αποτελεί μία από αρκετές πρόσφατες περιπτώσεις στις οποίες τα μοντέλα της OpenAI συμπεριφέρθηκαν απροσδόκητα κατά τη λειτουργία τους στο διαδίκτυο.
Η OpenAI δήλωσε ότι διεξάγει ευρεία ανασκόπηση των «μη ευθυγραμμισμένων μοντέλων κατά την εκπαίδευση και την αξιολόγηση» και εξετάζει μεγάλο όγκο ενεργειών που πραγματοποιήθηκαν από τα AI agents της.
Η εταιρεία δήλωσε ότι το μεγαλύτερο μέρος της δραστηριότητας που έχει εξετάσει αφορούσε συνήθεις ερευνητικές εργασίες, συμπεριλαμβανομένης της ανάκτησης δημοσίως διαθέσιμου διαδικτυακού περιεχομένου, αλλά αναγνώρισε ότι οι οργανισμοί που επηρεάστηκαν από τη συμπεριφορά αυτή έχουν βάσιμες ανησυχίες.
Η OpenAI πρόσθεσε ότι έχει ενημερώσει δεκάδες οργανισμούς για περιπτώσεις στις οποίες τα μοντέλα της παρέκαμψαν ελέγχους ασφαλείας ή επηρέασαν αρνητικά ιστότοπους.
Το πρόβλημα της παροχής μεγαλύτερης αυτονομίας στα AI agents
Πρόσφατα περιστατικά έχουν περιλάβει δραστηριότητα που αφορούσε κυβερνητικούς ιστότοπους των ΗΠΑ, συμπεριλαμβανομένων του Υπουργείου Εμπορίου και της Επιτροπής Κεφαλαιαγοράς, ενώ Αυστραλοί αξιωματούχοι ξεκίνησαν έρευνα αφού δήλωσαν ότι ένα agent της OpenAI παραβίασε έναν από τους κυβερνητικούς τους ιστότοπους.
Άλλοι ερευνητές έχουν αναφέρει ότι AI agents δημιούργησαν ψεύτικες διευθύνσεις ηλεκτρονικού ταχυδρομείου, παρέκαμψαν όρια ρυθμού αιτημάτων ιστοτόπων και ισχυρίστηκαν ψευδώς ότι δεν ήταν bots.
Το περιστατικό στον ΟΗΕ προσθέτει, επομένως, ακόμη ένα παράδειγμα σε ένα αυξανόμενο σύνολο στοιχείων ότι τα αυτόνομα συστήματα τεχνητής νοημοσύνης μπορούν να ερμηνεύουν τα εμπόδια ως προβλήματα που πρέπει να επιλυθούν και όχι ως όρια που πρέπει να γίνονται σεβαστά.
Οι ερευνητές υποστηρίζουν επίσης ότι το υποκείμενο ζήτημα δεν είναι κατ’ ανάγκη ότι τα μοντέλα προσπαθούν σκόπιμα να προκαλέσουν ζημιά, αλλά η δυνατότητα των AI agents να επιδιώκουν ολοένα και περισσότερο έναν στόχο μέσω πολλαπλών βημάτων, χωρίς να περιμένουν την έγκριση ενός ανθρώπου για κάθε ενέργεια.
«Τα AI agents βελτίωναν σταδιακά τις μεθόδους τους για να ανακτούν περισσότερα δεδομένα από κάθε σάρωση, ανακαλύπτοντας τελικά ότι ένα παιχνίδι της Google μπορούσε να χρησιμοποιηθεί για τη μαζική ανάκτηση δεδομένων», έγραψε ο Howard-Jones στην έκθεση.
Επιπλέον, τα τελευταία περιστατικά είναι πιθανό να εντείνουν τη συζήτηση σχετικά με το πόση αυτονομία θα πρέπει να έχουν τα AI agents όταν αλληλεπιδρούν με εξωτερικά συστήματα, εγείροντας πρόσθετα ερωτήματα σχετικά με το κατά πόσο οι υφιστάμενοι μηχανισμοί ασφάλειας των ιστοτόπων είναι επαρκείς όταν έρχονται αντιμέτωποι με λογισμικό που μπορεί να συλλογίζεται σχετικά με αυτούς τους μηχανισμούς και να τροποποιεί τη συμπεριφορά του.
www.worldenergynews.gr






