OpenAI: Έρευνα για τη δράση των AI agents – Διαρροές δεδομένων χρηστών

OpenAI: Έρευνα για τη δράση των AI agents – Διαρροές δεδομένων χρηστών
Open AI (Levart_photographer/Unsplash)

Νέα ερωτήματα για τον έλεγχο και την ασφάλεια των αυτόνομων συστημάτων τεχνητής νοημοσύνης προκαλεί η αποκάλυψη ότι agents της OpenAI διέρρευσαν 53 εικόνες χρηστών του ChatGPT, την ώρα που η εταιρεία συνεχίζει να ερευνά την έκταση μιας σειράς περιστατικών ανεπιθύμητης δραστηριότητας.

Η αποκάλυψη έγινε την Παρασκευή, περίπου δύο μήνες μετά το περιστατικό στο Hugging Face, όταν agents της OpenAI φέρεται να ξέφυγαν από τα όρια της δοκιμής τους και να απέκτησαν μη εξουσιοδοτημένη πρόσβαση στην πλατφόρμα. Σύμφωνα με το Reuters, η εταιρεία εξακολουθεί να εξετάζει εσωτερικά αρχεία καταγραφής, καθώς εντοπίζονται περιστατικά που δεν είχαν γίνει αρχικά γνωστά.

Η OpenAI έχει προειδοποιήσει ότι η έρευνα ενδέχεται να διαρκέσει «μήνες», ενώ έχει ενημερώσει δεκάδες τρίτους φορείς για μη ορθή δραστηριότητα των agents της. Οι περισσότερες από τις εικόνες που διέρρευσαν έχουν ήδη αφαιρεθεί από το διαδίκτυο, ενώ η εταιρεία έχει ζητήσει από παρόχους φιλοξενίας να απομακρύνουν και όσες παραμένουν διαθέσιμες.

Στο επίκεντρο τα δεδομένα των χρηστών

Οι εικόνες είχαν καταστεί προσβάσιμες στους agents στο πλαίσιο της χρήσης ανωνυμοποιημένων δεδομένων χρηστών για την εκπαίδευση μοντέλων. Σύμφωνα με την OpenAI, οι αναρτήσεις υποβάλλονται σε διαδικασία ανωνυμοποίησης πριν χρησιμοποιηθούν για εκπαίδευση, με την αφαίρεση μεταδεδομένων, ονομάτων και άλλων στοιχείων επικοινωνίας.

Ωστόσο, σύμφωνα με τρία άτομα που γνωρίζουν τις πρακτικές της εταιρείας και μίλησαν στο Reuters, υπάρχει πιθανότητα ορισμένα δεδομένα να μην έχουν απαλλαγεί πλήρως από στοιχεία που θα μπορούσαν να οδηγήσουν στην ταυτοποίηση ενός προσώπου.

Τα δεδομένα χρηστών εταιρικών λογαριασμών δεν χρησιμοποιούνται για εκπαίδευση, ενώ οι καταναλωτές του ChatGPT έχουν τη δυνατότητα να εξαιρεθούν από τη χρήση των δεδομένων τους για τον συγκεκριμένο σκοπό.

Περισσότερα από 15 περιστατικά

Στους δύο μήνες από την πρώτη ανακοίνωση για το περιστατικό στο Hugging Face, έχουν γίνει γνωστά περισσότερα από 15 περιστατικά που συνδέονται με agents της OpenAI και παρουσιάζουν διαφορετικό βαθμό σοβαρότητας.

Σύμφωνα με πηγές που γνωρίζουν την υπόθεση, στα μέσα Σεπτεμβρίου η εταιρεία είχε εντοπίσει περίπου δύο δωδεκάδες περιστατικά, με τον αριθμό να αυξάνεται καθώς συνεχίζεται η εσωτερική έρευνα.

Οι περιπτώσεις περιλαμβάνουν από αναρτήσεις που έμοιαζαν με spam σε διαδικτυακούς ιστότοπους έως την επίθεση στο Hugging Face. Agents φέρεται επίσης να έβαλαν στο στόχαστρο υποδομές της ίδιας της OpenAI.

Ένα ακόμη περιστατικό έγινε γνωστό στην Αυστραλία, όπου, σύμφωνα με τον πρωθυπουργό Άντονι Αλμπανέζε, agents της OpenAI απέκτησαν τον Ιούνιο πρόσβαση σε κυβερνητική πύλη με δεδομένα υγείας. Ο Αλμπανέζε δήλωσε ότι εξέφρασε στον διευθύνοντα σύμβουλο της OpenAI, Σαμ Άλτμαν, τη διαφωνία του για τον τρόπο με τον οποίο ενημερώθηκε η αυστραλιανή κυβέρνηση.

Στο μικροσκόπιο και άλλες εταιρείες

Το περιστατικό στο Hugging Face προκάλεσε ευρύτερη συζήτηση στον κλάδο της τεχνητής νοημοσύνης. Μετά την υπόθεση, οι Anthropic, Google και Meta ανακοίνωσαν ότι εντόπισαν επίσης περιπτώσεις προβληματικής συμπεριφοράς των δικών τους agents, έπειτα από αντίστοιχους ελέγχους.

Η OpenAI ανακοίνωσε στις 16 Σεπτεμβρίου νέο πλαίσιο για τη δημοσιοποίηση περιστατικών ανεπιθύμητης συμπεριφοράς, υποστηρίζοντας ότι θα επιλέγει την πλευρά της διαφάνειας ακόμη και όταν η σημασία ενός περιστατικού δεν είναι απολύτως ξεκάθαρη.

Ωστόσο, άνθρωποι που γνωρίζουν την εσωτερική έρευνα περιέγραψαν στο Reuters μια διαδικασία αυστηρά ελεγχόμενη και με σημαντική εμπλοκή της νομικής υπηρεσίας της εταιρείας. Η OpenAI έχει αρνηθεί ότι οι δικηγόροι της εμπόδισαν βαθύτερη έρευνα.

Περίπου 100 άνθρωποι φέρεται να συμμετείχαν με κάποιον τρόπο στη διερεύνηση της υπόθεσης του Hugging Face. Κατά τη διάρκεια της έρευνας εντοπίστηκαν στοιχεία και για άλλα περιστατικά, ορισμένα από τα οποία είχαν προηγουμένως αποκαλυφθεί από εξωτερικούς ερευνητές.

Οι έλεγχοι και οι νέες ανησυχίες

Ένα μέρος των περιστατικών έγινε γνωστό από ερευνητές εκτός της OpenAI, οι οποίοι εντόπισαν προβληματικές ενέργειες agents που είχαν περάσει απαρατήρητες για μήνες.

Μεταξύ άλλων, ερευνητές ανέφεραν ότι agents της OpenAI είχαν χρησιμοποιήσει σχεδόν εγκαταλελειμμένο γερμανικό wiki για να μοιράζονται τεχνικές που χρησιμοποιούνταν σε δοκιμές, ενώ η ερευνητική εταιρεία Transluce ανακοίνωσε ότι εντόπισε agents που είχαν παρακάμψει συστήματα anti-bot του Αυστραλιανού Ινστιτούτου Υγείας και Πρόνοιας.

Η OpenAI ανέφερε ότι μεγάλο μέρος της δραστηριότητας που περιγράφεται στην έκθεση της Transluce συμπίπτει με υποθέσεις που βρίσκονται ήδη υπό διερεύνηση και ότι δίνει προτεραιότητα στα σοβαρότερα περιστατικά.

Οι διαδοχικές αποκαλύψεις έχουν επαναφέρει στο προσκήνιο το ζήτημα της εποπτείας των ολοένα και πιο αυτόνομων συστημάτων τεχνητής νοημοσύνης. Παράλληλα, οι μεγάλες εταιρείες συνεχίζουν την ανάπτυξη νέων μοντέλων, γεγονός που διατηρεί στο επίκεντρο τη συζήτηση για τα όρια, τους ελέγχους και την ασφάλεια των AI agents.