TECHin

AI Agents της OpenAI έκαναν «παράκαμψη» μέχρι... την κυβέρνηση των ΗΠΑ


Επιχείρησαν να αντλήσουν δεδομένα από κυβερνητικές ιστοσελίδες, χωρίς η εταιρεία να γνωρίζει τι έκαναν

AI agents της OpenAI επιχείρησαν το καλοκαίρι να αποκτήσουν πρόσβαση ή να αντλήσουν δεδομένα από ιστοσελίδες αμερικανικών κυβερνητικών υπηρεσιών, χωρίς η ίδια η εταιρεία να γνωρίζει τις ενέργειές τους. Η OpenAI επιβεβαίωσε ορισμένα περιστατικά, τα οποία χαρακτηρίζει ανησυχητική και απρόβλεπτη συμπεριφορά, όχι παραβιάσεις συστημάτων.

Η OpenAI ανακάλυψε μόλις πρόσφατα ότι συστήματα τεχνητής νοημοσύνης της είχαν αλληλεπιδράσει με ασυνήθιστους τρόπους με τις ιστοσελίδες του υπουργείου Εμπορίου, της Επιτροπής Κεφαλαιαγοράς (SEC) και του υπουργείου Παιδείας των ΗΠΑ. Τα περιστατικά σημειώθηκαν το καλοκαίρι και εντοπίστηκαν στο πλαίσιο εσωτερικής έρευνας για προηγούμενες επιθέσεις ή απόπειρες επιθέσεων που είχαν πραγματοποιήσει αυτόνομα AI agents.

Οι agents είναι συστήματα που μπορούν να εκτελούν ενέργειες χωρίς να χρειάζονται συνεχή ανθρώπινη καθοδήγηση. Στην περίπτωση του υπουργείου Παιδείας, σύμφωνα με ερευνητές της εταιρείας AI Transluce, η τεχνολογία της OpenAI επιχείρησε να «χακάρει» την ιστοσελίδα του γραφείου πολιτικών δικαιωμάτων, προκειμένου να συλλέξει δεδομένα, χωρίς όμως να τα καταφέρει. Στην περίπτωση του υπουργείου Εμπορίου, οι agents άντλησαν δεδομένα από την ιστοσελίδα του Γραφείου Απογραφής, χρησιμοποιώντας κωδικούς πρόσβασης που είχαν εντοπίσει στο διαδίκτυο.

Σε ξεχωριστό περιστατικό, agents της OpenAI ανάρτησαν σε διαδικτυακό φόρουμ δημόσια διαθέσιμα δεδομένα από την ιστοσελίδα της SEC. Η OpenAI επιβεβαίωσε τα περιστατικά του υπουργείου Εμπορίου και της SEC, ενώ συνεχίζει να διερευνά την υπόθεση του υπουργείου Παιδείας. Η εταιρεία ενημέρωσε τις συγκεκριμένες κυβερνητικές υπηρεσίες τις τελευταίες εβδομάδες ότι τα μοντέλα της είχαν αλληλεπιδράσει με τις ιστοσελίδες τους με μη αναμενόμενους τρόπους.

«Έρευνα» με ανεξέλεγκτες κινήσεις

Η OpenAI υπογραμμίζει ότι κανένα από τα συγκεκριμένα περιστατικά δεν αποτέλεσε παραβίαση συστήματος. Τα χαρακτηρίζει, ωστόσο, ενδεικτικά του τρόπου με τον οποίο τα AI agents μπορούν να κινηθούν πέρα από αυτό που περίμεναν οι δημιουργοί τους. Η εταιρεία τα ανακάλυψε κατά την έρευνα προηγούμενων περιστατικών, μεταξύ των οποίων η επίθεση σε αυστραλιανή κυβερνητική ιστοσελίδα τον Ιούνιο και η παραβίαση της AI startup Hugging Face τον Ιούλιο.

Η νέα αποκάλυψη διευρύνει έναν ήδη αυξανόμενο κατάλογο περιστατικών στα οποία agents της OpenAI, της Anthropic, της Meta και της Google έχουν επιχειρήσει να παραβιάσουν ή να παρακάμψουν περιορισμούς σε εταιρείες, πανεπιστήμια και κυβερνητικούς οργανισμούς. Σε ορισμένες περιπτώσεις οι απόπειρες ήταν επιτυχείς, σε άλλες όχι. Κοινό στοιχείο είναι ότι οι εταιρείες ανάπτυξης των μοντέλων δεν αντιλήφθηκαν άμεσα τι είχαν κάνει τα συστήματά τους.

Στην περίπτωση της OpenAI, η εσωτερική έρευνα για την επίθεση στη Hugging Face αποκάλυψε την παραβίαση ιστοσελίδας της αυστραλιανής δημόσιας υπηρεσίας υγείας, αλλά και τουλάχιστον έξι ακόμη απόπειρες παραβίασης ή άλλες προβληματικές ενέργειες. Μεταξύ αυτών ήταν η απόκρυψη λαθών από την AI, η δημιουργία ανύπαρκτων δεδομένων και η μεταφορά αρχείων στο ανοιχτό διαδίκτυο χωρίς άδεια.

Εκπρόσωπος της OpenAI δήλωσε ότι η έρευνα της εταιρείας είναι «εκτεταμένη» και βρίσκεται σε εξέλιξη, ενώ η εταιρεία θα συνεχίσει να ενημερώνει οργανισμούς που επηρεάστηκαν από τα μοντέλα της. Σύμφωνα με την ίδια, το μεγαλύτερο μέρος της δραστηριότητας που έχει εξεταστεί μέχρι στιγμής αφορούσε συνηθισμένες ερευνητικές εργασίες, όπως η πρόσβαση σε δημόσιο περιεχόμενο του διαδικτύου. Οι κυβερνητικές ιστοσελίδες, πρόσθεσε, αποτελούν συχνά πηγή των μοντέλων επειδή θεωρούνται αξιόπιστες πηγές δημόσιας πληροφορίας.

«Δεν ήταν κακόβουλα – πήγαν όμως πολύ μακριά»

Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, παραδέχθηκε ότι η εταιρεία δεν ήταν όσο γρήγορη θα ήθελε στην αποκάλυψη περιστατικών που αφορούν τα μοντέλα της. Ανέφερε ότι η OpenAI ιεραρχεί τις ανακοινώσεις ανάλογα με τη σοβαρότητα και ότι η παραβίαση της Hugging Face παραμένει, σύμφωνα με την ίδια, το σοβαρότερο περιστατικό που έχει εντοπίσει μέχρι σήμερα.

Η συζήτηση δεν αφορά πλέον μόνο το αν ένα μοντέλο μπορεί να κάνει κάτι επικίνδυνο, αλλά και το τι συμβαίνει όταν ένας agent προσπαθεί επίμονα να ολοκληρώσει έναν στόχο και βρίσκει μόνος του διαφορετικούς τρόπους για να το πετύχει. Ο Κόνραντ Στος, επικεφαλής διακυβέρνησης της Transluce, δήλωσε ότι οι agents χρησιμοποίησαν μια σειρά από «γκρίζες» πρακτικές, μεταξύ άλλων αξιοποιώντας ιστοσελίδες με τρόπους που δεν είχαν προβλεφθεί και παραβιάζοντας σε ορισμένες περιπτώσεις ρητούς όρους χρήσης.

Οι ερευνητές της Transluce εντόπισαν επίσης άλλες δραστηριότητες που δεν μπορούν ακόμη να αποδοθούν με βεβαιότητα στην OpenAI. Σε αυτές, AI agents φέρεται να διερεύνησαν ιστοσελίδες άλλων ομοσπονδιακών και πολιτειακών υπηρεσιών, μεταξύ των οποίων το αμερικανικό Πολεμικό Ναυτικό και το Γραφείο Διαχείρισης και Προϋπολογισμού του Λευκού Οίκου. Οι συγκεκριμένες υπηρεσίες δεν είχαν απαντήσει μέχρι τη δημοσίευση του ρεπορτάζ.

Ο Στος υποστηρίζει ότι τα περιστατικά αποτελούν μέρος ενός ευρύτερου μοτίβου, με agents να επιχειρούν να αποκτήσουν πρόσβαση σε ιστοσελίδες εκατοντάδες χιλιάδες φορές, φαινομενικά παρακάμπτοντας περιορισμούς που έχουν θέσει οι ίδιοι οι δημιουργοί τους. Το γεγονός ότι οι ενέργειες αυτές μπορούν να προκύψουν από φαινομενικά καθημερινές εργασίες είναι αυτό που προβληματίζει ιδιαίτερα τους ερευνητές.

Το νέο μέτωπο της ασφάλειας της AI

Το νέο πεδίο προβληματισμού είναι αν οι σημερινές «δικλίδες ασφαλείας» επαρκούν για συστήματα που δεν περιορίζονται στην παραγωγή κειμένου, αλλά μπορούν να περιηγούνται στο διαδίκτυο, να γράφουν κώδικα, να χρησιμοποιούν διαπιστευτήρια και να λαμβάνουν διαδοχικές αποφάσεις για την ολοκλήρωση μιας αποστολής.\

Ο Άλτμαν έχει υποστηρίξει ότι η ασφάλεια πρέπει να προηγείται της περαιτέρω αύξησης των δυνατοτήτων της AI, προειδοποιώντας ότι χωρίς επαρκείς δικλίδες ασφαλείας η κοινωνία θα μπορούσε να «χάσει τον έλεγχο του μέλλοντος από την AI». Ο επικεφαλής της Anthropic, Ντάριο Αμοντέι, έχει επίσης ταχθεί υπέρ της επιβράδυνσης της ανάπτυξης της τεχνολογίας για λόγους ασφάλειας. Άλλοι ηγέτες της τεχνολογίας, όπως ο Τζένσεν Χουάνγκ της Nvidia, έχουν απορρίψει ως μη ρεαλιστικούς τους φόβους για ανεξέλεγκτη AI, ενώ ο Ντόναλντ Τραμπ έχει δηλώσει ότι δεν θεωρεί αναγκαία την επιβράδυνση του κλάδου.

Οι αμερικανικές υπηρεσίες που επηρεάστηκαν πάντως, υποβαθμίζουν μέχρι στιγμής τις επιπτώσεις. Η SEC δήλωσε ότι βρίσκεται σε επικοινωνία με την OpenAI και ότι δεν έχει ενημερωθεί για μη εξουσιοδοτημένη πρόσβαση σε μη δημόσιες πληροφορίες. Το υπουργείο Εμπορίου ανέφερε ότι η OpenAI απέκτησε μόνο πληροφορίες που ήταν ήδη δημόσιες στην ιστοσελίδα του Γραφείου Απογραφής. Το υπουργείο Παιδείας ανακοίνωσε ότι οι έλεγχοι των συστημάτων του δεν έδειξαν επιπτώσεις στην ιστοσελίδα ή στις βάσεις δεδομένων του.

Ανάλογο περιστατικό γνωστοποιήθηκε και από τον δήμο του Σικάγο, ο οποίος ενημερώθηκε πρόσφατα από την OpenAI ότι η τεχνολογία της είχε συλλέξει δημόσια διαθέσιμες πληροφορίες από δημοτική ιστοσελίδα. Σύμφωνα με τον δήμο, δεν φαίνεται να αποκτήθηκαν ευαίσθητα δεδομένα.

Ο Δημοκρατικός βουλευτής Τεντ Λιου, συμπρόεδρος ειδικής επιτροπής της Βουλής για την τεχνητή νοημοσύνη, περιέγραψε τα μοντέλα ως «αδίστακτα»: μπορούν, όπως είπε, να επιμένουν στην ολοκλήρωση μιας εργασίας χωρίς να κατανοούν έννοιες όπως η ηθική, οι συνέπειες, το καλό και το κακό. Κατά τον ίδιο, το πρόβλημα μπορεί τελικά να απαιτήσει όχι απλώς περισσότερα φίλτρα και περιορισμούς, αλλά βαθύτερη επανεκπαίδευση των ίδιων των μοντέλων.

Η δυσκολία με τους AI agents είναι ότι δεν χρειάζεται να έχουν «κακόβουλη πρόθεση» για να δημιουργήσουν πρόβλημα. Μπορεί να τους έχει ανατεθεί μια απολύτως συνηθισμένη εργασία, αλλά στην προσπάθειά τους να την ολοκληρώσουν, μπορεί να αναζητήσουν δρόμους που οι δημιουργοί τους δεν είχαν προβλέψει. Όπως το έθεσε ο Λιου, οι agents «δεν προσπαθούν να κάνουν κάτι κακό». Απλώς, στην προσπάθεια να ολοκληρώσουν μια εργασία, μπορεί να «ξεφύγουν» πολύ περισσότερο απ’ όσο είχε σχεδιαστεί.

Ακολουθήστε το Sofokleousin.gr στο Google News
και μάθετε πρώτοι όλες τις ειδήσεις
Σχετικά Άρθρα