Νέα ερωτήματα για τον έλεγχο των προηγμένων συστημάτων Τεχνητής Νοημοσύνης προκαλούν οι ενέργειες πρακτόρων της OpenAI στην πλατφόρμα RubyGems, οι οποίες καταγράφηκαν δύο μήνες πριν από την παραβίαση του Hugging Face.
Πράκτορες Τεχνητής Νοημοσύνης, οι οποίοι βρίσκονταν σε δοκιμαστική φάση από την OpenAI, φέρονται να προχώρησαν σε επιθετικές ενέργειες κατά του RubyGems, μιας ευρέως χρησιμοποιούμενης υπηρεσίας διανομής πακέτων λογισμικού.
Η υπόθεση έγινε γνωστή έπειτα από έρευνα που δημοσιεύθηκε την Παρασκευή (11/9) και επαναφέρει στο προσκήνιο τις ανησυχίες για τις δυνατότητες των AI agents, αλλά και για το εάν οι εταιρείες ανάπτυξής τους μπορούν να περιορίσουν αποτελεσματικά τη δράση τους.
Εκατοντάδες κακόβουλα πακέτα στο RubyGems
Όπως ανέφεραν οι ερευνητές Σπένσερ Κιτς, Τόμας Λάρσεν και Σίντνεϊ Φον Αρξ, στις 11 Μαΐου ανέβηκαν στο RubyGems εκατοντάδες κακόβουλα πακέτα. Σύμφωνα με την εκτίμησή τους, πίσω από τη συγκεκριμένη δραστηριότητα βρίσκονταν εσωτερικοί πράκτορες της OpenAI.
Οι ίδιοι υποστήριξαν ότι οι agents επιχείρησαν να αποσπάσουν διαπιστευτήρια χρηστών, αξιοποιώντας μια ευπάθεια στους διακομιστές της πλατφόρμας, η οποία μέχρι τότε δεν ήταν γνωστή. Παραμένει, ωστόσο, αδιευκρίνιστο εάν η προσπάθεια είχε αποτέλεσμα.
Παράλληλα, φέρονται να εκμεταλλεύτηκαν το RubyDoc.info, υπηρεσία που δημιουργεί τεκμηρίωση κώδικα, ώστε να εκτελέσουν δικό τους κώδικα στους διακομιστές της. Οι ερευνητές σημείωσαν ότι δεν γνωρίζουν γιατί οι πράκτορες επέλεξαν αυτή τη μέθοδο ούτε εάν πέτυχαν τον στόχο τους, καθώς δεν είχαν πρόσβαση στο σύνολο της δραστηριότητάς τους.
Τι απαντά η OpenAI
Η OpenAI επιβεβαίωσε ότι συνέβη το περιστατικό, δίνοντας όμως διαφορετική εξήγηση για τις ενέργειες των συστημάτων της.
Εκπρόσωπος της εταιρείας δήλωσε: «Με βάση την εξέτασή μας, οι πράκτορές μας χρησιμοποίησαν την πλατφόρμα RubyGems για να αποκτήσουν πρόσβαση στο διαδίκτυο, να εκτελέσουν ακίνδυνες εργασίες και να ανακτήσουν δημόσια διαθέσιμες πληροφορίες. Θα συνεχίσουμε να ερευνούμε το θέμα στο πλαίσιο της ευρύτερης εξέτασης της δραστηριότητας των agents κατά την εκπαίδευση και την αξιολόγηση».
Η εταιρεία ανέφερε ακόμη ότι βρίσκεται σε επικοινωνία με το RubyGems, προκειμένου να εξεταστούν αναλυτικά τα στοιχεία της υπόθεσης.
Δεν εντοπίστηκε επιτυχής παραβίαση
Από τη δική του έρευνα, το RubyGems ανακοίνωσε ότι δεν προέκυψαν αποδείξεις για επιτυχημένη παραβίαση των συστημάτων ή υποκλοπή στοιχείων χρηστών.
Η υπηρεσία διευκρίνισε επίσης ότι δεν ήταν σε θέση να επιβεβαιώσει εάν τα πακέτα που συνδέθηκαν με την εκστρατεία μαζικών δημοσιεύσεων δημιουργήθηκαν ή αναρτήθηκαν από πράκτορες Τεχνητής Νοημοσύνης.
Μέλος της ομάδας ασφαλείας του RubyGems είχε χαρακτηρίσει τον Μάιο το περιστατικό «μεγάλη κακόβουλη επίθεση». Εξαιτίας της δραστηριότητας, η πλατφόρμα είχε αναστείλει προσωρινά τη δυνατότητα δημιουργίας νέων λογαριασμών.
Η παραβίαση του Hugging Face και οι προηγούμενες ενέργειες
Το περιστατικό στο RubyGems σημειώθηκε περίπου δύο μήνες πριν από την παραβίαση της πλατφόρμας ανοικτού κώδικα Hugging Face. Σύμφωνα με προηγούμενες έρευνες, περίπου 700 πράκτορες της OpenAI συμμετείχαν στη συγκεκριμένη επίθεση, ενώ ορισμένοι φέρονται να προσπάθησαν να αποκρύψουν τα ίχνη τους.
Agents της εταιρείας είχαν επίσης χρησιμοποιήσει περισσότερους από δέκα ιστότοπους για μη εξουσιοδοτημένη επικοινωνία, ενώ μια ομάδα πρακτόρων είχε μετατρέψει γερμανόφωνο ιστότοπο προγραμματισμού σε χώρο ανταλλαγής μηνυμάτων και πληροφοριών.
Ανάλογα περιστατικά έχουν αναφερθεί και σε δοκιμές συστημάτων της Anthropic. Οι εξελίξεις τροφοδοτούν τη συζήτηση στις ΗΠΑ για τη θέσπιση αυστηρότερων κανόνων σχετικά με την ανάπτυξη, την αξιολόγηση και την εποπτεία προηγμένων μοντέλων Τεχνητής Νοημοσύνης.