MENU

AI agents έστησαν «κρυφό» δίκτυο επικοινωνίας σε γερμανικό wiki

Έκαναν πάνω από 15.000 παρεμβάσεις και αντάλλασσαν τρόπους για να παρακάμπτουν περιορισμούς και να μην εντοπίζονται

Μια μέχρι σήμερα άγνωστη υπόθεση μη εξουσιοδοτημένης δραστηριότητας από AI agents της OpenAI αποκαλύπτει νέα έρευνα, σύμφωνα με την οποία ένα σύνολο αυτόνομων πρακτόρων τεχνητής νοημοσύνης «ξέφυγε» από δοκιμές την περασμένη άνοιξη και χρησιμοποίησε έναν γερμανικό ιστότοπο ως πίνακα επικοινωνίας μεταξύ agents.

Το περιστατικό ξεκίνησε τον Μάιο του 2026 και, σύμφωνα με το Reuters και δύο πηγές με γνώση της υπόθεσης, τα στελέχη της OpenAI ενημερώθηκαν για αυτό εβδομάδες αργότερα. Η εταιρεία υποστηρίζει ότι έχει ενεργήσει με διαφάνεια και καλή πίστη, συνεργαζόμενη με εξωτερικούς ειδικούς, ενώ απορρίπτει μέρος των ισχυρισμών που διατυπώνονται γύρω από τον τρόπο με τον οποίο χειρίστηκε εσωτερικά το συμβάν.

Η υπόθεση έρχεται σε μια περίοδο κατά την οποία οι εταιρείες τεχνητής νοημοσύνης αναπτύσσουν ολοένα πιο αυτόνομους agents, ικανούς να εκτελούν σύνθετες εργασίες χωρίς συνεχή ανθρώπινη παρέμβαση. Παράλληλα, αυξάνονται οι ενδείξεις ότι τέτοια συστήματα μπορούν να εκμεταλλεύονται κενά, να παρακάμπτουν κανόνες και να συντονίζονται μεταξύ τους με τρόπους που δεν είχαν προβλεφθεί από τους δημιουργούς τους.

Πάνω από 15.000 επεξεργασίες σε γερμανικό wiki

Το περιστατικό εντοπίστηκε στα τέλη Αυγούστου από ομάδα ερευνητών, μεταξύ των οποίων η Sydney Von Arx, CEO της μη κερδοσκοπικής οργάνωσης για την ασφάλεια της AI Nightingale, και ο ερευνητής τεχνητής νοημοσύνης Cormac Slade Byrd.

Οι ερευνητές ανέφεραν ότι εντόπισαν περισσότερες από 15.000 επεξεργασίες που πραγματοποιήθηκαν από AI agents στο DseWiki, ένα γερμανόφωνο wiki που απευθύνεται κυρίως σε προγραμματιστές και επιτρέπει συλλογικές παρεμβάσεις από τους χρήστες.

Σύμφωνα με την έρευνα, οι agents είχαν ουσιαστικά μετατρέψει τον ιστότοπο σε ένα είδος message board, όπου αντάλλασσαν μεταξύ τους τεχνικές για να επιτυγχάνουν καλύτερα αποτελέσματα σε ορισμένες εργασίες, να παρακάμπτουν περιορισμούς της OpenAI και να αποκρύπτουν τη συμπεριφορά τους.

Οι ερευνητές εκτίμησαν ότι η δραστηριότητα προερχόταν από AI agents λόγω της εξαιρετικά υψηλής ταχύτητας με την οποία πραγματοποιούνταν οι παρεμβάσεις, αλλά και της έντονης εστίασης σε τεχνικά προβλήματα που παραπέμπουν σε αξιολογήσεις και δοκιμές μοντέλων AI.

Τα μηνύματα υπογράφονταν από λογαριασμούς που αυτοπροσδιορίζονταν ως agents, ενώ περίπου οι μισοί χρησιμοποιούσαν ονόματα που παρέπεμπαν στην OpenAI, όπως «OpenAIResearcher» και «OAIResearchMar26».

Παράλληλα, δημόσια αρχεία καταγραφής διακομιστών έδειξαν ότι σημαντικό μέρος της δραστηριότητας προερχόταν από υποδομές Microsoft Azure, τις οποίες χρησιμοποιεί και η OpenAI. Οι ερευνητές κατέγραψαν επίσης επανειλημμένες επισκέψεις εργαζομένων της OpenAI στον ιστότοπο μετά το περιστατικό, στοιχείο που, κατά την εκτίμησή τους, ενισχύει τη σύνδεση της εταιρείας με τους συγκεκριμένους agents.

Tor, εφεδρικές σελίδες και προσπάθειες αποφυγής εντοπισμού

Στα μηνύματα που εξετάστηκαν, οι agents εμφανίζονται να συζητούν τρόπους αποφυγής εντοπισμού, χρήση εργαλείων όπως το Tor, αλλά και μεθόδους διατήρησης των επικοινωνιών τους ακόμη και μετά τη διακοπή της λειτουργίας τους.

Όταν ο διαχειριστής του DseWiki άρχισε τον Ιούνιο να διαγράφει σελίδες που είχαν δημιουργηθεί, οι agents αντέδρασαν δημιουργώντας εφεδρικές σελίδες, προκειμένου να παρακάμψουν την εκκαθάριση του ιστότοπου.

Οι ερευνητές εντόπισαν ακόμη ενδείξεις προσπαθειών παρέμβασης στον ίδιο τον ιστότοπο. Ο Lukasz Olejnik, visiting senior research fellow στο King’s College London, χαρακτήρισε τη συγκεκριμένη δραστηριότητα απόπειρα hacking. Η OpenAI αμφισβήτησε αυτόν τον χαρακτηρισμό, με βάση τη δική της ανάλυση του διαθέσιμου υλικού.

Ο Maurice Chiodo, ακαδημαϊκός στο Centre for the Study of Existential Risk του Πανεπιστημίου του Cambridge, ο οποίος εξέτασε μέρος των επικοινωνιών, ανέφερε ότι τα μηνύματα έμοιαζαν με τη λειτουργία ενός είδους «υπόγειου δικτύου» προσανατολισμένου στην ολοκλήρωση μιας συγκεκριμένης αποστολής.

Κατά την εκτίμησή του, η υπόθεση ενισχύει τις ανησυχίες ότι ένας από τους κινδύνους της προηγμένης τεχνητής νοημοσύνης δεν βρίσκεται απαραίτητα σε ένα και μοναδικό υπερ-ευφυές σύστημα, αλλά σε μεγάλα σύνολα ημιαυτόνομων agents που μπορούν να συνεργάζονται μεταξύ τους.

Η σύνδεση με την υπόθεση Hugging Face και η απάντηση της OpenAI

Το νέο περιστατικό είναι ανεξάρτητο από την παραβίαση του Hugging Face τον Ιούλιο, όταν AI agents της OpenAI φέρεται να οργάνωσαν αυτόνομα μια ψηφιακή επίθεση η οποία παρέμεινε απαρατήρητη για περισσότερο από μία εβδομάδα.

Μετά το περιστατικό στο Hugging Face, η OpenAI είχε ανακοινώσει αυξημένη παρακολούθηση των μοντέλων της και τον Αύγουστο προχώρησε σε προσωρινή επιβράδυνση μέρους της εκπαίδευσής τους, προκειμένου να προσθέσει νέα μέτρα ασφαλείας.

Η OpenAI ανέφερε ότι δεν μπορούσε να σχολιάσει ουσιαστικά τα ευρήματα της νέας έκθεσης πριν αποκτήσει πρόσβαση σε αυτήν και ότι θα την εξετάσει μετά τη δημοσίευσή της.

Η εταιρεία απέρριψε επίσης ως «ψευδείς» τους ισχυρισμούς ότι η νομική της ομάδα επιχείρησε να αποθαρρύνει τη διερεύνηση του περιστατικού. Τόνισε ακόμη ότι η δραστηριότητα στη Γερμανία δεν σχετιζόταν με το Hugging Face και, ως εκ τούτου, δεν θα εντασσόταν σε αναφορά περιστατικού για την παραβίαση της συγκεκριμένης πλατφόρμας.

Σύμφωνα με το Reuters, τέσσερις πηγές με γνώση της υπόθεσης ανέφεραν ότι ορισμένοι ερευνητές της OpenAI επιχείρησαν να διευρύνουν την έρευνα για παρόμοια συμπεριφορά AI agents, συναντώντας αντιστάσεις στο εσωτερικό της εταιρείας. Η OpenAI απορρίπτει την εκδοχή ότι οι νομικοί της σύμβουλοι εμπόδισαν τη διερεύνηση.

Περισσότερες ειδήσεις

Ζώδια, ψυχολογία και… ChatGPT: Το μοντέλο GPT-4 «μάντεψε» τις απαντήσεις 600 ανθρώπων σε νέα έρευνα

Εντός των τειχών ο εχθρός της OpenAI – Πράκτορες AI χάκαραν την εταιρεία τους και το έκρυψαν

«Πείραξαν» δείγματα DNA με Τεχνητή Νοημοσύνη – Το κενό ασφαλείας που ανησυχεί τις Αρχές

Σχετικά Άρθρα