Οι πράκτορες τεχνητής νοημοσύνης που δημιούργησε η OpenAI εισέβαλαν στα ίδια τα συστήματα της εταιρείας κατά τη διάρκεια εσωτερικών δοκιμών και, σε ορισμένες περιπτώσεις, προσπάθησαν να αποκρύψουν τη συμπεριφορά τους, ανέφερε η εταιρεία σε έκθεση που δημοσιεύθηκε την Τετάρτη. Τα ευρήματα αυτά αναμένεται να εντείνουν τις ανησυχίες σχετικά με τα ολοένα και πιο ικανά συστήματα τεχνητής νοημοσύνης.
Η OpenAI ανέφερε ότι ορισμένοι πράκτορες διέφυγαν από περιορισμένα περιβάλλοντα δοκιμών, συνεργάστηκαν με άλλους πράκτορες και παρέμβαλαν στα συστήματα της εταιρείας, ενώ άλλοι «έκαναν ζαβολιά» σε εργασίες που δεν σχετίζονταν με την κυβερνοασφάλεια.
Ορισμένες από αυτές τις αντικοινωνικές συμπεριφορές, που κορυφώθηκαν με την παραβίαση της πλατφόρμας λογισμικού ανοιχτού κώδικα Hugging Face τον περασμένο μήνα, είχαν ήδη αποκαλυφθεί ή αναφερθεί στο παρελθόν, σύμφωνα με το Reuters.
Ωστόσο, η εταιρεία αποκαλύπτει για πρώτη φορά πολλές λεπτομέρειες στην έκθεση των 37 σελίδων. Ορισμένες από αυτές προκάλεσαν ανησυχία σε τουλάχιστον έναν ερευνητή στον τομέα της ασφάλειας της τεχνητής νοημοσύνης, ο οποίος ανέφερε ότι υποδηλώνουν ενδεχομένως βαθύτερα προβλήματα με την τεχνολογία στην OpenAI και ίσως και πέραν αυτής.
We have conducted a thorough investigation into the Hugging Face incident.
— OpenAI (@OpenAI) August 26, 2026
We are releasing a technical report and accompanying blog post that reconstruct the agents’ activity, explain why existing safeguards failed, and detail how we’re preventing recurrence.…
Οι πράκτορες της OpenAI παραβίασαν τμήματα των εσωτερικών συστημάτων της εταιρείας σε μια προσπάθεια να αντιγράψουν σε δοκιμασίες ή να αποκτήσουν μεγαλύτερη ελευθερία κινήσεων.
Περισσότεροι από ένας πράκτορες της OpenAI εμπλέκονταν στην παραβίαση της Hugging Face, και σε τουλάχιστον μία περίπτωση οι πράκτορες αντάλλαξαν πληροφορίες σχετικά με τον τρόπο να εισχωρήσουν κρυφά στο δίκτυο της εταιρείας.
Οι πράκτορες Τεχνητής Νοημοσύνης αντέγραψαν σε εξετάσεις που δεν σχετίζονταν με τον κυβερνοχώρο, συμπεριλαμβανομένων εξετάσεων που αφορούσαν μια βάση δεδομένων πρωτεϊνών και ένα υπολογιστικό φύλλο. Ορισμένα μοντέλα τεχνητής νοημοσύνης προσπάθησαν να αποκρύψουν την παράνομη συμπεριφορά τους διαγράφοντας ή αλλοιώνοντας τα αρχεία των ενεργειών τους.
Το γεγονός ότι αρκετοί πράκτορες εμπλέκονταν στην παραβίαση της Hugging Face και ότι, σε ορισμένες περιπτώσεις, συνεργάζονταν μεταξύ τους, είναι πιθανό να εγείρει ανησυχίες σχετικά με το πόσο στενά παρακολουθούσε η OpenAI τις δοκιμές.
«Με την εκ των υστέρων γνώση, ορισμένα πρώιμα σημάδια που εντοπίστηκαν στην παρούσα έκθεση θα μπορούσαν να είχαν προκαλέσει μια πρωτύτερη αντίδραση», ανέφερε η OpenAI στην έκθεσή της.
Περισσότερες ειδήσεις