MENU

Κώδικα για… πυραύλους έγραφε το Claude της Anthropic στην Υεμένη – Συναγερμός από την Anthropic

Οι δράστες φέρονται να χώριζαν τα αιτήματά τους σε διαφορετικές συνομιλίες για να παρακάμπτουν τα συστήματα ασφαλείας

Από chatbot σε εργαλείο για κώδικα καθοδήγησης πυραύλων μετατρέπεται το AI, σύμφβωνα με όσα αποκάλυψε η ίδια η εταιρεία τεχνητής νοημοσύνης Anthropic για μία από τις πιο ανησυχητικές μέχρι σήμερα περιπτώσεις κακόβουλης χρήσης του Claude, με επίκεντρο επιχείρηση στη βόρεια Υεμένη.

Σύμφωνα με νέα έκθεση της εταιρείας, την οποία επικαλείται το Al Jazeera, οι δράστες χρησιμοποίησαν το Claude για λογισμικό σχετικό με κατευθυνόμενους και βαλλιστικούς πυραύλους, ενώ φέρονται να «έσπαγαν» τα αιτήματά τους σε διαφορετικές συνομιλίες ώστε να μην αποκαλύπτεται ο τελικός σκοπός. Και το πιο ανησυχητικό: η Anthropic παραδέχεται ότι ορισμένα αιτήματα κατάφεραν να περάσουν τα φίλτρα ασφαλείας.

Σύμφωνα με την έκθεση, διαφορετικές εκδοχές του μοντέλου αναλάμβαναν επιμέρους ρόλους για τη συγγραφή κώδικα που σχετιζόταν με την καθοδήγηση και τον έλεγχο πτήσης ενός κατευθυνόμενου πυραύλου και ενός βαλλιστικού πυραύλου μεγάλου βεληνεκούς. Η Anthropic αναφέρει χαρακτηριστικά ότι το Claude χρησιμοποιήθηκε «στη θέση ανθρώπων μηχανικών λογισμικού».

Τα συστήματα ασφαλείας της εταιρείας απέκλεισαν πολλά από τα αιτήματα, ωστόσο η Anthropic παραδέχεται ότι ορισμένα πέρασαν τους ελέγχους. Οι χρήστες φέρονται να έκρυβαν τον τελικό στόχο των ενεργειών τους και να μοίραζαν την εργασία σε διαφορετικές συνεδρίες, ώστε κανένα μεμονωμένο αίτημα να μην αποκαλύπτει ολόκληρη την επιχείρηση.

Η Anthropic σημειώνει ότι δεν διαθέτει στοιχεία που να δείχνουν πως οι δράστες κατάφεραν τελικά να αναπτύξουν επιχειρησιακό όπλο, αν και εκτιμά ότι πραγματοποιήθηκε μία ανεπιτυχής δοκιμαστική εκτόξευση. Οι σχετικοί λογαριασμοί αποκλείστηκαν και οι πληροφορίες κοινοποιήθηκαν σε εταίρους του δημόσιου και ιδιωτικού τομέα.

Κυβερνοκατασκοπεία με σχεδόν ολόκληρη την επίθεση αυτοματοποιημένη

Η έκθεση περιγράφει επίσης επιχείρηση κυβερνοκατασκοπείας που, σύμφωνα με την Anthropic, εμφάνιζε χαρακτηριστικά της ρωσικά συνδεδεμένης ομάδας Midnight Blizzard, γνωστής και ως APT29.

Στην περίπτωση αυτή, αυτοματοποιημένες ροές εργασίας με AI φέρονται να χρησιμοποιήθηκαν σχεδόν σε όλο τον κύκλο της επίθεσης: από το phishing και την αρχική προετοιμασία μέχρι την κλοπή δεδομένων. Στους στόχους περιλαμβάνονταν οργανισμοί στην Ουκρανία και την Ευρώπη, διπλωματικοί φορείς αλλά και κατασκευαστές drones.

Ξεχωριστά, η Anthropic αναφέρει ότι διέκοψε κινεζική επιχείρηση που αποδίδει σε φοιτητές πανεπιστημίων στην επαρχία Hunan. Το Claude φέρεται να λειτουργούσε ως τεχνικό και οργανωτικό «στρώμα» ενός επιθετικού προγράμματος που στόχευε κυβερνητικά και εταιρικά δίκτυα στη Μέση Ανατολή, την Ευρώπη και τη Νοτιοανατολική Ασία.

Προφίλ στόχων και επιχειρήσεις επιρροής

Στο στόχαστρο της Anthropic βρέθηκαν επίσης τρεις λογαριασμοί που η εταιρεία χαρακτηρίζει ευθυγραμμισμένους με το ιρανικό κράτος και οι οποίοι φέρονται να χρησιμοποιούσαν το Claude για συγκεκαλυμμένες επιχειρήσεις επιρροής και ψυχολογικών επιχειρήσεων.

Παράλληλα, η έκθεση περιγράφει χρήση του μοντέλου για τη δημιουργία μαζικών και δομημένων προφίλ στόχων με στοιχεία όπως η τοποθεσία, τα δημογραφικά χαρακτηριστικά και οι πολιτικές τάσεις.

Σε μία από τις πιο ανεπτυγμένες επιχειρήσεις που εντόπισε η εταιρεία, λογαριασμός που η Anthropic συνδέει με την Κίνα και δεν διέθετε γνώση αραβικών φέρεται να χρησιμοποίησε το Claude σε πολυήμερη προσπάθεια προσέγγισης Ουιγούρων στη Συρία. Το μοντέλο συνέτασσε μηνύματα στην τοπική διάλεκτο και μετέφραζε τις απαντήσεις σε πραγματικό χρόνο.

Το πρόβλημα για την Anthropic: Τα «παράθυρα» στις δικλείδες ασφαλείας

Οι αποκαλύψεις επαναφέρουν στο προσκήνιο το ερώτημα κατά πόσο τα σημερινά συστήματα ασφαλείας μπορούν να εμποδίσουν τη χρήση ισχυρών μοντέλων AI σε στρατιωτικές ή κυβερνοεπιθετικές επιχειρήσεις.

Η ίδια η Anthropic αναγνωρίζει ότι, τουλάχιστον στην υπόθεση της πυραυλικής ανάπτυξης, ορισμένα αιτήματα κατάφεραν να περάσουν τα φίλτρα ασφαλείας, καθώς οι πραγματικοί στόχοι αποκρύπτονταν και οι εργασίες κατακερματίζονταν σε διαφορετικές συνομιλίες.

Η έκθεση έρχεται παράλληλα με νέα περιστατικά που αφορούν την ασφάλεια των μοντέλων της Anthropic και με αυξανόμενες πιέσεις στις ΗΠΑ για αυστηρότερο πλαίσιο εποπτείας των συστημάτων τεχνητής νοημοσύνης. Η εταιρεία αναφέρει ότι διερευνά τα επαναλαμβανόμενα περιστατικά και έχει αναθέσει και σε ανεξάρτητο ερευνητικό φορέα την αξιολόγησή τους.

Περισσότερες ειδήσεις

Παραίτηση με «αιχμές» για το AI από ερευνητή της Anthropic

Μεγαλύτερη ανησυχία για την παγκόσμια χρηματοπιστωτική σταθερότητα ο κίνδυνος της AI στον κυβερνοχώρο

Από τους αλγόριθμους στους ανθρώπους – Το 2026 η πιο πολύτιμη σύνδεση, δε βρίσκεται στο διαδίκτυο

Σχετικά Άρθρα