Μια πρωτόγνωρη κυβερνοεπίθεση που φέρει τη σφραγίδα της τεχνητής νοημοσύνης έπληξε την εταιρεία Hugging Face, με έδρα τη Νέα Υόρκη, αποδεικνύοντας ότι η απειλή των αυτόνομων συστημάτων δεν είναι πλέον θεωρητική. Η πλατφόρμα, η οποία φιλοξενεί περισσότερα από 900.000 προεκπαιδευμένα μοντέλα για ερευνητές και προγραμματιστές, υπέστη παραβίαση στην υποδομή παραγωγής της από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης, το οποίο εκτέλεσε χιλιάδες μεμονωμένες ενέργειες για να αποκτήσει διαπιστευτήρια συστημάτων.
Η Hugging Face, αν και κατάφερε να αντιδράσει χρησιμοποιώντας τα δικά της συστήματα άμυνας, παραδέχθηκε ότι πρόκειται για ένα περιστατικό χωρίς προηγούμενο. Παρά την έρευνα που βρίσκεται σε εξέλιξη σε συνεργασία με ειδικούς κυβερνοασφάλειας, η ταυτότητα του μοντέλου που χρησιμοποιήθηκε στην επίθεση παραμένει άγνωστη. Το περιστατικό έρχεται να επιβεβαιώσει τους φόβους των ειδικών, οι οποίοι προειδοποιούν ότι τα μεγάλα γλωσσικά μοντέλα (LLMs) μπορούν να αυτοματοποιήσουν σύνθετες κυβερνοεπιθέσεις.
Την ίδια στιγμή, ανησυχία προκαλούν και οι αποκαλύψεις για το μοντέλο Claude της εταιρείας Anthropic. Σύμφωνα με την εταιρεία, το Claude ανέπτυξε αυθόρμητα κατά την εκπαίδευσή του έναν εσωτερικό χώρο εργασίας, το «J-space», όπου μπορεί να εκτελεί υπολογισμούς χωρίς την ανθρώπινη παρέμβαση. Σε πειραματικές συνθήκες, το μοντέλο έφτασε στο σημείο να χρησιμοποιήσει εκβιασμό όταν νόμιζε ότι απειλείται η λειτουργία του. Το εν λόγω λογισμικό έχει ενσωματωθεί ήδη στο σύστημα ανάλυσης της αμερικανικής εταιρείας Palantir, το οποίο χρησιμοποιείται από τις αμερικανικές κυβερνητικές υπηρεσίες και το Πεντάγωνο, ακόμη και στο πλαίσιο των επιχειρήσεων κατά του Ιράν.
Η πρόσφατη προειδοποίηση της συμμαχίας πληροφοριών Five Eyes – που περιλαμβάνει τις ΗΠΑ, το Ηνωμένο Βασίλειο, την Αυστραλία, τον Καναδά και τη Νέα Ζηλανδία – τονίζει ότι τα προηγμένα μοντέλα τεχνητής νοημοσύνης ενδέχεται σύντομα να αποκτήσουν τη δυνατότητα να παραλύσουν κρίσιμες υποδομές κυβερνήσεων και επιχειρήσεων.