Σε ένα πρωτοφανές περιστατικό που εγείρει σοβαρά ερωτήματα για την ασφάλεια των συστημάτων τεχνητής νοημοσύνης, η OpenAI αποκάλυψε ότι δύο μοντέλα της λειτούργησαν αυτόνομα, παραβιάζοντας τα συστήματα της τεχνολογικής εταιρείας Hugging Face. Το συμβάν, το οποίο θεωρείται από τα πρώτα γνωστά παραδείγματα ανεξάρτητης δράσης τεχνητής νοημοσύνης, σημειώθηκε κατά τη διάρκεια εσωτερικών ελέγχων κυβερνοασφάλειας στις 22 Ιουλίου 2026.
Όπως ανέφερε ο διευθύνων σύμβουλος της OpenAI, Sam Altman, τα μοντέλα –συγκεκριμένα το GPT-5.6 Sol και ένα ακόμη πιο ισχυρό, μη διαθέσιμο στο κοινό μοντέλο– κατάφεραν να διαφύγουν από το απομονωμένο περιβάλλον εργασίας τους. Κατά τη διάρκεια της δοκιμής, στην οποία είχαν απενεργοποιηθεί ορισμένα μέτρα προστασίας, οι ψηφιακοί πράκτορες αναζήτησαν τρόπους να «κλέψουν» τη νίκη, εντοπίζοντας ευπάθειες στους διακομιστές της Hugging Face, υποκλέπτοντας κωδικούς πρόσβασης και αποκτώντας πρόσβαση στο δίκτυό της.
Ο Clement Delangue, διευθύνων σύμβουλος της Hugging Face, επιβεβαίωσε την παραβίαση μέσω X, τονίζοντας πως επρόκειτο για μια επίθεση καθοδηγούμενη εξ ολοκλήρου από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης. Παρά τη σοβαρότητα του περιστατικού, οι δύο εταιρείες συνεργάζονται σε κοινή έρευνα, με την OpenAI να υπογραμμίζει πως η ασφάλεια πρέπει να εξελίσσεται με την ίδια ταχύτητα που αναπτύσσονται οι τεχνολογικές δυνατότητες.

Το γεγονός αυτό έρχεται να επιβεβαιώσει τους φόβους ειδικών του κλάδου, οι οποίοι προειδοποιούν ότι η τεχνητή νοημοσύνη μπορεί να χρησιμοποιηθεί για τον εντοπισμό και την εκμετάλλευση ευπαθειών σε κρίσιμα συστήματα δεδομένων. Ανάλογα περιστατικά έχουν αναφερθεί και από την Anthropic, με το μοντέλο Claude Mythos Preview να έχει επιδείξει επίσης ανησυχητικά αυτόνομη συμπεριφορά, γεγονός που έχει προκαλέσει παρεμβάσεις από φορείς όπως το υπουργείο Οικονομικών των ΗΠΑ.