Αυτόνομος AI agent «ξέφυγε» από δοκιμή ασφαλείας, σε αυστηρά ελεγχόμενο περιβάλλον, και παραβίασε την πλατφόρμα Hugging Face
Σε ανάρτησή της στο επίσημο ιστολόγιό της, η OpenAI ανέφερε ότι πραγματοποιούσε δοκιμές αξιολόγησης των δυνατοτήτων ορισμένων από τα πλέον προηγμένα μοντέλα τεχνητής νοημοσύνης της σε ένα αυστηρά ελεγχόμενο περιβάλλον. Ωστόσο, ο αυτόνομος AI agent κατάφερε να διαφύγει από το περιβάλλον περιορισμού (sandbox), να συνδεθεί στο διαδίκτυο και να επιτεθεί στην πλατφόρμα Hugging Face, επιδιώκοντας να ολοκληρώσει τον στόχο που του είχε τεθεί στο πλαίσιο της δοκιμής.
Η εταιρεία χαρακτήρισε το περιστατικό «ένα πρωτοφανές κυβερνοσυμβάν που περιλάμβανε δυνατότητες αιχμής στον κυβερνοχώρο», υπογραμμίζοντας ότι ήδη προχωρά στην ενίσχυση των μηχανισμών ασφαλείας και περιορισμού των προηγμένων μοντέλων της.
We’re partnering with @huggingface to investigate an unprecedented security incident.
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.
Sharing preliminary findings to help defenders understand emerging risks:…
— OpenAI (@OpenAI) July 21, 2026
Το Hugging Face, μία από τις μεγαλύτερες πλατφόρμες φιλοξενίας ανοικτών μεγάλων γλωσσικών μοντέλων (LLMs) και συνόλων δεδομένων, είχε αποκαλύψει την προηγούμενη εβδομάδα ότι δέχθηκε μια κυβερνοεπίθεση «διαφορετική από οτιδήποτε είχε αντιμετωπίσει μέχρι σήμερα».
Η εταιρεία είχε αναφέρει ότι η επίθεση πραγματοποιήθηκε εξ ολοκλήρου από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης, χωρίς ανθρώπινη παρέμβαση.
Ο συνιδρυτής της πλατφόρμας, Κλεμάν Ντελάνγκ, σχολίασε μέσω της πλατφόρμας X ότι η εταιρεία αρχικά υπέθεσε πως η επίθεση προερχόταν από κάποιο κορυφαίο εργαστήριο ανάπτυξης AI, λόγω της πολυπλοκότητας του συστήματος.
«Αποδείχθηκε ότι πράγματι συνέβη. Είναι πραγματικά εντυπωσιακό ότι όλα αυτά έγιναν αυτόνομα», ανέφερε χαρακτηριστικά.
We suspected last week’s cyberattack might have come from a frontier lab, given the sophistication of the agent. Turns out it did!
We’ve spent the past 24 hours working closely with the @OpenAI team (thanks!), and we strongly believe there was no malicious intent on their part.… https://t.co/XWxGMeMGje
— clem 🤗 (@ClementDelangue) July 21, 2026
Η παραδοχή της OpenAI ότι η παραβίαση προήλθε από δικά της προηγμένα μοντέλα, παρά το γεγονός ότι βρίσκονταν σε αυτό που η ίδια περιέγραψε ως «υψηλά απομονωμένο περιβάλλον», αναμένεται να εντείνει τη συζήτηση γύρω από τους κινδύνους που ενδέχεται να συνεπάγεται η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης.
Η διευθύνουσα σύμβουλος της Luta Security, Κέιτι Μουσούρις, εκτίμησε ότι το περιστατικό αποτελεί προάγγελο όσων ενδέχεται να ακολουθήσουν στο μέλλον. «Τα σημερινά μοντέλα μοιάζουν με τα πιο ευφυή χταπόδια-δραπέτες στον κόσμο, με απεριόριστους βραχίονες και την ικανότητα να ξεγλιστρούν από οποιοδήποτε σημείο», σχολίασε, τονίζοντας ότι σήμερα δεν υπάρχουν επαρκείς μηχανισμοί περιορισμού, παρακολούθησης και έγκαιρης ενημέρωσης όταν ένα σύστημα AI ξεφεύγει από τον έλεγχο.









