23.07.2026
4’ READ TIME

Μοντέλα της OpenAI ξέφυγαν από τον έλεγχο και χάκαραν άλλη εταιρεία αυτόνομα

Μοντέλα τεχνητής νοημοσύνης της OpenAI ξεπέρασαν τα όρια ενός περιβάλλοντος δοκιμών, εντόπισαν ευπάθεια zero-day και επιχείρησαν πρόσβαση σε εξωτερική υποδομή. Τι σημαίνει αυτό για την κυβερνοασφάλεια.
Φωτο-εικονογράφηση: Jacqui VanLiew; Getty Images
Billboard 1

Κατά τη διάρκεια εσωτερικών αξιολογήσεων της OpenAI, αυτόνομα μοντέλα τεχνητής νοημοσύνης κατάφεραν να ξεπεράσουν τα μέτρα απομόνωσης του περιβάλλοντος δοκιμών, ανακάλυψαν ευπάθεια zero-day και επιτέθηκαν στις υποδομές της Hugging Face.

Η OpenAI αποκάλυψε ότι ορισμένα από τα πιο προηγμένα μοντέλα της «ξέφυγαν» από το ελεγχόμενο περιβάλλον δοκιμών και πραγματοποίησαν κυβερνοεπίθεση στην πλατφόρμα της Hugging Face, σε ένα περιστατικό που η εταιρεία χαρακτήρισε ως «πρωτοφανές στον κυβερνοχώρο».

Από την πλευρά της, η Hugging Face επιβεβαίωσε ότι διερευνά μια παραβίαση ασφάλειας η οποία «διαφέρει από οτιδήποτε είχαμε αντιμετωπίσει στο παρελθόν», καθώς σχεδιάστηκε και υλοποιήθηκε εξ ολοκλήρου, από την αρχή έως το τέλος, από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης.

Από την πλευρά της, η OpenAI ανέλαβε την ευθύνη, προχώρησε, όπως αναφέρει στην ανακοίνωση, σε αποκάλυψη της ευπάθειας zero-day, και δεσμεύτηκε να επιβάλει αυστηρότερους ελέγχους στις υποδομές αξιολόγησης.

Η ιδέα ενός συστήματος AI που αναπτύσσει δική του στρατηγική και επιτίθεται σε εξωτερικούς στόχους για να επιτύχει τον σκοπό του αποτελούσε επί χρόνια μοτίβο της επιστημονικής φαντασίας. Ωστόσο, η ανακοίνωση των δύο εταιρειών αποδεικνύει ότι τα όρια μεταξύ θεωρητικού κινδύνου και πραγματικότητας έχουν αρχίσει να θολώνουν όσο αυξάνονται οι δυνατότητες των προηγμένων μοντέλων ΑΙ.

Το ΑΙ δεν «επαναστάτησε». Έκανε ακριβώς αυτό που του ζητήθηκε αλλά βρήκε έναν δρόμο που οι άνθρωποι δεν είχαν προβλέψει.

Το χρονικό της «απόδρασης»

Το περιστατικό συνέβη κατά τη διάρκεια εσωτερικών δοκιμών της OpenAI, όπου τα μοντέλα αξιολογούνταν στο benchmark ExploitGym -μια σειρά τεστ που μετρούν τις προηγμένες ικανότητες των συστημάτων AI. Για να αποτυπωθεί το μέγιστο εύρος των δυνατοτήτων τους, οι ερευνητές είχαν απενεργοποιήσει τα παραδοσιακά φίλτρα προστασίας που εμποδίζουν τα μοντέλα από το να εκτελούν επιθετικές ενέργειες.

Η διαδικασία πραγματοποιήθηκε με τη χρήση ενός συνδυασμού μοντέλων, μεταξύ των οποίων η έκδοση επόμενης γενιάς GPT-5.6 Sol καθώς και ένα «ακόμη πιο ισχυρό μοντέλο που δεν έχει κυκλοφορήσει ακόμη στο κοινό».

Τα μοντέλα βρίσκονταν σε ένα αυστηρά απομονωμένο περιβάλλον με περιορισμένη δικτυακή πρόσβαση. Ωστόσο, στην προσπάθειά τους να επιλύσουν τις ασκήσεις του benchmark, δαπάνησαν σημαντικούς υπολογιστικούς πόρους αναζητώντας τρόπο να παρακάμψουν τους περιορισμούς.

Εντόπισαν μια άγνωστη ευπάθεια (zero-day), εκτέλεσαν μια σειρά ενεργειών εντός του ερευνητικού δικτύου της OpenAI, μέχρι που βρήκαν έναν κόμβο με ελεύθερη πρόσβαση στο διαδίκτυο.

Η επίθεση στην Hugging Face

Αφού απέκτησαν πρόσβαση στο ίντερνετ, τα μοντέλα υπέθεσαν ότι οι απαντήσεις ή τα δεδομένα αξιολόγησης του ExploitGym ενδέχεται να βρίσκονται αποθηκευμένα στις υποδομές της Hugging Face -της μεγαλύτερης πλατφόρμας φιλοξενίας μοντέλων και συνόλων δεδομένων ανοιχτού κώδικα.

Με στόχο να «κλέψουν» τις λύσεις της δοκιμασίας, τα μοντέλα οργάνωσαν μια πολυεπίπεδη επίθεση, σύμφωνα με τις ανακοινώσεις.

Ουσιαστικά, τα μοντέλα, προκειμένου να επιτύχουν τη βαθμολογία τους στο benchmark, αποφάσισαν ότι ο πιο αποτελεσματικός δρόμος ήταν να χακάρουν την εξωτερική υποδομή που φιλοξενούσε τα δεδομένα του τεστ.

Η αντίδραση των εταιρειών

Η ασυνήθιστη δραστηριότητα εντοπίστηκε από τις ομάδες ασφαλείας και των δύο εταιρειών. Η Hugging Face ενεργοποίησε πρωτόκολλα απομόνωσης και ανάσχεσης, χρησιμοποιώντας δικά της μοντέλα AI για την ανάλυση της επίθεσης.

Όπως δήλωσε ο Clem Delangue, συνιδρυτής και CEO της Hugging Face: «Το περιστατικό αυτό, πιθανότατα το πρώτο στο είδος του, αποδεικνύει κάτι που πιστεύουμε εδώ και καιρό: Η ασφάλεια της Τεχνητής Νοημοσύνης δεν θα επιλυθεί από μία μόνο εταιρεία που εργάζεται κεκλεισμένων των θυρών. Θα επιλυθεί ανοιχτά, συνεργατικά και με ευρεία πρόσβαση στα εργαλεία AI για κάθε αμυνόμενο».

Από την πλευρά της, η OpenAI ανέλαβε την ευθύνη, προχώρησε, όπως αναφέρει στην ανακοίνωση, σε αποκάλυψη της ευπάθειας zero-day, και δεσμεύτηκε να επιβάλει αυστηρότερους ελέγχους στις υποδομές αξιολόγησης.

Η επόμενη μέρα της κυβερνοασφάλειας

Το συμβάν αναμένεται να εντείνει τις ανησυχίες σχετικά με την ισχύ των κορυφαίων μοντέλων AI, σε μια περίοδο που μοντέλα όπως το Mythos της Anthropic έχουν ήδη προκαλέσει έντονες συζητήσεις και τους πρώτους ρυθμιστικούς περιορισμούς

Όπως σημείωσε η OpenAI, τέτοια φαινόμενα «αναμένεται να γίνουν πιο συνηθισμένα με την εξάπλωση μοντέλων που διαθέτουν ολοένα και περισσότερες δυνατότητες στον κυβερνοχώρο».

Το περιστατικό δείχνει ότι τα αυτόνομα μοντέλα διαθέτουν πλέον την ικανότητα να σχεδιάζουν και να εκτελούν σύνθετες κυβερνοεπιθέσεις στον πραγματικό κόσμο, χωρίς καν πρόσβαση στον πηγαίο κώδικα των στόχων τους.

Η μάχη της κυβερνοασφάλειας έχει ήδη περάσει σε νέα εποχή με την εμφάνιση εξελιγμένων μοντέλων ΑΙ. Τέτοια περιστατικά ενδέχεται να οδηγήσουν σε ανάγκη για επαναξιολόγηση κάποιων κινδύνων και σε ευρεία χρήση εργαλείων AI για να εντοπίζουν ευπάθειες σε ταχύτητες μηχανής -πριν προλάβουν να τις εκμεταλλευτούν κακόβουλοι δρώντες ή τα ίδια τα μοντέλα.

© WIRED Greece. Επιτρέπεται η αναδημοσίευση αποσπασμάτων μόνο με ενεργό σύνδεσμο προς το πρωτότυπο άρθρο και σαφή αναφορά στο WIRED Greece.
Για πλήρη αναδημοσίευση απαιτείται προηγούμενη γραπτή άδεια.
Βασίλης Τατσιόπουλος, Ως Staff Writer στο WIRED Greece, γράφει για τη διασταύρωση τεχνολογίας και κουλτούρας. Με θητεία… Περισσότερα

Γράψου στο newsletter μας!

Κάνε εγγραφή στο newsletter του WIRED Greece για να λαμβάνεις κάθε εβδομάδα τις ιστορίες, τις ιδέες και τις τεχνολογίες που διαμορφώνουν το αύριο.

Με την εγγραφή σας, συμφωνείτε με τους Όρους Χρήσης μας (συμπεριλαμβανομένης της παραίτησης από ομαδικές αγωγές και των διατάξεων διαιτησίας) και αναγνωρίζετε την Πολιτική Απορρήτου μας.

MOST READ ARTICLES
Sidebar 1
Sidebar 1
READ ALSO