Πρωτοφανές περιστατικό αποκάλυψε η OpenAI, γνωστοποιώντας ότι μοντέλο τεχνητής νοημοσύνης βασισμένο στην τεχνολογία της αυτονομήθηκε κατά τη διάρκεια δοκιμαστικής λειτουργίας.
Το μοντέλο απέκτησε αυτόνομα πρόσβαση στο διαδίκτυο και εξαπέλυσε κυβερνοεπίθεση στην πλατφόρμα φιλοξενίας AI, Hugging Face, σε ένα συμβάν που χαρακτηρίζεται ως μοναδικό στα χρονικά. Σύμφωνα με την κατασκευάστρια εταιρεία του ChatGPT, η Hugging Face κατάφερε να εντοπίσει έγκαιρα και να μπλοκάρει τον AI Agent, ένα αυτόνομο λογισμικό που εκτελεί διεργασίες χωρίς ανθρώπινη καθοδήγηση, αφότου εκείνος είχε διεισδύσει στα συστήματά της.
Πώς πραγματοποιήθηκε η κυβερνοεπίθεση από το μοντέλο του ChatGPT
«Πρόκειται για ένα πρωτοφανές επεισόδιο στον κυβερνοχώρο, το οποίο αναδεικνύει τις προηγμένες δυνατότητες που αποκτούν τα συστήματα AI στον τομέα των κυβερνοεπιθέσεων», σημείωσε η OpenAI. Μάλιστα, η εταιρεία προειδοποίησε ότι ανάλογα περιστατικά αναμένεται να πυκνώσουν στο μέλλον, όσο η ισχύς και η αυτονομία των μοντέλων τεχνητής νοημοσύνης εξελίσσονται με ραγδαίους ρυθμούς.
Σύμφωνα με δημοσιεύματα στον διεθνή τύπο, η επίθεση πραγματοποιήθηκε από έναν πράκτορα που βασιζόταν σε συνδυασμό του πιο πρόσφατου δημόσια διαθέσιμου μοντέλου της OpenAI, GPT-5.6 Sol, και ενός ακόμη πιο προηγμένου μοντέλου που δεν είχε ακόμη κυκλοφορήσει. Κατά τη διάρκεια εσωτερικών δοκιμών σε ένα απομονωμένο ψηφιακό περιβάλλον (sandbox), τα μοντέλα φέρεται να απέκτησαν πρόσβαση στο διαδίκτυο εκμεταλλευόμενα μια άγνωστη μέχρι τότε ευπάθεια.
Στη συνέχεια, ο πράκτορας φέρεται να εισέβαλε στο Hugging Face, αναζητώντας τεχνολογία που θα τον βοηθούσε να περάσει την αξιολόγηση των δυνατοτήτων του. Σύμφωνα με την OpenAI, το μοντέλο «βρήκε με επιτυχία τρόπους να αποκτήσει πρόσβαση σε μυστικές πληροφορίες, ώστε να εξαπατήσει τη διαδικασία αξιολόγησης». Η επίθεση φέρεται να σταμάτησε όταν η ομάδα ασφαλείας του Hugging Face και τα δικά της συστήματα AI εντόπισαν την ύποπτη δραστηριότητα.
Ο διευθύνων σύμβουλος του Hugging Face, Κλεμάν Ντελάνγκ, χαρακτήρισε την επίθεση «απίστευτη», αλλά δήλωσε ότι δεν πιστεύει πως υπήρχε «κακόβουλη πρόθεση» από την OpenAI.
«Υποψιαζόμασταν ότι η κυβερνοεπίθεση της περασμένης εβδομάδας ίσως προερχόταν από κάποιο κορυφαίο ερευνητικό εργαστήριο, λόγω της πολυπλοκότητας του πράκτορα», έγραψε στην πλατφόρμα Χ.
H Hugging Face αποκάλυψε αρχικά την επίθεση, μη γνωρίζοντας πως εμπλεκόταν η OpenAI. Χρησιμοποίησε ένα δωρεάν κινεζικό μοντέλο τεχνητής νοημοσύνης για να ερευνήσει το περιστατικό, καθώς τα εμπορικά μοντέλα υψηλών δυνατοτήτων δεν επέτρεπαν τέτοιου είδους ανάλυση λόγω των μηχανισμών ασφαλείας τους.
Με αυτόν τον τρόπο εντοπίστηκε μια άγνωστη ευπάθεια σε λογισμικό που ονομάζεται «zero-day vulnerability», επειδή οι προγραμματιστές έχουν μηδενικό χρόνο για να την επιδιορθώσουν μόλις ανακαλυφθεί.
Ο ειδικός στην κυβερνοασφάλεια Νέιθανιελ Τζόουνς δήλωσε ότι ο πράκτορας της OpenAI «ενήργησε όπως ένας πραγματικός χάκερ», αναζητώντας άγνωστες ευπάθειες και χρησιμοποιώντας κλεμμένα διαπιστευτήρια για να αποκτήσει πρόσβαση στα συστήματα του Hugging Face.
Τέλος, ο Αμερικανός βουλευτής Γκρεγκ Κασάρ χαρακτήρισε το περιστατικό ανησυχητικό και ζήτησε υποχρεωτικές ανεξάρτητες δοκιμές ασφαλείας, υποχρεωτική γνωστοποίηση περιστατικών ασφαλείας και διεθνή συνεργασία για την ασφαλή ανάπτυξη της τεχνητής νοημοσύνης.

