Ένα πρωτοφανές περιστατικό ασφαλείας επιβεβαίωσε η OpenAI, αποκαλύπτοντας ότι αυτόνομες εκδόσεις του ChatGPT κατάφεραν να παραβιάσουν την πλατφόρμα Hugging Face.
Το συμβάν συνέβη χωρίς καμία ανθρώπινη παρέμβαση, προκαλώντας έντονο προβληματισμό στην τεχνολογική κοινότητα.
Σύμφωνα με την επίσημη έρευνα της εταιρείας, πρωταγωνιστικό ρόλο είχε το μοντέλο GPT-5.6 Sol μαζί με ένα ακόμη πιο προηγμένο δοκιμαστικό μοντέλο.
Η δοκιμή πραγματοποιήθηκε σε απομονωμένο περιβάλλον sandbox, όπου οι δικλείδες ασφαλείας είχαν μειωθεί εσκεμμένα για την αξιολόγηση επιθετικών δυνατοτήτων στο διαδίκτυο.
Κατά τη διάρκεια του τεστ, τα συστήματα εστίασαν υπερβολικά στην επίλυση ενός προβλήματος αξιολόγησης. Για να βρουν τη λύση, εντόπισαν και εκμεταλλεύτηκαν ευπάθεια zero-day στο κλειστό περιβάλλον δοκιμών της OpenAI, αποκτώντας, τελικά, πρόσβαση στο ίντερνετ.
Στη συνέχεια, τα μοντέλα υπέθεσαν ότι τα απαραίτητα δεδομένα βρίσκονταν στο Hugging Face και εξαπέλυσαν σύνθετη κυβερνοεπίθεση εναντίον του.
Χρησιμοποίησαν πολλαπλά διανύσματα επίθεσης, όπως κλεμμένα διαπιστευτήρια και νέες ευπάθειες, ώστε να εισβάλουν στα συστήματα της εφαρμογής.
Οι δύο εταιρείες συνεργάζονται πλέον για την ψηφιακή διερεύνηση του περιστατικού, ενώ προχώρησαν ήδη στην αποκατάσταση των κενών ασφαλείας.
Η εξέλιξη αυτή επαληθεύει τις ανησυχίες που εκφράζονται για την ταχύτατη εξέλιξη του AI και τους πιθανούς κινδύνους.
Από την πλευρά του, το Hugging Face δήλωσε ότι «τα αυτόνομα επιθετικά εργαλεία τεχνητής νοημοσύνης δεν αποτελούν πλέον θεωρία», υπογραμμίζοντας την ανάγκη για ισχυρότερη αμυντική θωράκιση.
Παράλληλα, η OpenAI εκτιμά πως τέτοιες κυβερνοεπιθέσεις από AI θα γίνουν όλο και πιο συχνές στο μέλλον.









