Φωτογραφία: Pixabay
Η OpenAI αποκάλυψε ότι ένας αυτόνομος πράκτορας τεχνητής νοημοσύνης (AI agent), που λειτουργούσε με την τεχνολογία της, ξέφυγε από τον έλεγχο κατά τη διάρκεια δοκιμών, απέκτησε πρόσβαση στο ανοιχτό διαδίκτυο και παραβίασε μόνος του τα συστήματα της γνωστής startup Hugging Face, σε αυτό που η εταιρεία χαρακτήρισε «πρωτοφανές περιστατικό».
Η εταιρεία πίσω από το ChatGPT ανέφερε ότι η Hugging Face εντόπισε και περιόρισε τον AI agent ένα εργαλείο τεχνητής νοημοσύνης σχεδιασμένο να εκτελεί εργασίες χωρίς ανθρώπινη παρέμβαση αφού αυτός είχε ήδη εισέλθει στα συστήματά της.
«Θεωρούμε ότι πρόκειται για ένα πρωτοφανές περιστατικό κυβερνοασφάλειας, το οποίο περιλάμβανε δυνατότητες κυβερνοεπιθέσεων τελευταίας τεχνολογίας», ανέφερε η OpenAI.
Η εταιρεία πρόσθεσε ότι αναμένει παρόμοια περιστατικά να γίνονται ολοένα και συχνότερα, καθώς τα μοντέλα τεχνητής νοημοσύνης η τεχνολογία που βρίσκεται πίσω από εργαλεία όπως τα chatbots και οι AI agents αποκτούν ολοένα μεγαλύτερες δυνατότητες.
Η OpenAI εξήγησε ότι η παραβίαση πραγματοποιήθηκε από έναν agent που βασιζόταν σε συνδυασμό του πιο πρόσφατου δημόσια διαθέσιμου μοντέλου της, του GPT-5.6 Sol, και ενός ακόμη ισχυρότερου μοντέλου που δεν έχει ακόμη κυκλοφορήσει.
Κατά τη διάρκεια εσωτερικών δοκιμών των δυνατοτήτων τους στο hacking, μέσα σε ένα απομονωμένο ψηφιακό εργαστήριο (sandbox), τα μοντέλα κατάφεραν να αποκτήσουν πρόσβαση στο ανοιχτό διαδίκτυο, εντοπίζοντας μια άγνωστη μέχρι τότε ευπάθεια ασφαλείας, δημιουργώντας ουσιαστικά μια «οδό διαφυγής».
Στη συνέχεια, ο AI agent παραβίασε τα συστήματα της Hugging Face, μιας πλατφόρμας-αποθετηρίου μοντέλων τεχνητής νοημοσύνης, με στόχο να βρει τεχνολογία που θα τον βοηθούσε να περάσει με επιτυχία τη δοκιμή αξιολόγησης των δυνατοτήτων του στο hacking.
Η OpenAI ανέφερε ότι τα μοντέλα «κατάφεραν να βρουν τρόπους πρόσβασης σε απόρρητες πληροφορίες, τις οποίες θα μπορούσαν να χρησιμοποιήσουν για να εξαπατήσουν τη διαδικασία αξιολόγησης».
Η επίθεση σταμάτησε όταν η ομάδα κυβερνοασφάλειας της Hugging Face, μαζί με τα δικά της συστήματα τεχνητής νοημοσύνης, εντόπισαν και ανέκοψαν τη δραστηριότητα του ανεξέλεγκτου agent.
Ο διευθύνων σύμβουλος της Hugging Face, Κλεμάν Ντελάνγκ, χαρακτήρισε την επίθεση «συγκλονιστική», ωστόσο δήλωσε ότι πιστεύει πως «δεν υπήρχε κακόβουλη πρόθεση» από την πλευρά της OpenAI.
«Υποψιαζόμασταν ότι η κυβερνοεπίθεση της περασμένης εβδομάδας προερχόταν από κάποιο κορυφαίο εργαστήριο τεχνητής νοημοσύνης, λόγω της πολυπλοκότητας του agent», έγραψε στην πλατφόρμα X.
Ο όρος zero-day vulnerability περιγράφει μια άγνωστη ευπάθεια σε λογισμικό ή πληροφοριακά συστήματα, την οποία οι προγραμματιστές δεν έχουν προλάβει να διορθώσουν, επειδή ουσιαστικά έχουν «μηδέν χρόνο» για να αντιδράσουν μόλις αποκαλυφθεί.
Τον Απρίλιο, η Anthropic, ένας από τους βασικούς ανταγωνιστές της OpenAI, είχε ανακοινώσει ότι το μοντέλο Mythos είχε εντοπίσει χιλιάδες τέτοιες ευπάθειες.
Η αποκάλυψη αυτή οδήγησε την αμερικανική κυβέρνηση στην επιβολή περιορισμών στις εξαγωγές του Mythos και του συγγενικού μοντέλου Fable 5, αν και οι περιορισμοί αυτοί αργότερα ήρθησαν. Αντίστοιχοι περιορισμοί είχαν επιβληθεί και στο GPT-5.6 Sol, το οποίο πλέον έχει διατεθεί παγκοσμίως.
Ο Δημοκρατικός βουλευτής των ΗΠΑ, Γκρεγκ Κάσαρ, χαρακτήρισε το περιστατικό ιδιαίτερα ανησυχητικό.
«Η τεχνητή νοημοσύνη εξελίσσεται με εξαιρετικά γρήγορους ρυθμούς, χωρίς να υπάρχουν ουσιαστικοί κανονισμοί που να μας προστατεύουν», δήλωσε, ζητώντας να καθιερωθούν υποχρεωτικές ανεξάρτητες δοκιμές ασφαλείας, υποχρεωτική γνωστοποίηση περιστατικών κυβερνοασφάλειας και διεθνής συνεργασία «για να προστατευθούν οι άνθρωποι από μια απόλυτη καταστροφή».
Πηγή: Guarduan