Μοντέλα της OpenAI χάκαραν το Hugging Face για να «κλέψουν» σε τεστ αξιολόγησης

Το περιστατικό, το οποίο επιβεβαιώθηκε από τον διευθύνοντα σύμβουλο της OpenAI, Sam Altman, αλλά και τον διευθύνοντα σύμβουλο του Hugging Face, Clément Delangue, θεωρείται το πρώτο καταγεγραμμένο συμβάν όπου αυτόνομοι AI agents παραβιάζουν εξωτερικές υποδομές παραγωγής
 
Σε μια εξέλιξη που θυμίζει σενάριο επιστημονικής φαντασίας -αλλά αποτελεί πλέον πραγματικότητα στον τομέα της κυβερνοασφάλειας και της νέας AI-, η OpenAI παραδέχθηκε επίσημα ότι προηγμένα εσωτερικά μοντέλα της «δραπέτευσαν» από το απομονωμένο περιβάλλον δοκιμών (sandbox) και εξαπέλυσαν αυτόνομη κυβερνοεπίθεση κατά της πλατφόρμας Hugging Faceμε μοναδικό στόχο να… «κλέψουν» στις εξετάσεις τους.
 
Το περιστατικό, το οποίο επιβεβαιώθηκε από τον διευθύνοντα σύμβουλο της OpenAI, Sam Altman, αλλά και τον διευθύνοντα σύμβουλο του Hugging Face, Clément Delangue, θεωρείται το πρώτο καταγεγραμμένο συμβάν όπου αυτόνομοι AI agents παραβιάζουν εξωτερικές υποδομές παραγωγής χωρίς ανθρώπινη εντολή ή δόλο.

Το χρονικό της αυτόνομης «απόδρασης»

Σύμφωνα με την επίσημη ανακοίνωση της OpenAI, το συμβάν σημειώθηκε κατά τη διάρκεια εσωτερικών δοκιμών αξιολόγησης των κυβερνο-ικανοτήτων των μοντέλων της (benchmark ExploitGym). Στις δοκιμές αυτές συμμετείχαν το νέο μοντέλο GPT-5.6 Sol, καθώς και ένα ακόμα πιο προηγμένο πειραματικό μοντέλο που δεν έχει κυκλοφορήσει στην αγορά. Για τις ανάγκες της αξιολόγησης, οι εσωτερικές δικλίδες ασφαλείας και οι αρνήσεις εκτέλεσης επιθετικών ενεργειών (cyber refusals) είχαν προσωρινά απενεργοποιηθεί.

Διαβάστε τη συνέχεια στο startupper.gr

ΣΧΕΤΙΚΑ ΑΡΘΡΑ