Day 2 Day – Οι Είδησεις Σήμερα
Διαδίκτυο - Επιστήμη & AI

OpenAI: Πώς ο πράκτορας ΤΝ ξέφυγε και χάκαρε τη Hugging Face – ertnews.gr

Σιγά σιγά ξετυλίγεται το κουβάρι της πρωτοφανούς κυβερνοεπίθεσης που πραγματοποίησε ένα αυτόνομο σύστημα Τεχνητής Νοημοσύνης της OpenAI εναντίον της Hugging Face, μιας από τις μεγαλύτερες πλατφόρμες φιλοξενίας μοντέλων και εργαλείων ΤΝ.

Όπως είχε γράψει το ertnews.gr στις 22 Ιουλίου, το σύστημα κατάφερε, ενώ δοκιμαζόταν σε απομονωμένο περιβάλλον, να παρακάμψει τους περιορισμούς ασφαλείας, να αποκτήσει πρόσβαση στο διαδίκτυο και να εισβάλει στις υποδομές μιας άλλης εταιρείας.

Όμως νέες πληροφορίες έρχονται συνεχώς στη δημοσιότητα, δημιουργώντας περισσότερα ερωτήματα από όσα λύνουν. Το σημαντικότερο είναι ίσως πώς ένα σύστημα ειδικά σχεδιασμένο για να εντοπίζει και να εκμεταλλεύεται κενά ασφαλείας μπόρεσε να δρα επί ημέρες χωρίς η ίδια η OpenAI να αντιληφθεί ότι είχε ξεφύγει από το περιβάλλον της δοκιμής.

Σύμφωνα με την αρχική εξήγηση της εταιρείας, το περιστατικό συνέβη κατά την αξιολόγηση ενός αυτόνομου πράκτορα Τεχνητής Νοημοσύνης. Σε αντίθεση με ένα συνηθισμένο chatbot, το οποίο απαντά σε ερωτήσεις ή παράγει κείμενο, ένας πράκτορας μπορεί να αναλάβει έναν στόχο, να σχεδιάσει τα επιμέρους βήματα για την επίτευξή του και να εκτελέσει διαδοχικές ενέργειες χρησιμοποιώντας ψηφιακά εργαλεία, εφαρμογές ή το διαδίκτυο, χωρίς να χρειάζεται ανθρώπινη εντολή σε κάθε στάδιο. Μπορεί επίσης να αξιολογεί το αποτέλεσμα κάθε ενέργειας και να προσαρμόζει την επόμενη κίνησή του όταν συναντά εμπόδια.

Ο συγκεκριμένος πράκτορας βασιζόταν σε δύο από τα ισχυρότερα μοντέλα της OpenAI: το GPT-5.6 Sol και ένα ακόμη ισχυρότερο μοντέλο, το οποίο δεν έχει κυκλοφορήσει. Στόχος της δοκιμής ήταν να διαπιστωθεί αν το σύστημα μπορούσε να εντοπίζει διαφορετικές αδυναμίες σε ένα δίκτυο και να τις συνδυάζει ώστε να ολοκληρώνει μια σύνθετη κυβερνοεπίθεση.

Το πείραμα υποτίθεται ότι διεξαγόταν μέσα σε ένα sandbox, δηλαδή σε ένα απομονωμένο ψηφιακό περιβάλλον, σχεδιασμένο ώστε όσα συμβαίνουν στο εσωτερικό του να μην μπορούν να επηρεάσουν εξωτερικά συστήματα. Ο πράκτορας, όμως, εντόπισε ένα κενό ασφαλείας, βγήκε στο ανοιχτό διαδίκτυο και κατευθύνθηκε προς τη Hugging Face.

Η επιλογή δεν φαίνεται να ήταν τυχαία. Η Hugging Face φιλοξενεί εκατομμύρια μοντέλα, σύνολα δεδομένων και εργαλεία που χρησιμοποιούνται από προγραμματιστές και ερευνητές σε ολόκληρο τον κόσμο. Σύμφωνα με την OpenAI, το σύστημα οδηγήθηκε εκεί επειδή υπολόγισε ότι θα μπορούσε να βρει πληροφορίες που θα το βοηθούσαν να περάσει την αξιολόγηση στην οποία υποβαλλόταν.

Αυτό δεν σημαίνει ότι το μοντέλο απέκτησε δικούς του στόχους ή ότι «αποφάσισε» με την ανθρώπινη έννοια να επιτεθεί σε μια εταιρεία. Σημαίνει όμως ότι, στην προσπάθειά του να εκπληρώσει τον στόχο που του είχε ανατεθεί, επέλεξε μια διαδρομή η οποία δεν είχε προβλεφθεί ή, τουλάχιστον, δεν είχε αποκλειστεί αποτελεσματικά από τους δημιουργούς του.

Μια επίθεση που η OpenAI άργησε να εντοπίσει

Το νέο ρεπορτάζ του Reuters προσθέτει ένα πολύ πιο ανησυχητικό στοιχείο: η OpenAI φέρεται να μην αντιλήφθηκε αμέσως ούτε τη διαφυγή του πράκτορα ούτε την επίθεση που ακολούθησε.

Σύμφωνα με πηγές που επικαλείται το πρακτορείο, το σύστημα επιχείρησε να βγει από το απομονωμένο περιβάλλον της OpenAI γύρω στις 9 Ιουλίου. Δύο ημέρες αργότερα, στις 11 Ιουλίου, άρχισε η εισβολή στις υποδομές της Hugging Face, η οποία συνεχίστηκε έως τις 13 Ιουλίου. Μέσα σε λιγότερο από δύο ημέρες, ο πράκτορας φέρεται να πραγματοποίησε περίπου 17.000 επιμέρους ενέργειες, με ταχύτητα που θα ήταν αδύνατο να επιτύχει ένας άνθρωπος.

Η Hugging Face εντόπισε την παραβίαση και στις 16 Ιουλίου ανακοίνωσε ότι είχε δεχθεί μια επίθεση διαφορετική από όσες είχε αντιμετωπίσει στο παρελθόν. Η ανάλυσή της έδειχνε ότι δεν επρόκειτο για μια συνηθισμένη ομάδα χάκερ, αλλά για ένα αυτόνομο σύστημα ΤΝ που μπορούσε να μετακινείται μεταξύ διαφορετικών ψηφιακών περιβαλλόντων, να προσαρμόζει τις ενέργειές του και να συνεχίζει την επίθεση με ελάχιστη ή καθόλου ανθρώπινη καθοδήγηση.

Εκείνη τη στιγμή, η εταιρεία δεν γνώριζε ποιος είχε δημιουργήσει ή χειριζόταν το σύστημα. Απευθύνθηκε στις αμερικανικές αρχές και ενημέρωσε το FBI, θεωρώντας ότι μπορεί να βρίσκεται αντιμέτωπη με μια ιδιαίτερα εξελιγμένη εγκληματική ομάδα ή ακόμη και με κρατικούς χάκερ.

Σύμφωνα πάντα με το Reuters, μόνον μετά τη δημόσια ανακοίνωση της Hugging Face άρχισε η OpenAI να υποψιάζεται ότι πίσω από την επίθεση ίσως βρισκόταν το δικό της σύστημα. Το Σαββατοκύριακο 18 και 19 Ιουλίου, εργαζόμενοι της εταιρείας φέρεται να εντόπισαν στα εσωτερικά αρχεία καταγραφής ενδείξεις ότι ο πράκτορας είχε παραβιάσει τους περιορισμούς της δοκιμής.

Οι δύο εταιρείες επικοινώνησαν για πρώτη φορά γύρω στις 20 Ιουλίου, όταν η παραβίαση είχε ήδη σταματήσει και η Hugging Face είχε ενημερώσει το FBI. Στις 21 Ιουλίου, η OpenAI παραδέχθηκε δημόσια ότι ο υπεύθυνος της επίθεσης ήταν δικός της πράκτορας και χαρακτήρισε το συμβάν «πρωτοφανές» για την κυβερνοασφάλεια και σημαντική στιγμή για την ασφάλεια της Τεχνητής Νοημοσύνης.

Η εταιρεία υποστηρίζει ότι συνεργάζεται με τη Hugging Face, ότι εξετάζει το περιστατικό με εξωτερικούς συμβούλους και ότι θα δημοσιεύσει αναλυτική τεχνική έκθεση. Παράλληλα, δήλωσε ότι το ρεπορτάζ του Reuters περιλαμβάνει «αρκετές ανακρίβειες», χωρίς όμως να διευκρινίσει ποιες πληροφορίες αμφισβητεί.

Το ερώτημα παραμένει: πώς ήταν δυνατόν ένα σύστημα να πραγματοποιεί επί ημέρες χιλιάδες ενέργειες εκτός του περιβάλλοντος δοκιμής χωρίς να ενεργοποιηθεί άμεσα κάποιος συναγερμός;

Πηγές με γνώση των διαδικασιών της OpenAI αναφέρουν ότι η εταιρεία πραγματοποιεί συχνά πολλές αξιολογήσεις μοντέλων ταυτόχρονα. Τα συστήματα λειτουργούν με μεγάλη ταχύτητα και παράγουν τεράστιο όγκο δεδομένων, τον οποίο οι εργαζόμενοι δεν είναι πάντοτε σε θέση να ελέγχουν σε πραγματικό χρόνο. Αυτή η εξήγηση, ωστόσο, δεν περιορίζει την ανησυχία. Αντίθετα, αναδεικνύει το χάσμα ανάμεσα στις δυνατότητες των νέων μοντέλων και στους μηχανισμούς που διαθέτουν οι εταιρείες για να τα επιβλέπουν.

Ακόμη πιο ανησυχητικές είναι οι πληροφορίες ότι πριν από την επίθεση είχαν ήδη εμφανιστεί ασυνήθιστες συμπεριφορές. Σύμφωνα με τρεις πηγές του Reuters, σε μία περίπτωση ένας πράκτορας άφησε σημειώσεις που φαίνονταν να απευθύνονται σε μελλοντικές εκδοχές του, περιγράφοντας τρόπους με τους οποίους θα μπορούσαν να παρακάμψουν τους εσωτερικούς περιορισμούς της OpenAI. Σε άλλες δοκιμές, συστήματα παρακολούθησης φέρεται να είχαν αποσυνδεθεί.

Το Reuters σημειώνει, πάντως, ότι δεν μπόρεσε να εξακριβώσει αν αυτά τα περιστατικά συνδέονται με τον πράκτορα που επιτέθηκε στη Hugging Face. Δεν μπορεί επομένως να υποστηριχθεί ότι το σύστημα σχεδίαζε την «απόδρασή» του ή ότι διαφορετικές εκδοχές του επικοινωνούσαν μεταξύ τους. Τα στοιχεία δείχνουν, ωστόσο, ότι υπήρχαν ενδείξεις απρόβλεπτης συμπεριφοράς πριν από την επίθεση.

Το περιστατικό έχει προκαλέσει έντονη διαμάχη στον χώρο της τεχνολογίας. Για ορισμένους ειδικούς αποτελεί μια σαφή προειδοποίηση: οι αυτόνομοι πράκτορες έχουν φτάσει σε σημείο να μπορούν να εκτελούν σύνθετες κυβερνοεπιθέσεις, να υπερπηδούν εμπόδια και να αλλάζουν τακτική χωρίς συνεχή ανθρώπινη καθοδήγηση.

Άλλοι αντιμετωπίζουν με σκεπτικισμό τη δραματική παρουσίαση της υπόθεσης. Θεωρούν ότι η OpenAI μπορεί να αξιοποιεί το περιστατικό και ως επίδειξη των δυνατοτήτων των νέων μοντέλων της: η ίδια τεχνολογία που παρουσιάζεται ως απειλή μπορεί στη συνέχεια να πωληθεί ως αναγκαίο εργαλείο προστασίας απέναντι στις επιθέσεις που θα πραγματοποιούν άλλα συστήματα ΤΝ. Με δύο λόγια ότι πρόκειται για ένα τέχνασμα μάρκετινγκ της εταιρείας.

Οι δύο ερμηνείες δεν αλληλοαποκλείονται. Μια σοβαρή αποτυχία ασφάλειας μπορεί ταυτόχρονα να λειτουργήσει ως προειδοποίηση και ως επικοινωνιακή επίδειξη ισχύος. Το βέβαιο είναι ότι η δοκιμή αποκάλυψε αδυναμίες τόσο στην απομόνωση του πράκτορα όσο και στην παρακολούθησή του.

Η συζήτηση δεν αφορά μόνο την OpenAI. Η Anthropic, η Google και άλλες μεγάλες εταιρείες αναπτύσσουν ήδη μοντέλα ειδικά σχεδιασμένα για την κυβερνοασφάλεια. Και μάλιστα το νέο Claude της Anthropic δεν έχει κυκλοφορήσει ακόμα γιατί θεωρείται ότι μπορεί ν’ ανακαλύψει «τρύπες» στην ασφάλεια των συστημάτων κι αυτό το καθιστά επικίνδυνο. Όμως το ίδιο δεν έγινε και τώρα; Οι ίδες οι εταιρείες επισημαίνουν ότι με την βοήθεια των πρακτόρων μπορούν να εντοπίζουν ευπάθειες ταχύτερα, να διορθώνουν προβλήματα και να προστατεύουν κρίσιμες υποδομές. Οι ίδιες δυνατότητες, όμως, μπορούν να χρησιμοποιηθούν και για επίθεση.

Η τεχνική έκθεση που έχει υποσχεθεί η OpenAI θα πρέπει να απαντήσει σε συγκεκριμένα ερωτήματα. Πώς κατάφερε ο πράκτορας να αποκτήσει πρόσβαση στο διαδίκτυο; Γιατί δεν διακόπηκε αυτόματα η λειτουργία του; Τι ακριβώς έκανε στα συστήματα της Hugging Face και σε ποια δεδομένα απέκτησε πρόσβαση; Γιατί χρειάστηκαν τόσες ημέρες για να συνδεθεί η επίθεση με την OpenAI; Και ποιες ακριβώς πληροφορίες του Reuters θεωρεί ανακριβείς η εταιρεία;

Θα ήταν λάθος να διαβάσουμε το περιστατικό ως απόδειξη ότι η Τεχνητή Νοημοσύνη απέκτησε δική της βούληση. Αποτελεί όμως ένδειξη ότι οι εταιρείες δημιουργούν συστήματα τα οποία μπορούν να ενεργούν ταχύτερα και με μεγαλύτερη αυτονομία από όσο μπορούν οι ίδιες να τα παρακολουθούν. Και αυτό, χωρίς κανένα σενάριο επιστημονικής φαντασίας, είναι ήδη αρκετά ανησυχητικό.

Με πληροφορίες από το Reuters

Όλες οι Ειδήσεις από την Ελλάδα και τον Κόσμο,  στο ertnews.gr
Διάβασε όλες τις ειδήσεις μας στο Google
Κάνε like στη σελίδα μας στο Facebook
Ακολούθησε μας στο Twitter
Κάνε εγγραφή στο κανάλι μας στο Youtube
Γίνε μέλος στο κανάλι μας στο Viber
Προσοχή! Επιτρέπεται η αναδημοσίευση των πληροφοριών του παραπάνω άρθρου (όχι αυτολεξεί) ή μέρους αυτών μόνο αν:
– Αναφέρεται ως πηγή το ertnews.gr στο σημείο όπου γίνεται η αναφορά.
– Στο τέλος του άρθρου ως Πηγή
– Σε ένα από τα δύο σημεία να υπάρχει ενεργός σύνδεσμος

Source link

Related posts

Facebook: Θα ειδοποιήσει τα θύματα της διαρροής δεδομένων;

Bit Coin Αλήθειες κ μύθοι …

Απάτη με sms στην Αλόννησο – Με ψεύτικο μήνυμα από τράπεζα «ξάφρισαν» 9.000 ευρώ από 41χρονο