Ερευνητές χρησιμοποίησαν το Claude για να χακάρουν την OpenAI

Ερευνητές χάκαραν την OpenAI με τη βοήθεια του Claude

Ερευνητές χρησιμοποίησαν το Claude για να χακάρουν την OpenAI

Τρεις ερευνητές κυβερνοασφάλειας κατάφεραν να αποκτήσουν πρόσβαση σε λογαριασμούς εργαζομένων της OpenAI και να φτάσουν σε εσωτερικό αποθετήριο κώδικα της εταιρείας, χρησιμοποιώντας εργαλεία τεχνητής νοημοσύνης, μεταξύ των οποίων το Claude της Anthropic. Η διαδικασία ολοκληρώθηκε σε λιγότερο από 72 ώρες και αποκάλυψε δύο αδυναμίες που, όταν συνδυάστηκαν, επέτρεψαν στους ερευνητές να ξεπεράσουν τα όρια ενός απλού φόρουμ υποστήριξης.

Η υπόθεση δεν αφορά μια ανεξέλεγκτη επίθεση του Claude εναντίον του ChatGPT. Οι ερευνητές της εταιρείας Hacktron AI πραγματοποίησαν ελεγχόμενη δοκιμή ασφάλειας, ανέφεραν τα ευρήματά τους στην OpenAI και έλαβαν αμοιβή μέσω του προγράμματος εντοπισμού ευπαθειών της. Η OpenAI επιβεβαίωσε ότι διόρθωσε τα προβλήματα που επέτρεψαν την πρόσβαση.

Η επίθεση ξεκίνησε από το φόρουμ της OpenAI

Το αρχικό σημείο εισόδου ήταν το community.openai.com, το επίσημο φόρουμ της OpenAI, το οποίο λειτουργεί με την πλατφόρμα Discourse. Οι ερευνητές εντόπισαν μια ευπάθεια στη διαδικασία επεξεργασίας εικόνων που ανέβαζαν οι επισκέπτες του φόρουμ. Το πρόβλημα σχετιζόταν με τη βιβλιοθήκη libheif, η οποία χρησιμοποιείται για την αποκωδικοποίηση εικόνων σε μορφές όπως HEIF και HEIC.

Με τη βοήθεια εκδόσεων του Claude Opus, η ομάδα ανέπτυξε έναν τρόπο αξιοποίησης της ευπάθειας. Πρώτα δοκίμασε τη μέθοδο σε δική της εγκατάσταση του Discourse και στη συνέχεια επιβεβαίωσε ότι μπορούσε να εκτελέσει κώδικα και στο φόρουμ της OpenAI. Με απλά λόγια, μια αδυναμία στον τρόπο με τον οποίο το φόρουμ διαχειριζόταν ορισμένες εικόνες επέτρεψε στους ερευνητές να αποκτήσουν δυνατότητες που κανονικά δεν θα έπρεπε να έχουν.

Η συγκεκριμένη ευπάθεια είχε ήδη διορθωθεί στον αρχικό κώδικα της βιβλιοθήκης περίπου έναν χρόνο νωρίτερα. Ωστόσο, δεν είχε χαρακτηριστεί τότε ως πρόβλημα ασφάλειας και δεν είχε λάβει αναγνωριστικό CVE, με αποτέλεσμα η διόρθωση να μη φτάσει εγκαίρως σε όλες τις εγκαταστάσεις που τη χρησιμοποιούσαν.

Πώς απέκτησαν πρόσβαση σε λογαριασμούς ChatGPT και Codex

Η παραβίαση του φόρουμ ήταν μόνο το πρώτο στάδιο. Το σημαντικότερο πρόβλημα προέκυψε από τον τρόπο με τον οποίο το φόρουμ συνδεόταν με τους λογαριασμούς της OpenAI.

Οι επισκέπτες μπορούσαν να συνδεθούν στο Discourse χρησιμοποιώντας τον λογαριασμό τους στην OpenAI. Όμως, τα ψηφιακά διαπιστευτήρια που δημιουργούνταν για αυτή τη σύνδεση είχαν περισσότερα δικαιώματα από όσα χρειάζονταν. Έτσι, η πρόσβαση στο φόρουμ μπορούσε να μετατραπεί σε πρόσβαση σε συνδεδεμένους λογαριασμούς ChatGPT και Codex.

Η αδυναμία αυτή δεν περιοριζόταν θεωρητικά σε έναν συγκεκριμένο εργαζόμενο. Σύμφωνα με τους ερευνητές, μπορούσε να επηρεάσει λογαριασμούς ανθρώπων που είχαν συνδεθεί στο φόρουμ, εφόσον πληρούνταν οι σχετικές προϋποθέσεις. Η ύπαρξη επιπλέον συνδέσεων με υπηρεσίες τρίτων δημιουργούσε και άλλες πιθανές διαδρομές πρόσβασης, χωρίς αυτό να σημαίνει ότι οι ερευνητές εκμεταλλεύτηκαν όλες αυτές τις δυνατότητες.

Έφτασαν σε εσωτερικό αποθετήριο κώδικα χωρίς να κατεβάσουν τα αρχεία

Για να αποδείξει τη σοβαρότητα του προβλήματος, η ομάδα απέκτησε πρόσβαση σε λογαριασμό εργαζομένου της OpenAI που είχε συνδέσει το Codex με την εταιρική οργάνωση στο GitHub. Μέσω αυτής της σύνδεσης, οι ερευνητές μπόρεσαν να φτάσουν σε εσωτερικό αποθετήριο κώδικα και να υποβάλουν ένα pull request, δηλαδή μια πρόταση αλλαγής σε αρχείο του αποθετηρίου.

Η ενέργεια έγινε ως απόδειξη της πρόσβασης και όχι με σκοπό την αλλοίωση του λογισμικού. Οι ερευνητές δήλωσαν ότι δεν κατέβασαν ούτε εξέτασαν τον εσωτερικό κώδικα. Η OpenAI ανέφερε ότι από τη δική της διερεύνηση προέκυψε περιορισμένη ανάγνωση μεταδεδομένων και καταχωρίσεων αλλαγών ιδιωτικού αποθετηρίου, καθώς και η υποβολή της πρότασης αλλαγής σε αρχείο README.

Η διάκριση είναι σημαντική. Η ομάδα απέδειξε ότι μπορούσε να φτάσει σε εσωτερικούς πόρους, αλλά δεν υπάρχουν στοιχεία ότι αντέγραψε ολόκληρο το αποθετήριο ή απέκτησε πρόσβαση σε όλα τα συστήματα της OpenAI.

Το Claude βοήθησε στην επίθεση, αλλά δεν ενήργησε μόνο του

Ο τίτλος της είδησης τραβά την προσοχή επειδή το Claude ανήκει στην Anthropic, μία από τις εταιρείες που ανταγωνίζονται την OpenAI στην ανάπτυξη προηγμένων μοντέλων τεχνητής νοημοσύνης. Ωστόσο, το περιστατικό δεν ήταν μια αυτόνομη «σύγκρουση» δύο AI.

Οι ερευνητές καθόρισαν τον στόχο, αξιολόγησαν τις ευπάθειες και χρησιμοποίησαν εργαλεία AI για να επιταχύνουν την τεχνική εργασία. Το Claude συνέβαλε στην ανάπτυξη της μεθόδου εκμετάλλευσης της ευπάθειας, ενώ η ομάδα ανέφερε ότι χρησιμοποίησε σε μεγάλο βαθμό και το GPT-5.6 Sol της ίδιας της OpenAI κατά τη διάρκεια της έρευνας.

Το στοιχείο που ξεχωρίζει είναι ο χρόνος. Η Hacktron αναφέρει ότι χρειάστηκε λιγότερες από 72 ώρες από τον αρχικό εντοπισμό του προβλήματος μέχρι την επίδειξη πρόσβασης στο εσωτερικό αποθετήριο. Η χρήση AI δεν καταργεί την ανάγκη για γνώσεις κυβερνοασφάλειας, μπορεί όμως να μειώσει σημαντικά τον χρόνο που απαιτείται για την ανάλυση κώδικα, τη δοκιμή διαφορετικών προσεγγίσεων και την ανάπτυξη εργαλείων.

Η OpenAI διόρθωσε τις ευπάθειες και πλήρωσε 6.500 δολάρια

Η Hacktron γνωστοποίησε το πρόβλημα πρόσβασης λογαριασμών στην OpenAI μέσω του προγράμματος αναφοράς ευπαθειών της. Η εταιρεία επιβεβαίωσε τη διόρθωση περίπου 14 ώρες μετά την αναφορά, σύμφωνα με τα στοιχεία που δημοσιοποιήθηκαν. Περιόρισε τα δικαιώματα των διαπιστευτηρίων σύνδεσης του φόρουμ και ανακάλεσε τα επηρεαζόμενα διαπιστευτήρια και τις σχετικές συνεδρίες.

Η ευπάθεια της βιβλιοθήκης εικόνων αναφέρθηκε ξεχωριστά στην ομάδα του Discourse, η οποία προχώρησε σε διόρθωση και πρόσθεσε επιπλέον απομόνωση στη διαδικασία επεξεργασίας εικόνων. Για το εύρημα που αφορούσε τα συστήματά της, η OpenAI κατέβαλε στους ερευνητές 6.500 δολάρια μέσω του προγράμματος ανταμοιβής για τον εντοπισμό σφαλμάτων.

Τι σημαίνει η υπόθεση για την ασφάλεια των εφαρμογών AI;

Το περιστατικό αναδεικνύει δύο διαφορετικά ζητήματα. Το πρώτο είναι ότι μια ευπάθεια σε υπηρεσία τρίτου κατασκευαστή μπορεί να αποτελέσει το αρχικό βήμα για πρόσβαση σε πολύ πιο ευαίσθητα συστήματα, ιδιαίτερα όταν οι υπηρεσίες μοιράζονται μηχανισμούς σύνδεσης. Το δεύτερο είναι ότι τα προηγμένα μοντέλα AI μπορούν να επιταχύνουν σημαντικά την έρευνα κυβερνοασφάλειας.

Η ίδια δυνατότητα μπορεί να αξιοποιηθεί από ερευνητές που εντοπίζουν και αναφέρουν υπεύθυνα προβλήματα, αλλά και από κακόβουλους παράγοντες. Στην περίπτωση της Hacktron, η ομάδα σταμάτησε τη δοκιμή αφού απέδειξε την πρόσβαση και ενημέρωσε την OpenAI, δίνοντας στην εταιρεία τη δυνατότητα να διορθώσει τις αδυναμίες.

Το ουσιαστικό συμπέρασμα δεν είναι ότι το Claude «νίκησε» το ChatGPT. Είναι ότι τρεις ερευνητές, με τη βοήθεια διαφορετικών εργαλείων τεχνητής νοημοσύνης, κατάφεραν μέσα σε λίγες ημέρες να συνδυάσουν δύο ευπάθειες και να φτάσουν από ένα δημόσιο φόρουμ σε εσωτερικό αποθετήριο κώδικα. Αυτό δείχνει πόσο σημαντικά είναι τα περιορισμένα δικαιώματα πρόσβασης, οι έγκαιρες ενημερώσεις ασφαλείας και ο έλεγχος των συνδέσεων ανάμεσα σε διαφορετικές υπηρεσίες.

Panagiotis Notis
notispv@gmail.com

Συντάκτης του TechSmart καθώς και άλλων επιτυχημένων blog. Η αρθογραφία μαζί με την παροχή υπηρεσιών διαδικτύου και SEO αποτελούν τις κύριες ενασχολίες του.

No Comments

Post A Comment