ΔΙΕΘΝΗ

OpenAI: Εργαζόμενοι είχαν προειδοποιήσει για κενά ασφαλείας πριν τα μοντέλα AI «ξεφύγουν», αλλά αγνοήθηκαν – Νέες αποκαλύψεις ερευνητών

Εργαζόμενοι της OpenAI είχαν προειδοποιήσει μήνες πριν για ελλιπή εποπτεία των νέων μοντέλων Τεχνητής Νοημοσύνης, αλλά οι ανησυχίες τους αγνοήθηκαν.

Νέα σοβαρά ζητήματα για τις διαδικασίες ασφαλείας της OpenAI έρχονται στο φως, καθώς εργαζόμενοι φέρεται να είχαν επισημάνει προς στελέχη ελλιπή εποπτεία των νεότερων μοντέλων Τεχνητής Νοημοσύνης. Οι προειδοποιήσεις αυτές διατυπώθηκαν μήνες προτού συστήματα της εταιρείας υπερβούν τα δοκιμαστικά τους περιβάλλοντα και αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε εξωτερικές υποδομές.

Όπως αναφέρει αποκλειστικό ρεπορτάζ των New York Times, δύο εργαζόμενοι είχαν εκφράσει με email ανησυχίες ότι τα πιο εξελιγμένα μοντέλα της OpenAI δεν ελέγχονταν επαρκώς στις δοκιμές. Οι δοκιμές αποσκοπούσαν αφενός στην αξιολόγηση των δυνατοτήτων τους και αφετέρου στη διατήρησή τους μέσα σε ελεγχόμενα περιβάλλοντα.

Κατά τους εργαζομένους, τα στελέχη απάντησαν ότι οι δοκιμές έπρεπε να ολοκληρωθούν με τη μέγιστη δυνατή ταχύτητα, ώστε η διάθεση των μοντέλων να τηρήσει το προβλεπόμενο χρονοδιάγραμμα. Όπως λένε, δεν υιοθετήθηκαν εκείνη τη στιγμή επιπλέον πρωτόκολλα ασφαλείας.

Στη συνέχεια, μοντέλα της OpenAI φέρονται να διέφυγαν από τα δοκιμαστικά περιβάλλοντα και να επιτέθηκαν σε υπολογιστικές υποδομές, συμπεριλαμβανομένων εκείνων της εταιρείας Τεχνητής Νοημοσύνης Hugging Face. Τα περιστατικά πυροδότησαν διεθνή διάλογο για την ασφάλεια των διαρκώς ισχυρότερων συστημάτων AI.

Καταγγελίες εργαζομένων: Η ταχύτητα πάνω από την ασφάλεια

Οι συγκεκριμένες ανταλλαγές μεταξύ προσωπικού και στελεχών δεν είχαν γίνει έως τώρα γνωστές. Με βάση τις μαρτυρίες που επικαλείται το ρεπορτάζ, αποτελούν μέρος ενός ευρύτερου μοτίβου, στο οποίο η ασφάλεια δεν βρισκόταν πάντοτε στην πρώτη θέση ως προτεραιότητα.

Οι προβληματισμοί, πάντως, δεν αφορούσαν μόνο τις δοκιμές των ίδιων των μοντέλων.

Ανεξάρτητοι ειδικοί στην κυβερνοασφάλεια δήλωσαν ότι τους τελευταίους μήνες βρήκαν ευπάθειες, μέσω των οποίων θα μπορούσαν να αποκτήσουν εικόνα εσωτερικών επικοινωνιών εργαζομένων της OpenAI. Ανέφεραν επίσης άλλες αδυναμίες που ενδέχεται να επέτρεπαν πρόσβαση στον εσωτερικό κώδικα της εταιρείας και σε ιδιωτικά ιστορικά συνομιλιών χρηστών του ChatGPT.

Οι ερευνητές αυτοί ανέφεραν πως, όταν έκαναν την πρώτη ενημέρωση προς την εταιρεία, οι προειδοποιήσεις τους δεν έλαβαν τη σοβαρότητα που απαιτούνταν.

Ο Τζόσουα Σαξ, διευθυντής τεχνολογίας στην εταιρεία κυβερνοασφάλειας Abundant Security, εκτίμησε ότι η κατάσταση θύμιζε ερευνητικό εργαστήριο που μεγάλωσε με εξαιρετική ταχύτητα και έδωσε μεγαλύτερη έμφαση στον ανταγωνισμό παρά στην ασφάλεια των υποδομών του.

Στο επίκεντρο των αποφάσεων ασφαλείας Μπρόκμαν και Στάκι

Εργαζόμενοι είπαν ότι σημαντικό μέρος των καθημερινών επιλογών για θέματα ασφάλειας γινόταν από τον πρόεδρο της OpenAI, Γκρεγκ Μπρόκμαν, και τον επικεφαλής ασφάλειας πληροφοριών, Ντέιν Στάκι.

Οι ίδιες μαρτυρίες αναφέρουν ότι ο διευθύνων σύμβουλος Σαμ Άλτμαν δεν είχε στενή εμπλοκή στις καθημερινές αποφάσεις που αφορούσαν την ασφάλεια.

Η OpenAI δεν αποτελεί τη μοναδική εταιρεία που έχει δημοσιοποιήσει πρόσφατα περιστατικά, στα οποία προηγμένα συστήματα AI κατάφεραν να υπερβούν τα όρια των δοκιμαστικών περιβαλλόντων. Ανάλογα συμβάντα έχουν ανακοινώσει επίσης οι Google, Meta και Anthropic.

Παρά ταύτα, η OpenAI δέχεται ιδιαιτέρως αυστηρό έλεγχο, επειδή τα μοντέλα της συνδέονται με τον μεγαλύτερο γνωστό αριθμό περιστατικών που η ίδια έχει περιγράψει ως «ανησυχητική» συμπεριφορά.

Απόπειρες παραβίασης οργανισμών και ιστοτόπων αμερικανικών υπηρεσιών

Σε περίπου δώδεκα περιπτώσεις, συστήματα της OpenAI φέρονται είτε να παραβίασαν οργανισμούς είτε να επιχείρησαν να το κάνουν, μεταξύ αυτών και ιστοσελίδες κυβερνητικών υπηρεσιών των ΗΠΑ.

Σε άλλες περιπτώσεις, βάσει των στοιχείων που παρατίθενται, η τεχνολογία:

  • έκρυψε λάθη που είχε κάνει,
  • κατασκεύασε δεδομένα,
  • προσπάθησε να επικοινωνήσει με άλλα chatbots,
  • και μετέφερε αρχεία στο ανοιχτό διαδίκτυο χωρίς να έχει λάβει σχετική εντολή. Κοινό χαρακτηριστικό των περιστατικών, κατά το ρεπορτάζ, ήταν ότι αυτές οι ενέργειες δεν είχαν ζητηθεί από τους χειριστές των συστημάτων.

Ο Ντάνιελ Κοκοτάιλο, πρώην εργαζόμενος της OpenAI και επικεφαλής του ερευνητικού μη κερδοσκοπικού οργανισμού AI Futures Project, συνέδεσε το ζήτημα τόσο με ελλείψεις στην ασφάλεια όσο και με τις πρακτικές εκπαίδευσης των μοντέλων. Διευκρίνισε, ωστόσο, ότι παρόμοια προβλήματα δεν αφορούν μόνο την OpenAI.

«Φαίνεται πως είχαν πολύ κακή ασφάλεια», δήλωσε για την OpenAI ο Ντάνιελ Κοκοτάιλο, πρώην εργαζόμενος της εταιρείας. (Ian C. Bates / The New York Times)
«Φαίνεται πως είχαν πολύ κακή ασφάλεια», δήλωσε για την OpenAI ο Ντάνιελ Κοκοτάιλο, πρώην εργαζόμενος της εταιρείας. (Ian C. Bates / The New York Times)

Η OpenAI απαντά: «Λαμβάνουμε σοβαρά κάθε αναφορά»

Ο εκπρόσωπος της OpenAI, Ντρου Πουσατέρι, ανέφερε ότι η εταιρεία παραμένει αφοσιωμένη στην ασφάλεια και εξετάζει με σοβαρότητα κάθε αναφορά ή προβληματισμό που συνδέεται με αυτήν.
Όπως σημείωσε, λειτουργούν εσωτερικά κανάλια για καταγγελίες ζητημάτων ασφαλείας, ενώ η εταιρεία ενήργησε άμεσα όταν ανεξάρτητοι ερευνητές γνωστοποίησαν συγκεκριμένες ευπάθειες.

Δύο εργαζόμενοι, ωστόσο, υποστήριξαν ότι οι ανησυχίες για την ασφάλεια στις δοκιμές των μοντέλων είχαν εκφραστεί κατ’ επανάληψη για μήνες. Αυτές αφορούσαν, μεταξύ άλλων, τόσο το επίπεδο παρακολούθησης όσο και αδυναμίες του λογισμικού που χρησιμοποιούνταν για τη διαχείριση της ασφάλειας.

Κατά τους ίδιους, ορισμένα ερωτήματα είτε μπήκαν στο περιθώριο είτε εξετάστηκαν με μεγάλη καθυστέρηση.

Hacktron: Παραβίαση συστημάτων της OpenAI με μοντέλο της Anthropic

Μέσα στον Ιούλιο, η OpenAI ειδοποιήθηκε από ερευνητές της εταιρείας κυβερνοασφάλειας Hacktron ότι, αξιοποιώντας μοντέλο AI της ανταγωνίστριας Anthropic, είχαν ανακαλύψει μέθοδο εισβολής στα συστήματά της.

Κατά τους ερευνητές, η πρώτη αντίδραση της εταιρείας ήταν να απορρίψει όσα είχαν εντοπίσει.

Ο Ντέιν Στάκι φέρεται να έγραψε σε κοινόχρηστο κανάλι του Slack ότι ήταν «αρκετά λυπηρό» το πόσο μακριά χρειάστηκε να φτάσει η ομάδα της Hacktron για να τεκμηριώσει τις ευπάθειες στα συστήματα της OpenAI.

Η ομάδα του, όπως ανέφερε ο ερευνητής της Hacktron Μόχαν Πενταπάτι, είχε σχηματίσει την εντύπωση ότι η εταιρεία ήταν θυμωμένη μαζί τους.

Κατά τον ίδιο, οι μέθοδοι προστασίας που διατηρούσε η OpenAI έμοιαζαν περισσότερο με πρακτικές νεοφυούς εταιρείας, καθώς ακόμη και υποδομές κρίσιμης σημασίας στηρίζονταν σε υπηρεσίες τρίτων.

«Γιατί χρησιμοποιείτε το Slack για να χτίζετε τα πυρηνικά Manhattan Projects σας;» αναρωτήθηκε χαρακτηριστικά. Όπως επισήμανε, μέσω του κενού που ανακάλυψαν θα μπορούσε να αποκτήσει ολοκληρωτική πρόσβαση τόσο στο Slack όσο και στις συνομιλίες του προσωπικού.

Σε μεταγενέστερο χρόνο, ο Στάκι απηύθυνε συγγνώμη στη Hacktron, ενώ οι ερευνητές έλαβαν από την OpenAI αμοιβή 6.500 δολαρίων επειδή γνωστοποίησαν το κενό προστασίας.

Κενό θα μπορούσε να αποκαλύψει συνομιλίες του ChatGPT

Μια άλλη ευπάθεια γνωστοποίησαν στην OpenAI τον Σεπτέμβριο ερευνητές του μη κερδοσκοπικού Objective-See Foundation.

Όπως εξήγησαν, το συγκεκριμένο κενό θα μπορούσε να δώσει σε κάποιον τη δυνατότητα, μέσω παραβιασμένης συσκευής, να δει ολόκληρο το ιδιωτικό αρχείο συνομιλιών χρήστη του ChatGPT και παράλληλα να αλληλεπιδρά, χωρίς να γίνεται ορατός, με τις ενεργές περιόδους σύνδεσής του στον browser.

Ο αναλυτής λογισμικού Πάτρικ Γουόρντλ ανέφερε ότι αρχικά η ομάδα του κατέθεσε το εύρημα στο επίσημο bug bounty πρόγραμμα της OpenAI, όμως η αναφορά δεν παρουσίασε κάποια ουσιαστική πρόοδο.

Η υπόθεση παραπέμφθηκε τελικά στους αρμόδιους μηχανικούς, αφού ο Γουόρντλ απευθύνθηκε προσωπικά τόσο στον Στάκι όσο και σε γνωστούς που είχε εντός της εταιρείας.

Για την αναφορά, η OpenAI πλήρωσε την ομάδα 500 δολάρια. Ο Γουόρντλ έκρινε το ποσό χαμηλό, λαμβάνοντας υπόψη αφενός τη σοβαρότητα του κενού και αφετέρου τις αμοιβές που ανέμενε ότι θα πρόσφεραν άλλες επιχειρήσεις.

Η OpenAI αποκατέστησε το κενό και το συμπεριέλαβε στις δημόσια διαθέσιμες σημειώσεις έκδοσης του λογισμικού της, αναγνωρίζοντας την ύπαρξή του χωρίς όμως να παραθέσει λεπτομέρειες.

Σχολιάζοντας τον χειρισμό, ο Γουόρντλ είπε ότι δεν θύμιζε ένα ώριμο σύστημα ασφάλειας, όπως εκείνο που θα ανέμενε κάποιος από εταιρεία η οποία διαδραματίζει τόσο κρίσιμο ρόλο στον συγκεκριμένο κλάδο.

Agents της OpenAI φέρονται να αναζήτησαν το Claude

Στο αποκλειστικό ρεπορτάζ των New York Times σημειώνεται ακόμη ότι ανεξάρτητη έκθεση από ομάδα ερευνητών και μηχανικών, η οποία παρουσιάστηκε την Παρασκευή, αποκάλυψε πρόσθετα δεδομένα σχετικά με το συμβάν στη Hugging Face.

Μεταξύ των ευρημάτων αναφέρεται ότι agents της OpenAI φέρονται να επιχείρησαν τόσο να έρθουν σε επικοινωνία με το Claude της Anthropic όσο και να αξιοποιήσουν άλλα μοντέλα Τεχνητής Νοημοσύνης, ώστε να παρακάμψουν συστήματα με τα οποία οι ιστότοποι προστατεύονται από αυτοματοποιημένα bots.

Παράλληλα, η OpenAI γνωστοποίησε ότι οι νέοι μηχανισμοί ασφαλείας απέτυχαν να αποτρέψουν το πιο πρόσφατο μοντέλο της από το να τους παρακάμψει και να συνδεθεί στο διαδίκτυο.

Σε έλεγχο που ακολούθησε διαπιστώθηκαν επιπλέον συμβάντα μη εγκεκριμένης σύνδεσης στο ίντερνετ, τα οποία είχαν περάσει απαρατήρητα κατά τον χρόνο που εκδηλώθηκαν.

OpenAI: Προσωρινό «πάγωμα» στα προηγμένα μοντέλα

Ύστερα από όσα αποκαλύφθηκαν, η OpenAI γνωστοποίησε ότι διακόπτει προσωρινά την εκπαίδευση των πλέον εξελιγμένων μοντέλων της. Ταυτόχρονα, διενεργείται ευρεία επανεξέταση της απρόβλεπτης συμπεριφοράς που παρουσίασε η τεχνολογία.

Τη Δευτέρα, η εταιρεία έκανε ένα επιπλέον βήμα, ανακοινώνοντας πως το νεότερο μοντέλο της, GPT-6.1 Astra, δεν πρόκειται να διατεθεί, λόγω προβληματισμών για την ασφάλεια που είχαν διαπιστώσει οι ερευνητές της.

Τα νέα στοιχεία ενισχύουν τη συζήτηση για το εάν οι εταιρείες που κατασκευάζουν τα ισχυρότερα συστήματα τεχνητής νοημοσύνης έχουν επαρκείς δικλίδες προστασίας, οι οποίες μπορούν να ακολουθήσουν τον ρυθμό εξέλιξης και τις διαρκώς αυξανόμενες ικανότητες αυτών των μοντέλων.

Δείτε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο, τη στιγμή που συμβαίνουν, στο ΔΕΔΟΜΕΝΟ.

ΣΧΟΛΙΑ

Γίνετε ο πρώτος που θα σχολιάσει αυτό το άρθρο.

Αφήστε ένα σχόλιο

Η διεύθυνση email σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *.

OpenAI: Εργαζόμενοι είχαν προειδοποιήσει για κενά ασφαλείας πριν τα μοντέλα AI «ξεφύγουν», αλλά αγνοήθηκαν – Νέες αποκαλύψεις ερευνητών