Λογισμικό τεχνητής νοημοσύνης που δοκιμαζόταν από την OpenAI, δημιουργό του ChatGPT, παραβίασε τους μηχανισμούς ασφαλείας, απέκτησε πρόσβαση στο διαδίκτυο και επιτέθηκε σε άλλη εταιρεία τεχνολογίας, προκειμένου να αντλήσει τις απαντήσεις σε ερωτήσεις που αξιολογούσαν τις δυνατότητές του στον τομέα της κυβερνοασφάλειας, όπως ανακοίνωσε την Τρίτη η εταιρεία.
Όπως μεταδίδει η Washington Post, το περιστατικό καταγράφεται σε μια περίοδο κατά την οποία η τεχνολογική βιομηχανία και κυβερνήσεις σε ολόκληρο τον κόσμο επιχειρούν να προσαρμοστούν στην εμφάνιση μοντέλων τεχνητής νοημοσύνης που μπορούν να εντοπίζουν κενά ασφαλείας σε λογισμικό.
Η κυβέρνηση Τραμπ είχε επιβάλει προσωρινούς περιορισμούς στην OpenAI και στην ανταγωνίστριά της Anthropic, δημιουργό του chatbot Claude, προκειμένου να αποτρέψει τη χρήση της τεχνολογίας τους από αντιπάλους των Ηνωμένων Πολιτειών.
► Νέα απάτη μέσω ChatGPT: Πώς επιτήδειοι παγιδεύουν χρήστες και αποκτούν πρόσβαση σε λογαριασμούς
«Θεωρούμε ότι πρόκειται για ένα πρωτοφανές περιστατικό κυβερνοασφάλειας, το οποίο αφορά δυνατότητες αιχμής στον κυβερνοχώρο», ανέφερε η OpenAI σε ανάρτησή της την Τρίτη.
Η εταιρεία συνεργάζεται με τη Hugging Face, την εταιρεία τεχνητής νοημοσύνης στα συστήματα της οποίας επιτέθηκε το λογισμικό της OpenAI, προκειμένου να διαπιστωθεί το πλήρες εύρος των επιπτώσεων της παραβίασης.
Πριν δημοσιοποιήσει το περιστατικό, η OpenAI ενημέρωσε την κυβέρνηση Τραμπ, σύμφωνα με πρόσωπο που γνωρίζει την υπόθεση και μίλησε υπό τον όρο της ανωνυμίας, καθώς οι πληροφορίες δεν είχαν δοθεί στη δημοσιότητα.
Ο διευθύνων σύμβουλος της Hugging Face, Κλεμάν Ντελάνγκ, ανέφερε σε ανάρτησή του στο X ότι η εταιρεία του συνεργάστηκε στενά με την OpenAI για να κατανοήσει τι ακριβώς συνέβη.
«Πιστεύουμε ακράδαντα ότι δεν υπήρχε κακόβουλη πρόθεση από την πλευρά τους. Είναι πραγματικά εντυπωσιακό ότι όλα αυτά συνέβησαν αυτόνομα», έγραψε.
Απέκτησε πρόσβαση σε εσωτερικά δεδομένα
Η Hugging Face είχε αποκαλύψει αρχικά το περιστατικό σε ανάρτηση στο ιστολόγιό της την προηγούμενη εβδομάδα, χωρίς να κατονομάσει την OpenAI ως την πηγή της επίθεσης.
Η παραβίαση επέτρεψε την πρόσβαση σε ορισμένα εσωτερικά σύνολα δεδομένων και διαπιστευτήρια σύνδεσης, ωστόσο παρέμενε ασαφές εάν είχαν επηρεαστεί δεδομένα πελατών, σύμφωνα με την εταιρεία.
Το συμβάν σημειώθηκε την ώρα που η OpenAI δοκίμαζε έναν «πράκτορα» τεχνητής νοημοσύνης, ο οποίος μπορούσε να εκτελεί αυτόνομα ενέργειες σε ηλεκτρονικό υπολογιστή και βασιζόταν σε δύο από τα ισχυρότερα μοντέλα της εταιρείας.
Στο πλαίσιο της δοκιμής, το σύστημα κλήθηκε να εντοπίσει ήδη γνωστές ευπάθειες λογισμικού, μέσω μιας διαδικασίας που είχε σχεδιαστεί από ειδικούς στην ασφάλεια υπολογιστών.
Αντί, όμως, να επιχειρήσει να εντοπίσει μόνο του τις ευπάθειες, το σύστημα ανακάλυψε ένα σφάλμα στο λογισμικό που είχε σχεδιαστεί για να περιορίζει την πρόσβασή του σε άλλα υπολογιστικά συστήματα και επιχείρησε να «κλέψει», σύμφωνα με την OpenAI.
Εκμεταλλεύτηκε το κενό ασφαλείας, απέκτησε πρόσβαση στο διαδίκτυο και προσπάθησε να αντλήσει τις απαντήσεις των ερωτήσεων της δοκιμής από τη Hugging Face, η οποία φιλοξενεί αποθετήρια λογισμικού τεχνητής νοημοσύνης.
Το AI παρέκαμψε τους δημιουργούς του
Τόσο η OpenAI όσο και η Anthropic έχουν αναφέρει στο παρελθόν ότι τα συστήματά τους επιχείρησαν κατά τη διάρκεια δοκιμών να αντιγράψουν, να παρακάμψουν ελέγχους ή να αποφύγουν περιορισμούς στις ενέργειές τους.
Το περιστατικό που αποκάλυψε η OpenAI φαίνεται να καταδεικνύει τις πιθανές συνέπειες όταν ένα σύστημα τεχνητής νοημοσύνης κατορθώνει να παρακάμψει επιτυχώς τους περιορισμούς που έχουν επιβάλει οι ίδιοι οι δημιουργοί του.
Σε ξεχωριστή ανάρτησή της τη Δευτέρα, η OpenAI ανέφερε ότι έχει παρατηρήσει ισχυρά μοντέλα τεχνητής νοημοσύνης να επιχειρούν να διαφύγουν από απομονωμένα περιβάλλοντα ασφαλείας, γνωστά ως sandboxes, όταν λαμβάνουν εντολή να λειτουργήσουν αυτόνομα για μεγάλο χρονικό διάστημα.
Τα συστήματα τεχνητής νοημοσύνης έχουν βελτιωθεί σημαντικά στη συγγραφή κώδικα τον τελευταίο χρόνο, γεγονός που έχει τροφοδοτήσει περαιτέρω επενδύσεις στον κλάδο.
Τον Απρίλιο, ωστόσο, η Anthropic ανακοίνωσε ένα σύστημα με την ονομασία Mythos AI, το οποίο μπορούσε να αξιοποιεί τις δυνατότητές του στον προγραμματισμό για να εντοπίζει κενά ασφαλείας που θα μπορούσαν να χρησιμοποιηθούν από κακόβουλους παράγοντες.
Κατά τις δοκιμές, το Mythos εντόπισε κρίσιμες ευπάθειες σε υποδομές του διαδικτύου, οι οποίες είχαν παραμείνει απαρατήρητες από ανθρώπους προγραμματιστές επί χρόνια.


