Οι «Οδύσσειες» είναι των ημερών. Ωστόσο, πέρα από την πιο πρόσφατη κινηματογραφική εκδοχή του ομηρικού έπους από τον Κρίστοφερ Νόλαν, μια άλλη «Οδύσσεια του Διαστήματος», όπως ήταν εκείνη του Αρθουρ Κλαρκ που έγινε ταινία από τον Στάνλεϊ Κιούμπρικ, μοιάζει εξίσου επίκαιρη. Σε αυτήν πρωταγωνιστής είναι ένας έξυπνος υπολογιστής, ο HAL 9000, ο οποίος αποφασίζει σε μια κρίσιμη στιγμή της ταινίας να αυτονομηθεί.
Στην πραγματική ζωή πια, ο πρωταγωνιστής αυτός θα μπορούσε να λέγεται Claude ή Mythos, όπως τα έξυπνα προγράμματα τεχνητής νοημοσύνης της αμερικανικής εταιρείας Anthropic. Οπως αποκάλυψε χθες ο κατασκευαστής τους, υπό δοκιμήν συστήματα τεχνητής νοημοσύνης –τα «ξαδέλφια» του Claude και του Mythos– νωρίτερα φέτος «διέφυγαν» στο Διαδίκτυο κατά τη διάρκεια δοκιμών και εν συνεχεία παραβίασαν μόνα τους τα συστήματα τριών εξωτερικών εταιρειών, χωρίς, απ’ ό,τι φαίνεται, να το πάρει κανείς είδηση την ώρα που συνέβη.
Ωστόσο, αυτή η «χειραφέτηση» έξυπνων υπολογιστικών συστημάτων γεννά προβληματισμούς, καθώς είναι η δεύτερη που ανακοινώνεται μέσα σε διάστημα μόλις δύο εβδομάδων.
Η «απόδραση»
Η αποκάλυψη της Anthropic έρχεται με φόντο το ανάλογο περιστατικό το οποίο καταγράφηκε πριν από περίπου δέκα ημέρες από μια άλλη εταιρεία τεχνητής νοημοσύνης, την OpenAI, γνωστή διεθνώς ως δημιουργό του ChatGPT. Ενα δικό της σύστημα τεχνητής νοημοσύνης βρήκε τρόπο να «αποδράσει» από το περιβάλλον δοκιμών και να παραβιάσει, από μόνο του, το σύστημα μιας άλλης εταιρείας τεχνολογίας.
Αυξάνονται οι συζητήσεις σχετικά με το πώς οι τεχνολογικοί κολοσσοί και οι κυβερνήσεις θα πρέπει να «διαχειριστούν» τις δυνατότητες πιο εξελιγμένων προγραμμάτων ΑΙ.
Οπως γράφει η Washington Post, οι νέες κυβερνοεπιθέσεις του μοντέλου της Anthropic ενδέχεται να ρίξουν λάδι στη φωτιά των διαρκώς εντεινόμενων συζητήσεων γύρω από το ενδεχόμενο κάποια προηγμένα μοντέλα τεχνητής νοημοσύνης να προκαλέσουν εκτεταμένα προβλήματα ασφαλείας. Το εν λόγω σενάριο έχει ταρακουνήσει τον τεχνολογικό κλάδο και έχει προετοιμάσει το έδαφος για κρατικές παρεμβάσεις με στόχο τον περιορισμό των πιθανών ή επαπειλούμενων κινδύνων.
Σε ανάρτηση στον ιστότοπό της, η Anthropic σημείωσε χθες ότι η προ ημερών αποκάλυψη της OpenAI την ώθησε να εξετάσει τα αρχεία από τις δικές της δοκιμές μοντέλων τεχνητής νοημοσύνης. Ετσι, η αμερικανική εταιρεία ανακάλυψε ότι, σε τρεις περιπτώσεις, μοντέλα τεχνητής νοημοσύνης που κλήθηκαν να παραβιάσουν λογισμικό που δημιουργήθηκε αποκλειστικά για να τεστάρει τις δεξιότητές τους διέφυγαν από το ελεγχόμενο περιβάλλον και βγήκαν στο Διαδίκτυο, όπου εν συνεχεία χάκαραν πραγματικές εταιρείες.
Οι παραβιάσεις αυτές δεν είχαν γίνει αντιληπτές από την Anthropic ούτε και από τις ίδιες τις εταιρείες-στόχους, μέχρι τον έλεγχο που πραγματοποίησε η πρώτη αυτή την εβδομάδα, γράφει η Post. Εκπρόσωπος του αμερικανικού κολοσσού της AI αρνήθηκε να κατονομάσει τις εταιρείες που παραβιάστηκαν από το δικό της λογισμικό τεχνητής νοημοσύνης.
Στην ίδια ανάρτηση, η Anthropic εξηγεί πως οι παραβιάσεις προέκυψαν επειδή μια τρίτη εταιρεία με την επωνυμία Irregular, την οποία προσέλαβε για να βοηθήσει στη δοκιμή των μοντέλων της, παρείχε στα «εξεγερμένα» προγράμματα πρόσβαση στο Διαδίκτυο λόγω μιας «παρεξήγησης».
«Εκτιμούμε τη συνεργασία και τη διαφάνεια της Anthropic και προσβλέπουμε στη συνέχιση της συνεργασίας μας με στόχο την προώθηση της ασφάλειας», ανέφερε εκπρόσωπος της Irregular. Και οι δύο εταιρείες ανακοίνωσαν ότι συνεχίζουν να διερευνούν τα περιστατικά.
Η OpenAI εξηγεί
Από την πλευρά της, η OpenAI ανέφερε την περασμένη εβδομάδα ότι ένας «πράκτορας» τεχνητής νοημοσύνης, κατά τη διάρκεια δοκιμών, παρέκαμψε την εντολή που του είχε δοθεί να αντιμετωπίσει ένα ζήτημα κυβερνοασφάλειας και χρησιμοποίησε μια προηγουμένως άγνωστη ευπάθεια στο περιβάλλον δοκιμών της εταιρείας για να αποκτήσει πλήρη πρόσβαση στο Διαδίκτυο. Σε διάστημα πέντε ημερών εισέβαλε σε πολλούς εξωτερικούς υπολογιστές, για να «χακάρει» τελικά την εταιρεία λογισμικού τεχνητής νοημοσύνης Hugging Face, αναζητώντας απαντήσεις στο ζήτημα που έπρεπε να λύσει.
Αυτά τα δύο επεισόδια –με πρωταγωνίστριες την OpenAI και την Anthropic– ήρθαν στο φως ενώ είναι σε εξέλιξη μια ευρύτερη συζήτηση σχετικά με το πώς οι τεχνολογικοί κολοσσοί και η αμερικανική κυβέρνηση (αλλά και οι κυβερνήσεις ευρύτερα) θα πρέπει να «διαχειριστούν» την ικανότητα των πιο εξελιγμένων μοντέλων τεχνητής νοημοσύνης να εντοπίζουν ευάλωτα σημεία σε συστήματα κυβερνοασφάλειας, σημειώνει η Washington Post.
Τον περασμένο Απρίλιο η Anthropic ανακοίνωσε το μοντέλο τεχνητής νοημοσύνης Mythos, το οποίο όμως χαρακτήρισε «επικίνδυνα» ισχυρό για να κυκλοφορήσει ευρέως με ασφάλεια. Από την πλευρά της, η OpenAI έχει επίσης αναπτύξει μοντέλα AI με ισχυρές δυνατότητες, τα οποία θα μπορούσαν να χρησιμοποιηθούν για κυβερνοεπιθέσεις.
Τον περασμένο Ιούνιο ο Αμερικανός πρόεδρος Ντόναλντ Τραμπ υπέγραψε εκτελεστικό διάταγμα που στόχο έχει να δώσει στην κυβέρνηση των ΗΠΑ το πλεονέκτημα του να έχει πρώτη εκείνη πρόσβαση σε ισχυρά μοντέλα τεχνητής νοημοσύνης που θα μπορούσαν να θέσουν σε κίνδυνο την ασφάλεια της χώρας.

